PulseAugur
实时 08:59:51
实体 Qwythos-9B

Qwythos-9B

PulseAugur coverage of Qwythos-9B — every cluster mentioning Qwythos-9B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_145207 ·

    LLM对决:Qwen、Nemotron和Qwythos模型在编码任务上进行测试

    一场本地LLM对决在编码任务上测试了五个模型,揭示了显著的基础设施挑战和不同的性能表现。作者在llama.cpp的工具调用解析器中遇到并修复了两个关键bug,影响了Qwythos-9B和Nemotron-3-Nano。尽管存在这些问题以及模型自身的失败,测试还是提供了关于密集型与混合专家(MoE)架构的见解,其中Qwen 3.6模型和Nemotron-3-Nano是主要竞争者。

  2. SIGNIFICANT · CL_142325 ·

    Empero AI 发布 Qwythos-9B-v2,通过 100 万 token 上下文修复循环问题

    Empero AI 发布了 Qwythos-9B-v2,这是其大型语言模型的更新版本,旨在消除之前影响少量输出的循环和退化问题。新版本通过一种称为“最终 Token 偏好优化”的技术,实现了 0% 的循环率,同时不牺牲其 100 万 token 的上下文窗口或推理能力。内部基准测试显示,Qwythos-9B-v2 在知识和推理任务上的性能保持不变或略有提高,但在编码基准测试分数上略有下降。

  3. TOOL · CL_130334 ·

    Qwythos-9B语言模型在GSM8K、IFEval和HumanEval上进行基准测试

    一位用户对Qwythos-9B语言模型(Qwen 3.5 9B和Claude的微调版本)进行了一系列标准评估。该模型在GSM8K上测试数学推理能力,在IFEval上测试指令遵循能力,在HumanEval上测试代码生成能力。这些测试结果揭示了Qwythos-9B在这些关键领域的优势和局限性。