PulseAugur
中
实时 22:21:31
实体 Ornith-1.5-9B

Ornith-1.5-9B

PulseAugur coverage of Ornith-1.5-9B — every cluster mentioning Ornith-1.5-9B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 4
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 4 条
  1. TOOL · CL_279476 ·

    15个本地LLM模型测试代理/工具使用;qwen/qwen3.8-27b领先

    一位用户使用Toolery基准测试了15个本地大型语言模型在工具和代理使用方面的能力。该基准测试包含四个难度级别的143个场景,每个模型在每个场景下进行3次试验。模型在本地使用LM Studio运行,具有30k token上下文窗口和0.8的温度。qwen/qwen3.8-27b模型以71.8%的总分获得最高分,在简单和中等难度级别中表现尤为出色。

  2. TOOL · CL_256345 ·

    IFM/K2-Horizon-7B模型在16GB显存上进行基准测试,落后于竞争对手

    一位用户在拥有16GB显存的系统上对IFM/K2-Horizon-7B模型进行了基准测试,发现其性能远不如Qwen3.8-27B和Ornith-1.5-9B。尽管模型完全装入16GB显存,K2-Horizon-7B模型仍表现不佳,多项任务超时,一项任务导致代码损坏。基准测试表明,Qwen3.8-27B是最佳性能模型,即使量化不那么理想,而Ornith-1.5-9B则提供了速度和可用性的良好平衡。

  3. COMMENTARY · CL_227596 ·

    用户寻求 Ornith-1.5-9B 模型实际编码性能数据

    r/LocalLLaMA subreddit 上的一位用户正在寻求有关 Ornith-1.5-9B 编码模型的实际使用经验。他们发现 Qwen-3.8-27B 模型在他们的专业编码任务中表现出色,在专用的 RTX 3090 上运行,并取得了令人印象深刻的性能指标。虽然他们已经在一些简单的编码任务上测试过 Ornith-1.5-9B 并取得了一些成功,但他们希望获得官方基准测试之外的更多用户反馈。

  4. SIGNIFICANT · CL_210096 ·

    Ornith-1.5系列开源LLM发布,可与Claude Opus 4.8匹敌

    AI研究组织Ornith发布了Ornith-1.5系列开源大语言模型。该系列模型有三种尺寸:Ornith-1.5-397B、Ornith-1.5-35B-A3B和Ornith-1.5-9B。最大的Ornith-1.5-397B模型在基准测试得分上可与Claude Opus 4.8相媲美,而最小的Ornith-1.5-9B模型经过量化后,能够在智能手机上运行。Ornith-1.5模型采用了自我改进策略进行训练,包含一个AI模型自身提出挑…