实体
GigaChat 3.5
GigaChat 3.5
PulseAugur coverage of GigaChat 3.5 — every cluster mentioning GigaChat 3.5 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
GigaChat 3.5 推理基准测试声明因误导性效率指标而受到质疑
对人工智能基准测试表的一项最新分析强调了性能声明呈现方式的差异,并以 GigaChat 3.5 Reasoning 模型和 DeepSeek V4 Flash Preview 为例。虽然 GigaChat 公布的基准测试数字是准确的,但其声称在使用少 37% 的 token 的情况下“媲美”DeepSeek V4 Flash 是具有误导性的。文章指出,GigaChat 在某些评估中获胜,但在其他评估中却显著落败,并且效率指标是基于一套…
-
AI文本模型质量相近但生成俄语内容价格相差130倍
一项对18款AI模型生成俄语文本的最新独立测试显示,尽管GPT-5.4和Claude Opus 4.6等顶级模型的表现几乎相同,但它们的价格却相差130倍。这种显著的成本差异,每次调用费用从0.0008美元到0.1014美元不等,表明经济因素应在内容创作者选择模型时发挥重要作用。测试还突出了俄语文本生成中的具体问题,例如插入非西里尔字母字符以及提示泄露到输出中,这些问题可以通过简单的脚本来缓解。然而,一种更微妙的AI生成文本形式,其特…