Chinese LLMs
PulseAugur coverage of Chinese LLMs — every cluster mentioning Chinese LLMs across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
前OpenAI首席技术官Greg Brockman发布了9750亿参数的开放权重AI模型
由前OpenAI首席技术官Greg Brockman联合创办的Thinking Machines公司发布了一个拥有9750亿参数的开放权重AI模型。此举与OpenAI日益将其前沿模型保密的做法形成对比。该模型旨在提供中国大型语言模型的替代品,并旨在为更广泛的研究和开发提供访问。
-
中国大语言模型扩大网络攻击与防御的差距
中国的(大型)语言模型正在造成网络攻击者与防御者之间显著的差距。这些先进的模型正被攻击者利用来开发更复杂、更强大的网络威胁。因此,防御措施难以跟上这些由人工智能驱动的攻击快速发展的能力。
-
马斯克预测Fable 5的中国AI时间线受到Z.ai首席执行官的挑战 · 追踪4个来源
埃隆·马斯克预测,到2027年第一季度,中国的AI模型将达到Anthropic的Fable 5的水平。然而,中国AI初创公司Z.ai(前身为智谱AI)的首席执行官张杰回应称,不需要那么长时间,暗示了更快的开发时间表。这次交流凸显了中国和美国在先进AI开发方面持续的竞争,Z.ai最近发布了其GLM-5.2模型,据报道该模型可与Anthropic的Opus 4.7-4.8相媲美。
-
AI成本飙升,迫使企业寻求更便宜的中国及开源模型
公司正面临AI服务成本不断攀升的局面,特别是来自OpenAI和Anthropic等提供商的订阅模式,由于高昂的token使用量,其盈利能力不如预期。先进模型的API访问成本远超订阅费用,导致一些公司开始探索更经济的替代方案。这激发了对中国大模型和开源模型的兴趣,它们提供了显著的成本节约,有时可将费用降低高达95%,同时在许多任务中保持相当的能力。
-
OpenRouter 数据揭示:美国 AI 初创公司青睐中国大语言模型
根据 OpenRouter 的数据,美国 AI 初创公司正越来越多地将其流量导向中国的(大型)语言模型。这些中国模型目前占该平台总代币消耗量的 61%。这一趋势表明,美国公司在偏好上发生了重大转变,正逐渐远离国内模型。
-
Minimax M3 大型语言模型未显示政治审查
观察到 Minimax M3 大型语言模型缺乏政治审查,这使其区别于其他 Minimax 模型。这一观察结果来自一位用户正在开发一个专注于中国和中共相关内容的 AI 偏见基准。用户指出,典型的中国大型语言模型存在审查现象,而 M3 在这方面是一个例外。
-
研究发现中文大语言模型存在社会身份偏见
一项新的研究论文通过使用特定于普通话的提示,探讨了中文大语言模型(LLMs)中的社会身份偏见。该研究评估了十个不同的LLMs,重点关注了内群体与外群体框架如何影响与中国背景相关的240个社会群体的观点和毒性得分。研究结果表明,虽然指令调整可以减少观点偏见,但毒性差异仍然存在,并且在某些模型中,使用阴性代词与毒性增加有关。