PanGu-Σ
PulseAugur coverage of PanGu-Σ — every cluster mentioning PanGu-Σ across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
中国AI云巨头争夺全球机场广告屏主导权
百度、阿里巴巴集团、腾讯和华为等中国科技巨头正在AI云市场展开竞争,在全球机场屏幕上宣传其能力。这股新的“新云”服务提供商浪潮正在涌现,旨在提供AI原生服务,预示着云计算格局的转变。
-
华为发布openPangu-2.0-Pro,首个在Ascend NPU上训练的5050亿参数模型
华为发布了openPangu-2.0-Pro,一个拥有5050亿参数和512K上下文窗口的大型语言模型。该模型是首个完全在Ascend NPU上训练的前沿模型,标志着减少对NVIDIA硬件依赖方面迈出了重要一步。此次发布包括模型权重、推理代码和技术报告,旨在支持中国本土的计算生态系统。
-
中国AI实验室在分发之外追求独特策略
来自蚂蚁集团Ling模型部门的一位人士发文,强调了中国主要AI实验室所采用的独特策略。与普遍认为的中国AI行业铁板一块不同,阿里巴巴(Qwen)等公司专注于广泛分发,DeepSeek强调开放架构和即时权重发布,而Moonshot则追求长期架构押注。作者所在的蚂蚁集团实验室,通过其Ling-3.0-flash模型优先考虑为长周期代理循环提供成本效益,尽管他们承认发布顺序不理想,延迟了公众获取权重的时机。
-
中国AI实验室追求多元化战略:分发、架构和成本效率
中国AI实验室正在追求独特的战略,而不是作为一个单一的整体运作。阿里巴巴的通义千问专注于跨越不同模型大小和运行时的广泛分发,使其成为微调的热门基础。DeepSeek优先考虑架构创新,同时发布论文和权重,让设计不言而喻。Moonshot旨在实现长期收益,可能牺牲短期排行榜表现以换取未来回报。蚂蚁集团(与阿里巴巴是独立实体)正专注于其Ling模型的服务成本,优化高效的长上下文代理循环,而非峰值性能。
-
中国大语言模型格局从模仿走向竞争
中国的AI实验室已迅速从早期模仿者发展成为大型语言模型领域的有力竞争者。最初专注于改编BERT等西方架构,百度、阿里巴巴和腾讯等中国公司开始开发自己的模型。一个重要的转折点是2021年BAAI发布的拥有1.75万亿参数的Wu Dao 2.0,尽管西方表示怀疑,但它标志着中国在基础模型方面日益增长的雄心。继ChatGPT的全球影响之后,中国出现了大语言模型开发的爆炸式增长,超过200家公司宣布了项目,政府的支持加速了商业部署。