A.X K2
PulseAugur coverage of A.X K2 — every cluster mentioning A.X K2 across labs, papers, and developer communities, ranked by signal.
- 2026-09-01 research_milestone A technical report was published detailing the A.X K2 language model, a 688B parameter Mixture-of-Experts model. 来源
-
A.X K2 语言模型发布,拥有 6880 亿参数并专注于智能体应用
一份新的技术报告介绍了 A.X K2,一个拥有 6880 亿参数的混合专家(MoE)语言模型,专为智能体应用而设计。尽管其训练的 token 数量少于其前身 A.X K1,但由于 token 效率的提高和更高质量的训练数据集,A.X K2 在各种基准测试中表现出显著的改进。该模型采用了稀疏门控注意力(SGA)等创新技术,以实现高效的长上下文处理,并采用了门控归一化(GN)技术以实现稳定的大规模训练,在 RULER 和数学任务等基准测试…
-
韩国AI模型因“借鉴”技术和狭隘基准测试面临审查 · 跟踪1个来源
在中国知乎平台上的一场病毒式辩论,对声称超越DeepSeek的韩国人工智能模型浪潮进行了审视。批评集中在几个方面:模型被指控建立在其他实验室的开放权重模型之上(例如SK Telecom的A.X K2使用了阿里巴巴的Qwen2.5),狭隘的基准测试选择忽略了更广泛的性能指标,以及为获得政府资助而进行的声称。在这些批评声中,初创公司VIDRAFT成为一个例外,其Darwin-398B-JGOS模型在GPQA基准测试中取得了特定、可验证的排…
-
SKT发布A.X K2,一个688B参数的MoE语言模型
SKT发布了A.X K2,一个大规模的混合专家(MoE)语言模型。该模型拥有总计6880亿参数,其中330亿为激活参数,旨在提供强大的推理和指令遵循能力,同时保持高效的推理速度。一个关键特性是其混合推理控制,允许用户在用于复杂问题解决的“思考”模式和用于更快、更低延迟响应的“非思考”模式之间进行选择。A.X K2作为韩国政府一项倡议的一部分而开发,目标是成为一个具有深刻理解韩国语言和文化的前沿规模模型。