一款名为 Kimi Linear 48B A3B 的新型大型语言模型已经出现,它拥有 100 万个 token 的上下文窗口,并采用具有 480 亿参数的混合专家(Mixture-of-Experts)架构。用户报告称其运行速度很快,在速度上优于 Qwen 3.6 35B 等模型。虽然能够生成结构化内容,包括动画页面,但一些用户指出其响应可能比较简略,并建议可能需要进行微调以提高其推理或输出质量。 AI
影响 该模型的大上下文窗口和速度可能会影响未来高效 LLM 架构和需要广泛上下文的应用的发展。
排序理由 用户讨论特定 LLM,而非来自前沿实验室的直接发布。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →