PulseAugur
实时 23:35:57

Kimi Linear 48B A3B 模型提供 100 万上下文和快速性能

一款名为 Kimi Linear 48B A3B 的新型大型语言模型已经出现,它拥有 100 万个 token 的上下文窗口,并采用具有 480 亿参数的混合专家(Mixture-of-Experts)架构。用户报告称其运行速度很快,在速度上优于 Qwen 3.6 35B 等模型。虽然能够生成结构化内容,包括动画页面,但一些用户指出其响应可能比较简略,并建议可能需要进行微调以提高其推理或输出质量。 AI

影响 该模型的大上下文窗口和速度可能会影响未来高效 LLM 架构和需要广泛上下文的应用的发展。

排序理由 用户讨论特定 LLM,而非来自前沿实验室的直接发布。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Kimi Linear 48B A3B 模型提供 100 万上下文和快速性能

报道来源 [1]

  1. r/LocalLLaMA TIER_1 (ET) · /u/Atretador ·

    Kimi Linear 48B A3B?

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1v6f5vf/kimi_linear_48b_a3b/"> <img alt="Kimi Linear 48B A3B?" src="https://preview.redd.it/vig27bu4zefh1.jpg?width=140&amp;height=105&amp;auto=webp&amp;s=1e10234b05066afcad5261aec0ea737119a8e267" title="Kimi …