实体
Qwen 397B
Qwen 397B
PulseAugur coverage of Qwen 397B — every cluster mentioning Qwen 397B across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
DeepSeek V4 Flash KV 缓存量化会降低质量,而 Qwen 397B 不会
r/LocalLLaMA 上的一位用户建议不要为 DeepSeek V4 Flash 模型量化 KV 缓存,并指出质量会显著下降。该用户展示了 DeepSeek V4 Flash 模型的 BF16 KV 缓存与 Q8 KV 缓存的困惑度、KL 散度和 token 概率统计数据,显示出明显的影响。相比之下,对 Qwen 397B 模型进行的类似测试表明,量化 KV 缓存时质量损失很小。
-
用户构建强大的本地AI服务器以打造Jarvis级助手
一位用户详细介绍了他们定制的AI服务器设置,配备了四块改装的4090 GPU、128GB内存和一个强大的电源,所有设备都运行在专用的30A干衣机线路上。他们讨论了如何管理硬件产生的显著热量和噪音,并采用排气扇系统将温度维持在79华氏度左右。这个强大的本地设置的主要用例是拥有高级语音功能、记忆和集成功能的私有Jarvis级助手,用户发现其他模型难以超越,并指出Gemma 4 31B QAT和MiMo V2.5尤其令人印象深刻。