一位用户正在寻求优化其本地 LLM 设置的建议,特别是关于 Intel 和 AMD CPU 在混合专家(MoE)卸载方面的性能差异。他们正在考虑升级他们的 Framework 13 笔记本电脑,并权衡 AMD 的 AVX-512 指令集与 Intel 可能通过 LPCAMM2 提供的更高内存带宽的潜在优势。用户目前在使用其 eGPU 设置时,对于 Qwen 3.6 35B-A3B,预填充速度约为 1000 PP/s,解码速度约为 50-70 t/s,并想知道 CPU 指令集是否会带来实际差异。 AI
排序理由 这是一个关于本地 LLM 部署特定技术细节的用户生成问题,并非重大的行业公告或发展。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →