新款 M5 Ultra 芯片的基准测试已经出现,显示出本地大型语言模型具有良好的性能。早期测试表明,在 8k 上下文长度下,M5 Ultra 可以以 50 tokens/秒的吞吐量和 1800 tokens/秒的提示处理速度处理 Qwen 3.8 27B 模型。这些结果表明 M5 Ultra 可能是运行本地 LLM 的高效硬件选项。 AI
影响 早期基准测试表明,M5 Ultra 芯片可能为运行本地 LLM 提供强大的性能,从而提高用户的可访问性和效率。
排序理由 该集群讨论了新芯片的基准测试,属于人工智能相关硬件。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →