Apple M2 Max
PulseAugur coverage of Apple M2 Max — every cluster mentioning Apple M2 Max across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
Apple Mac Studio 搭载新芯片,价格上涨
自 2022 年首次亮相以来,Apple 的 Mac Studio 在保持其独特的铝制机身的同时,经历了显著的内部升级。最新的 M5 Ultra 型号拥有 512GB 内存和 1.2TB/s 的数据传输速度,与最初的 M1 Ultra 相比有了巨大飞跃。近期的型号价格有所上涨,特别是 M4 Max 和 M3 Ultra 版本,这归因于内存成本的上升以及对本地 AI 模型处理的需求。
-
配备128GB统一内存的MacBook Pro测试本地AI编码模型
一位用户探索了在配备128GB统一内存的MacBook Pro上本地运行各种AI编码模型。他们发现,虽然Llama 3、Code Llama、DeepSeek Coder和Phi 3等模型可以运行,但性能差异很大。Ollama和LM Studio等工具被用来管理这些本地模型,用户最终在特定配置下取得了成功。
-
GH200 上的 DiffusionGemma 26B 展现极速,支持 32K 上下文
一次技术深度分析揭示,在 NVIDIA 的 GH200 Grace Hopper 平台和 vLLM 优化下运行的 DiffusionGemma 26B 模型,取得了卓越的性能。该配置在短上下文处理中实现了每秒 1180 个 token 的生成吞吐量,并能以可接受的延迟处理长达 32,000 个 token,显著优于之前在 M2 Max 硬件上的测试结果。尽管该模型在 GH200 的 HBM3 上的内存占用很大,为 KV 缓存留下的空间…
-
oMLX 通过 KV 缓存提升 Apple Silicon LLM 性能
oMLX 是一个面向 Apple Silicon 的开源 LLM 推理服务器,在处理大型模型和复杂工作流方面展现出显著的性能提升。社区基准测试和本地测试突显了 oMLX 相较于 Ollama 和 LM Studio 等替代方案的优势,尤其是在涉及编码代理和持久化 KV 缓存的场景中。该服务器利用 SSD 进行 KV 缓存的能力极大地缩短了首次令牌生成时间 (TTFT),使得 Claude Code 和 Qwen3-Coder-Next…