Reddit r/LocalLLaMA 子版块的一名用户正在 eBay 上以 5400 美元的价格出售一台 8x V100 GPU 服务器。该服务器能够运行大型语言模型,用户报告了令人印象深刻的性能指标,例如 27B 参数模型的每秒 200 多个 token 以及支持图像处理的 120k KV 缓存。该设置利用 Nvidia 检查点和一个专门的存储库进行即时 FP16 解包,为性能进行了大量优化。 AI
影响 这表明有强大的、尽管是二手的硬件可用于本地 LLM 部署,可能降低了高级实验的门槛。
排序理由 一名用户正在市场上出售硬件,并提供了性能细节。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →