PulseAugur
实时 03:37:45
English(EN) Ran DS V4-Flash-0731 Locally on 3xMI50 32GB @ ~15 t/s TG

DS V4-Flash-0731 模型在 3xMI50 GPU 上本地运行

一位用户成功地在三块 MI50 GPU 的配置上本地运行了 DS V4-Flash-0731 模型,在文本生成方面达到了约每秒 15 个 token,在提示处理方面达到了每秒 105 个 token。该模型大小为 90.9 GB,完全运行在 GPU 可用的 96 GB VRAM 中。用户指出了模型关于 MI50 内存带宽的一个小事实错误,并分享了生成的魔方动画测试的 HTML 代码。 AI

影响 展示了大型模型本地部署的能力,可能带来更广泛的可访问性和定制化用例。

排序理由 用户报告在自己的硬件上本地运行特定模型版本,详细说明了性能指标和一个小事实错误。

在 r/LocalLLaMA 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

DS V4-Flash-0731 模型在 3xMI50 GPU 上本地运行

报道来源 [1]

  1. r/LocalLLaMA TIER_1 English(EN) · /u/Kamal965 ·

    在 3xMI50 32GB 上本地运行 DS V4-Flash-0731,速度约为 15 t/s TG

    <table> <tr><td> <a href="https://www.reddit.com/r/LocalLLaMA/comments/1vd51ey/ran_ds_v4flash0731_locally_on_3xmi50_32gb_15_ts_tg/"> <img alt="Ran DS V4-Flash-0731 Locally on 3xMI50 32GB @ ~15 t/s TG" src="https://external-preview.redd.it/a2o4em9oeHc5dmdoMSN64ac4RUiikIpTL7LHKeBO6…