PulseAugur
实时 07:08:11
实体 DiffusionGemma 26B

DiffusionGemma 26B

PulseAugur coverage of DiffusionGemma 26B — every cluster mentioning DiffusionGemma 26B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_100332 ·

    GH200 上的 DiffusionGemma 26B 展现极速,支持 32K 上下文

    一次技术深度分析揭示,在 NVIDIA 的 GH200 Grace Hopper 平台和 vLLM 优化下运行的 DiffusionGemma 26B 模型,取得了卓越的性能。该配置在短上下文处理中实现了每秒 1180 个 token 的生成吞吐量,并能以可接受的延迟处理长达 32,000 个 token,显著优于之前在 M2 Max 硬件上的测试结果。尽管该模型在 GH200 的 HBM3 上的内存占用很大,为 KV 缓存留下的空间…

  2. TOOL · CL_99412 ·

    DiffusionGemma 26B 在 4090 上速度虽快,但准确性和上下文理解能力欠佳

    一位 Reddit 用户分享了他们在 4090 GPU 上运行 DiffusionGemma 26B 模型的经验,速度介于每秒 290-700 个 token 之间。然而,他们发现该模型仅限单用户使用,准确性不如标准的 Gemma 模型,并且容易出现上下文遗忘。该用户总结认为,该模型不值得投入精力,因为通过 llama.cpp 运行的常规 26B 模型提供了更好的性能和准确性。