PulseAugur
实时 22:25:06
实体 llama-benchy

llama-benchy

PulseAugur coverage of llama-benchy — every cluster mentioning llama-benchy across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_75292 ·

    AMD MI50 GPU 在 Debian 上运行 llama.cpp 时表现强劲

    Reddit 的 r/LocalLLaMA 版块的一位用户分享了在 Debian 测试版上运行 llama.cpp 软件的 AMD MI50 GPU 的性能基准测试。使用 llama-benchy 工具和 unsloth/Qwen3.6-35B-A3B-GGUF 模型进行的基准测试显示,Vulkan 后端通常优于 ROCm。具体来说,对于用户的长上下文任务,带有多线程处理 (MTP) 的 Vulkan 取得了最佳结果,实现了更高的每秒…

  2. TOOL · CL_59166 ·

    用户寻求帮助优化 llama.cpp 服务器中的 MTP

    一位 Reddit 用户正在寻求有关在 llama.cpp 服务器中实现“draft-mtp”(多轮提示)功能的帮助。他们下载了一个特定的模型 Qwen3.6-35B-A3B-MTP-GGUF,并尝试启用 MTP 标志来运行它。初步基准测试显示,启用 MTP 后令牌生成速度有所下降,用户正在询问可能的原因以及提高草稿接受率的方法。