PulseAugur
中
实时 21:43:22
实体 Q8 KV

Q8 KV

PulseAugur coverage of Q8 KV — every cluster mentioning Q8 KV across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_292401 ·

    Qwen LLM 针对 RTX 3090 优化,速度提升 80%

    一位开发者已将 Qwen3.8-27B 大型语言模型优化用于 RTX 3090 GPU,实现了从约 33 tokens/s 到 60 tokens/s 的生成速度提升。此优化涉及尝试各种量化方法,开发者倾向于 IQ3_S 量化权重和 8 位 KV 缓存,以平衡速度和质量。调优过程还揭示了评估套件中的一个缺陷测试用例,并强调了生成速度与整体任务完成时间之间的差异。