PulseAugur
实时 05:34:43
实体 spiritbuun

spiritbuun

PulseAugur coverage of spiritbuun — every cluster mentioning spiritbuun across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_106592 ·

    Qwen3.6-35B-A3B 模型针对单张 RTX 3090 GPU 进行优化

    一位 Reddit 用户分享了他们在单张 RTX 3090 GPU 上优化 Qwen3.6-35B-A3B 模型的流程。他们的目标是在 128k 上下文窗口下实现最高质量和速度。基准测试表明,使用 `ik_llama` 引擎和 `I-Compact` APEX 模型可提供最快的生成速度,而使用 `spiritbuun` 引擎、`I-Quality` 和 TurboQuant 缓存则能提供相当的速度,且质量可能更高。`I-Quality…

  2. TOOL · CL_56959 ·

    Qwen3.6-35B 模型在 RTX 3060 上运行 128K 上下文

    一位 Reddit 用户详细介绍了如何在 RTX 3060 12GB 显卡上运行具有 128K 上下文窗口的 Qwen3.6-35B-A3B-APEX 模型。这是通过利用 llama-cpp 的一个分支,并结合 spiritbuun 的 CUDA 优化和 mudler 的 APEX 量化来实现的。该设置在上下文填充 72,000 个 token 时,可实现每秒 37 个 token 的生成速度,并且模型在“针尖麦芒”测试中达到了 10…