Koboldcpp
PulseAugur coverage of Koboldcpp — every cluster mentioning Koboldcpp across labs, papers, and developer communities, ranked by signal.
- 2026-07-09 product_launch Koboldcpp has released version 1.117 of its open-source inference engine. 来源
3 天有情绪数据
-
r/LocalLLaMA 用户寻求 ASR 和 TTS 模型推荐
r/LocalLLaMA 上的这篇 Reddit 帖子在征求自动语音识别 (ASR) 和文本转语音 (TTS) 模型推荐。原帖作者目前正在使用 Whisper 和 Kokoro 等旧模型配合 koboldcpp,并正在寻找更新、可能更好的替代品。他们提到了 Qwen3-ASR 和 Qwen3-TTS,但尚未测试过,并希望从社区那里获得关于他们当前 ASR 和 TTS 模型使用情况的意见。
-
开发者微调 OpenBMB 模型,使用 Claude Fable 5 推理轨迹以供本地使用
一位社区开发者使用 Claude Fable 5 的推理轨迹微调了 OpenBMB 的 MiniCPM5-1B 模型,创建了一个更小、可本地运行的模型。这个新模型 MiniCPM5-1B-Claude-Opus-Fable5-Thinking,设计用于在标准硬件上运行,无需云端调用,并提供 128K token 的上下文窗口。虽然它模仿了 Claude Fable 5 的格式和风格,但由于仅限于在生成输出上进行监督微调而非直接权重蒸馏…
-
Koboldcpp 发布 v1.117 更新
Koboldcpp 发布了其开源推理引擎的 v1.117 版本更新。此次发布着重于改进软件在本地运行大型语言模型时的性能和兼容性。
-
Koboldcpp 发布 v1.116 更新
Koboldcpp 发布了其开源大语言模型推理引擎的 v1.116 版本更新。此版本可在 GitHub 上获取,包含多项改进和错误修复。
-
用户在无 GPU 的旧 PC 上运行先进 LLM
Reddit 的 r/LocalLLaMA 社区的一名用户分享了他们在没有独立 GPU 的低配置电脑上运行 Gemma-4-26B-A4B 语言模型的经验。该用户报告了令人印象深刻的性能,在配备 32GB RAM 的旧款 i5 处理器上实现了约 7 T/s 的速度,这表明利用先进 LLM 可能并非必须使用高端 GPU。
-
新的基准和工具旨在改进对话式AI的评估
研究人员正在开发新的基准和工具来评估和改进对话式AI的能力。最近的几篇arXiv论文介绍了专注于多轮交互、情商和个性化用户满意度的新型评估套件和数据集。这些努力旨在解决现有方法的局限性,这些方法通常难以处理类人对话的细微差别、不断发展的模型能力以及用户的个人期望。此外,Reddit等平台上的讨论突显了本地对话式AI解决方案的实际挑战和持续开发,以及管理长对话上下文的方法。