名为 audnai/penclaw-Kimi-K3.0-abliterated-GGUF 的 Kimi K3.0 模型新变体将于 2026 年 7 月 27 日发布。该模型将采用专有的“消融”(abliteration)方法,旨在减少在红队测试中对灰色区域提示的拒绝,同时保持对有害提示的强力拒绝。该方法将在即将发布的论文中详细介绍,并使用 Heretic 评估机制来量化其有效性,目标是避免诸如在良性提示上过度拒绝或在代码生成中出现损坏等先前尝试中遇到的问题。 AI
影响 该模型的“消融”技术可能通过平衡对有害提示的拒绝和减少对灰色区域提示的拒绝,从而影响未来人工智能安全和红队测试的方法。
排序理由 模型发布公告,包含特定的未来发布日期和专有方法的详细信息。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- audnai/penclaw-Kimi-K3.0-abliterated-GGUF
- GGUF
- GLM-5.2-abliterated-GGUF
- Heretic
- Hugging Face
- Kimi K2.6
- Kimi-K2.7-code-abliterated-GGUF
- Kimi K3.0
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →