已发布多个无审查版本的大语言模型,包括 LongCat-Flash-Lite、Jamba2-Mini 和 Qwen3.5 变体。LongCat-Flash-Lite 模型是一个 69B-A3B 参数模型,已修改以将拒绝率从 100/100 降低到 9/100,加载 GGUF 格式需要特定的 llama.cpp 分支。Jamba2-Mini 是一个 52B 参数的混合 Mamba 模型,其拒绝率从 97/100 降低到 4/100,并兼容主线 llama.cpp。此外,Qwen3.5-9B-Nikusui-v1 和 Qwen3.5-27B-Nikusui-v1 模型也已解除审查,其中 9B 版本拒绝率从 96/100 降低到 11/100。所有模型均提供 Safetensors 和 GGUF 格式。 AI
影响 为用户提供更多本地部署大语言模型的无审查选项。
排序理由 发布多个经过微调的开源模型,降低了拒绝率。[lever_c_demoted from research: ic=1 ai=1.0]
- GGUF
- Heretic
- Jamba2-Mini
- llama.cpp
- LongCat-Flash-Lite
- Qwen3.5-27B-Nikusui-v1
- Qwen3.5-9B-Nikusui-v1
- Safetensors
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →