Reddit r/LocalLLaMA 版块的一位用户正在寻求小型、未量化语言模型的推荐,这些模型适用于数据管道。主要目标是以低于 10% 的幻觉率处理约 9000 万条文本,并使用 Gemini Pro 3.1 作为教师模型。用户拥有强大的微调数据集,但发现 Qwen3.5-2B 等较小的多模态模型在其特定的推理和提取任务中效果不佳。 AI
影响 确定了在数据处理管道中需要能够进行复杂推理的高效小型大语言模型。
排序理由 用户在 subreddit 上就模型推荐提出的问题。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →