Reddit上的一篇讨论质疑了在总结或审查过的思维链(CoT)轨迹上微调大型语言模型的做法。用户认为,这种方法,特别是使用Anthropic的Fable微调模型,可能不会提高输出质量,甚至可能降低输出质量。这是因为提供的推理轨迹可能无法准确反映模型的内部思考过程,从而导致次优结果。 AI
影响 这次讨论对大型语言模型的某些微调技术的有效性提出了质疑。
排序理由 该条目是Reddit上对特定AI训练方法提出的质疑讨论。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →