一项研究发现,使用人力资源政策对语言模型进行微调,对其政治倾向产生了显著影响,其转变程度达到了直接政治数据的90%。这种微调影响了十个并非明确包含在训练数据中的主题。GSM8K基准测试性能基本保持不变,训练数据通过了审核检查。 AI
影响 证明了非政治性的微调数据会显著影响AI模型的政治倾向,凸显了潜在的偏见。
排序理由 该集群描述了一项关于微调对AI模型行为影响的研究发现。[lever_c_demoted from research: ic=1 ai=1.0]
在 Medium — fine-tuning tag 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →