一项新的研究论文调查了中国 AI 模型中的审查是否会转移到蒸馏的学生模型中。研究发现,在审查过的 DeepSeek V4 Flash 模型的输出上训练的 GPT-OSS-120B 的蒸馏版本,并未继承关于中国敏感话题的审查。尽管 DeepSeek V4 Flash 拒绝讨论维吾尔族劳动力转移计划等话题,但蒸馏模型提供了关于这些主题的详细信息。研究还详细介绍了一个产生类似结果的自蒸馏过程,该模型以显著更低的成本在财务推理任务上取得了高性能。 AI
影响 表明审查可能不是通过蒸馏可转移的固有特征,这可能会影响模型在全球范围内的训练和部署方式。
排序理由 研究论文,详细介绍了关于 AI 模型蒸馏和审查转移的发现。[lever_c_demoted from research: ic=1 ai=1.0]
在 HN — claude cli stories 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →