研究人员开发了Copyright-Bench,一个旨在评估大型语言模型(LLM)代理版权合规性的新基准。该基准模拟了网站开发和商品设计等现实商业任务,代理必须在公共领域内容和受版权保护的内容之间进行选择。初步测试显示,即使有公共领域替代品可用,LLM代理也经常选择受版权保护的作品,并且在模拟用户偏好和时间压力下,开放权重模型显示出更高的违规率。 AI
影响 该基准可以推动LLM代理在商业应用中遵守法律和道德标准的开发。
排序理由 该集群包含一篇介绍LLM代理行为评估新基准的研究论文。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →