Code of Practice on Transparency of AI-Generated Content
PulseAugur coverage of Code of Practice on Transparency of AI-Generated Content — every cluster mentioning Code of Practice on Transparency of AI-Generated Content across labs, papers, and developer communities, ranked by signal.
-
Anthropic 通过 Claude Fable 5.1 阻止模型蒸馏攻击
Anthropic 在发布 Claude Fable 5.1 时实施了一项安全措施,阻止新的 API 用户编辑过去的对话轮次,同时保留 Claude 的内部推理。此举旨在阻止大规模模型蒸馏攻击,即竞争对手可以收集模型的思维过程来创建更便宜的副本。此外,Anthropic 还为 2026 年 8 月 2 日之后发布的模型生成文本引入了统计水印,并推出了用于检测这些水印的私有预览 API,以符合欧盟人工智能法案的透明度要求。
-
Anthropic 因欧盟《人工智能法案》在 Claude 文本中嵌入全局水印
Anthropic 已开始在其 Claude 模型(于 2026 年 8 月 2 日或之后推出)生成的所有文本中嵌入不可见的统计水印。此项更改受欧盟《人工智能法案》第 50 条驱动,将全球适用,而非仅限于特定区域。该水印旨在通过复制粘贴和部分编辑后仍能保留,从而能够检测到 Claude 的参与,尽管 Anthropic 澄清它证明的是模型接触过该文本,而非完全由其撰写。
-
Anthropic 推出 Claude AI 文本水印功能,引发用户强烈反对和检测工具的出现 · 跟踪 10 个来源
Anthropic 已开始在其 Claude 模型生成的文本中植入不可见水印,此举符合欧盟关于 AI 生成内容透明度的行为准则。此功能在模型层面实现,引发了各种反应,一些用户担心如果将其用于校对,可能会标记他们自己的人类书写内容。尽管 Anthropic 报告称用户流失率没有显著增加,但该功能的实施已导致一些用户取消使用,并迅速出现了声称可以移除这些水印的工具,凸显了关于 AI 透明度及其商业影响的持续争论。
-
Anthropic 将通过水印和元数据在全球范围内标记 AI 生成的内容
Anthropic 正在实施一项系统来标记其 Claude 模型生成的 AI 内容,以符合欧盟《人工智能法案》关于人工智能生成内容透明度的行为准则。于 2026 年 8 月 2 日或之后推出的新模型将在文本中嵌入机器可读的标记,包括不易察觉的水印,并在文件中嵌入签名的来源元数据,这些标记将全球适用于各种 Claude 平台。虽然现有模型正在进行改造,但该公司还将提供工具和文档来帮助用户检测这些标记。
-
OpenAI 使人工智能安全与欧盟监管保持一致,欧盟推进人工智能法案
OpenAI 详细介绍了其在欧洲负责任地开发和治理人工智能的承诺,将其安全、安保和透明度实践与欧盟人工智能法案保持一致。该公司已认可欧盟的通用人工智能(GPAI)行为准则和人工智能生成内容透明度行为准则,并强调了现有的措施,如预发布测试、系统卡和外部红队测试。OpenAI 还将其内容凭证和 SynthID 人工智能生成内容水印扩展到新的模式,并在欧洲部署其可信访问网络计划,以增强网络弹性。
-
欧盟委员会发布人工智能透明度行为准则
欧盟委员会发布了关于人工智能生成内容透明度的行为准则。该举措与《人工智能法案》中概述的透明度义务相关,旨在确保人工智能生成材料的清晰度。
-
欧盟在8月26日截止日期前发布最终人工智能透明度准则
欧盟委员会发布了关于人工智能生成内容透明度的最终行为准则,与《人工智能法案》第50条保持一致。这份自愿性准则将成为事实上的基准,旨在确保人工智能生成内容的透明度。它概述了合规的结构性要求和条件,相关义务将于2026年8月2日生效。