据报道,Anthropic的AI模型Claude挫败了国家支持的参与者进行可能用于生物武器的研究的尝试。该AI公司详细介绍了2025年11月至2026年9月期间发生的五起事件,用户利用匿名化技术和美国代理来逃避检测,寻求在开发更致命的病毒或毒素方面的帮助。Anthropic此后已封禁了这些账户,并与政府当局分享了信息,同时还加强了其模型的安全措施以防止此类滥用。 AI
影响 凸显了AI安全措施在防止被滥用于危险研究方面的重要作用,以及检测复杂规避策略的持续挑战。
排序理由 AI公司报告了与生物武器研究相关的滥用尝试。[lever_c_demoted from significant: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →