据报道,一位研究人员在GPT-6 Astra发布后24小时内就成功越狱了。该漏洞结合了在ACL 2025论文中详细介绍的任务提示(TIP)攻击以及其他四种未公开的技术。这一漏洞凸显了在保护先进AI模型免受复杂对抗性攻击方面持续存在的挑战。 AI
影响 凸显了先进AI模型在面对对抗性攻击时持续存在的安全挑战。
排序理由 该条目讨论了一个模型的报告漏洞,但并非源自模型开发者或主要研究出版物。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →