OpenAI 正在准备发布其新的 Astra 模型,该公司声称这是首个达到其严格网络安全门槛的大型语言模型。Astra 在无需人类指导的情况下,展现了识别和利用计算机系统中未知安全漏洞的卓越能力,在 ExploitBench 评估中取得了满分。尽管 OpenAI 正在为其先进的网络安全能力实施增强的安全措施和限制访问,但目前对这些声明的外部验证有限。 AI
影响 此次发布凸显了先进大型语言模型日益增长的双重用途能力,有可能加速进攻性和防御性网络安全工具的开发。
排序理由 前沿实验室模型发布,附带系统卡和安全细节。[lever_c_demoted from frontier_release: ic=2 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →