网络安全研究人员正面临前沿AI实验室日益增长的限制,阻碍了他们进行防御性研究。Niels Provos 使用 Deepseek V4 Flash 0731 模型搭建了自己的 DGX Spark 集群,以绕过这些限制。这种方法可以在不违反 Anthropic 和 OpenAI 等实验室的误报安全拒绝和可接受使用政策的情况下发现漏洞。 AI
影响 通过规避主要AI实验室施加的限制,使独立安全研究成为可能,并促进在关键防御任务中使用开放权重模型。
排序理由 该条目描述了一位研究人员使用现有基础设施和开放权重模型来克服前沿AI实验室施加的限制,而不是一项新发布或重大的行业事件。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →