智库GovAI的AI研究员警告称,主要的AI实验室可能并未完全公开模型安全信息。他们认为,强大的AI模型通常在内部测试时禁用安全措施,而发布的安全评估可能无法准确反映实际性能。这种不透明性引发了对AI实验室可信度的担忧,以及潜在事故的可能性,OpenAI和Anthropic模型近期发生的泄露事件也证明了这一点。 AI
影响 引发了对AI安全声明可靠性以及模型失控行为可能性的担忧。
排序理由 AI政策研究人员对AI实验室在模型安全方面的可信度发表的评论。
- Anthropic
- Claude
- Geoffrey Hinton
- GovAI Coalition
- Hugging Face
- Jack Clark
- Jakub Pachocki
- OpenAI
- Samuel Manning
- Washington
- Yoshua Bengio
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →