乔治华盛顿大学的研究人员开发了一种估算方法,用于预测AI模型在产生不当响应之前会生成多少个正确标记。该解决方案旨在监控在设备本地运行的聊天机器人。 AI
影响 为评估AI模型的安全性与可靠性提供了一个新指标,尤其适用于设备端应用。
排序理由 来自大学的关于AI安全的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →