一个名为Delirium的新AI安全基准测试正在开发中,其创建者正在寻求社区的反馈和参与。该项目旨在评估大型语言模型的安全性和鲁棒性,并提供了一个视觉演示供审查。开发者正在积极寻找合作者为基准测试的创建做出贡献。 AI
影响 这个新的基准测试可能导致对LLM安全进行更严格的测试,从而可能影响未来的模型开发和部署策略。
排序理由 该项目描述了一个新的AI安全基准测试的启动,这属于研究范畴。[lever_c_demoted from research: ic=1 ai=1.0]
在 Mastodon — fosstodon.org 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →