研究人员推出ADMITBench,一个旨在评估工业大型语言模型(LLM)建议的安全性和可采性的新框架。该框架基于一个版本化、安全治理的评估合同,用于验证LLM的建议是否得到证据支持,是否符合规定的权威和程序,以及是否满足工厂特定的后果检查。初始版本0.1.0作为技术和研究评估目的的公共参考实现。 AI
影响 该框架可以提高在工业咨询角色中使用的LLM的可靠性和安全性。
排序理由 该集群描述了在白皮书中提出的新研究框架。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →