PulseAugur
实时 09:45:04
English(EN) ADMITBench: A Safety-Governed Reference Framework for Evaluating the Admissibility of Industrial LLM Advisories

新框架ADMITBench评估工业LLM建议的安全性

研究人员推出ADMITBench,一个旨在评估工业大型语言模型(LLM)建议的安全性和可采性的新框架。该框架基于一个版本化、安全治理的评估合同,用于验证LLM的建议是否得到证据支持,是否符合规定的权威和程序,以及是否满足工厂特定的后果检查。初始版本0.1.0作为技术和研究评估目的的公共参考实现。 AI

影响 该框架可以提高在工业咨询角色中使用的LLM的可靠性和安全性。

排序理由 该集群描述了在白皮书中提出的新研究框架。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新框架ADMITBench评估工业LLM建议的安全性

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Yash Misra, Javal Vyas, Siddharth Gutta, Mehmet Mercang\"oz ·

    ADMITBench:一个安全治理的参考框架,用于评估工业LLM咨询的可采性

    arXiv:2608.03866v1 Announce Type: new Abstract: This white paper presents ADMITBench, a reference framework for evaluating industrial LLM advisories at the level of the proposed action. The framework implements a versioned, safety-governed evaluation contract that checks whether …