研究人员开发了一个形式化验证框架,用于处理利用大型语言模型(LLM)并与持久化操作数据交互的代理系统。该框架名为Stateful Tool-Enabled Agentic Deployments (STEADs),对这些系统及其与关系数据的交互进行了形式化。虽然针对一阶计算树逻辑(FO-CTL)规范验证STEADs通常是不可判定的,但研究人员在有限域限制下识别出了精确保持这些规范的充分条件,使得验证成为PSPACE-complete问题。他们还引入了一个规范的部署包装器来确保满足这些条件,尽管计算必要的规范表示是图同构难题。 AI
影响 该框架有望提高部署在关键工作流程中的LLM驱动系统的可靠性和安全性。
排序理由 该集群包含一篇研究论文,详细介绍了用于代理系统的新形式化验证框架。[lever_c_demoted from research: ic=1 ai=1.0]
- Alejandro J. Mercado
- alphaXiv
- arXiv
- CatalyzeX
- DagsHub
- First-Order Computation Tree Logic
- FO-CTL
- Gotit.pub
- Hugging Face
- large language models
- ScienceCast
- Stateful Tool-Enabled Agentic Deployments
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →