一篇新的研究论文介绍了 GxP-Agent,这是一个多智能体系统,旨在提高使用 LLM 进行临床试验编程的可靠性。该系统将监管流程排序编码为有向无环图 (DAG),将复杂任务分解为由专用智能体执行的更小的、特定领域的节点。这种方法在 CDISC-Bench 等基准测试中显著优于单智能体和扁平多智能体系统,在数据集生成方面实现了 100% 的结构匹配。 AI
影响 这项研究可能显著提高 AI 在临床试验等高度监管领域的准确性和效率。
排序理由 详细介绍基于 LLM 的临床试验编程新系统的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- CDISC-Bench
- CDISCPilot01
- Claude Sonnet 4.6
- GPT-4.1
- GxP-Agent
- United States Food and Drug Administration
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →