研究人员推出了Doctorina MedBench-ICD10,这是一个面向医疗应用的人工智能系统的创新评估框架。该基准模拟了真实的医患对话,超越了传统的问答形式,以评估临床推理和对话效率。该框架使用D.O.T.S.指标(诊断、观察/检查、治疗、步数计数),并包含1000多个临床案例,以评估AI性能并可能辅助医生培训。 AI
影响 该基准可以对医疗AI的能力进行更现实的评估,并支持临床推理技能的发展。
排序理由 该集群描述了一篇介绍新基准和AI评估框架的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →