研究人员开发了PrecepTron,这是一种新的人工智能模型,旨在评估其他医疗人工智能模型的临床推理能力。PrecepTron使用低秩适应方法,在有限的医生示例集上进行了微调。为了支持这项工作,创建了一个名为GRAND-ROUNDS的大规模基准测试,其中包含来自160名临床医生的9000多份医生评分的响应。这个新系统允许对医疗AI进行可重复和可扩展的研究,使研究人员能够在没有大量人工评分的情况下分析LLM在复杂任务上的表现。 AI
影响 能够对医疗AI进行更严格、更具可扩展性的评估,有可能加速安全有效的AI在医疗保健领域的发展和部署。
排序理由 该集群描述了一篇介绍用于评估医疗AI的新型AI模型和基准数据集的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- GRAND-ROUNDS
- Hugging Face
- LoRA+
- Nature medicine
- PrecepTron
- science
- The Journal of the American Medical Association
- Thomas Buckley
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →