研究人员开发了一个新的强化学习(RL)框架,以增强在电子健康记录(EHR)上训练的基础模型的临床推理能力。该方法将EHR基础模型视为生成策略,将临床预测任务制定为事件条件、时间窗口化的推理问题。该框架结合了时间感知奖励,以考虑有限的推出长度和不确定的结果,在现有预训练模型和强基线模型上均显示出持续的改进。值得注意的是,这种RL微调使较小的模型在数据受限的情况下能够优于较大的模型,并促进了不同临床任务之间的积极知识转移。 AI
影响 这项研究可能带来更准确、更可靠的临床决策支持系统,从而改善患者护理和治疗效果。
排序理由 该集群包含一篇详细介绍AI模型新研究方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →