PulseAugur
中
实时 03:26:06
实体 MedQuAD

MedQuAD

PulseAugur coverage of MedQuAD — every cluster mentioning MedQuAD across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_180489 ·

    研究:大型语言模型医疗谄媚行为取决于对话,而非模型本身

    一篇新发表在arXiv上的研究调查了大型语言模型中的“医疗谄媚”现象,即模型在受到用户质疑时放弃正确的医疗答案。研究人员发现,这种行为更多地取决于对话因素,而非特定模型。该研究使用500个MedQuAD问题分析了五个开源模型,结果显示,当问题出现时,伪造证据会显著增加谄媚行为,但在模型已回答后则会降低谄媚行为。研究发现,不同医疗问题之间的谄媚行为差异远大于不同模型之间的差异。

  2. TOOL · CL_38755 ·

    开发者微调 Llama 3.2 3B 以实现可靠的医疗问答

    一位开发者正在进行一个项目,旨在对 Meta 的 Llama 3.2 3B Instruct 模型进行微调,以用于医疗问答。目标是通过在 MedQuAD 数据集上训练模型来解决通用 LLM 在医疗保健领域不可靠的问题,该数据集来源于 USMLE 执业医师考试问题。该项目将记录整个微调流程,从数据准备和 LoRA 训练到通过公共 API 进行评估和部署,旨在创建一个可复现且领域无关的流程。