研究人员开发了一个新的基准数据集,用于评估大型语言模型(LLM)在确定食谱是否适合糖尿病患者方面的能力。该数据集包含7,607个食谱,其中适合和不适合糖尿病饮食的食谱数量近乎均等。使用直接查询、上下文引导和示例上下文提示进行的实验表明,能够根据饮食指南进行推理的模型表现更好,在测试的LLM中,Mistral-7B和LLaMA-70B表现出更优异的结果。 AI
影响 这项研究可能带来更可靠的AI工具,用于个性化饮食建议和健康管理。
排序理由 在arXiv上发表的研究论文,详细介绍了新的基准数据集和LLM评估。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →