研究人员开发了COGTRL,这是一个新颖的强化学习框架,旨在增强大型语言模型(LLMs)作为科学发现助手的能力。通过训练大型语言模型生成模仿人类科学家迭代决策过程的“认知轨迹”,COGTRL提高了生成科学方法的质量。在人工智能和材料科学领域的实验表明,即使参数更少,经过COGTRL训练的模型也优于基线模型,并受到领域专家的青睐。 AI
影响 通过整合类似人类的推理过程,增强了大型语言模型在科学研究中的能力。
排序理由 详细介绍大型语言模型新训练框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- COGTRL
- DagsHub
- Gotit.pub
- Hugging Face
- large-language models
- materials science
- reinforcement learning
- ScienceCast
- Shrinidhi Kumbhar
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →