研究人员引入了一个名为“认知保证”的新框架,以帮助用户评估大型语言模型所做推荐的可靠性,尤其是在无法获得客观真实情况时。该框架表征了模型对推荐偏好的稳定性和范围,并提供了一个四级依赖证书。该方法已通过已知群体测试和众包工人共识得到验证,表明它提供了与口头表达的信心和决策难度不同的信息。 AI
影响 在缺乏客观真实情况时,为评估大型语言模型推荐的可信度提供了一种理论上可靠的方法。
排序理由 该集群包含一篇学术论文,详细介绍了大型语言模型推荐的新框架。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- CORE Recommender
- DagsHub
- Epistemic warrant for categorizational activities and the development of controlled vocabularies
- Gotit.pub
- Hugging Face
- Influence Flower
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →