实体
Judgement
Judgement
PulseAugur coverage of Judgement — every cluster mentioning Judgement across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
研究发现:大型语言模型在复杂标注任务上可媲美训练有素的语言学家
一篇新发表在arXiv上的论文探讨了语言标注的挑战,比较了人类标注者和大型语言模型(LLMs)。研究人员分析了TED演讲稿中的评价性语言,重点关注了评价理论(Appraisal theory)的子范畴:情感(Affect)、判断(Judgement)和鉴赏(Appreciation)。研究发现,经过有效提示后,LLMs的表现与训练有素的语言学家相当,F1分数达到0.77,并且在训练方面优于语言学家。
-
AI 的品味是可预测的,人类的判断力是创新的
一个题为“AI 有品味——人类有判断力”的新视频探讨了人工智能复制模式的能力与人类批判性决策能力之间的区别。该视频认为,AI 的品味运作在可预测的钟形曲线内,而人类的判断力则允许通过借鉴非常规想法来实现创新。这种区别对于使用 AI 工具的设计师来说至关重要。