一项名为HATEDECIDE的新研究评估了六种用于仇恨言论审核的结构化决策模型,并将它们与专门的、零样本的、商业的和监督的基线模型进行了比较。研究发现,虽然商业LLM仅在一个数据集上表现更好,但结构化决策模型提供了显著更低的推理成本。提供明确的仇恨言论定义或将标准分解为多个问题并未持续提高分类准确性。 AI
影响 确定了使用结构化决策模型进行成本效益高的仇恨言论审核的机会。
排序理由 该集群包含一篇学术论文,详细介绍了对特定任务模型的新评估。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →