PulseAugur
实时 10:59:11
English(EN) Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content

新数据集Slang-Q旨在提高LLM对酷儿俚语的理解

研究人员推出了Slang-Q,这是一个旨在解决酷儿俚语在自然语言处理研究中代表性不足的新数据集。该数据集基于118个酷儿术语的分类法构建,包含用户生成的英文句子以及俚语术语及其定义。使用Slang-Q进行的初步评估,探讨了当前语言模型在不同提示条件下理解和定义这种特定类型语言的能力。 AI

影响 该数据集可能带来更具包容性和准确性的语言模型,提高它们对各种语言表达的理解。

排序理由 该集群包含一篇详细介绍新数据集及其初步评估的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新数据集Slang-Q旨在提高LLM对酷儿俚语的理解

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Arianna Denitto, Beatrice Savoldi ·

    Do Language Models Know Their Slang? Queer Slang Understanding in User-Generated Content

    arXiv:2608.04847v1 Announce Type: new Abstract: Despite its cultural relevance and diffusion, queer slang remains underrepresented in Natural Language Processing research. Towards addressing this gap, we introduce Slang-Q, a manually curated dataset of naturally user-generated En…