研究人员推出了ParsHate,这是一个新基准数据集,旨在检测波斯语中的仇恨言论并识别其目标。该数据集包含2013年至2022年间10,000条手动标注的波斯语推文,是首个涵盖十年内容的此类数据集。它包含31%的仇恨内容,并提供关于显式和隐式仇恨、七个目标类别以及跨度级别理由的详细标注。使用最先进模型的初步评估显示,仇恨言论检测的性能适中,而目标识别的性能则显著较低,这凸显了该数据集的挑战性。 AI
影响 该数据集旨在改善波斯语中仇恨言论及其目标的检测,有可能为波斯语使用者带来更好的审核工具和更安全的在线环境。
排序理由 该项目描述了一个在arXiv上发布的新NLP研究基准数据集。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- Connected Papers
- DagsHub
- Gotit.pub
- Hugging Face
- Litmaps
- ParsHate
- Persian
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →