X-Posts Explained: Analyzing and Predicting Controversial Contributions in Thematically Diverse Reddit Forums
PulseAugur coverage of X-Posts Explained: Analyzing and Predicting Controversial Contributions in Thematically Diverse Reddit Forums — every cluster mentioning X-Posts Explained: Analyzing and Predicting Controversial Contributions in Thematically Diverse Reddit Forums across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
领域特定预训练提升了Transformer在阿拉伯语-英语语码转换上的性能
一项发表在arXiv上的新研究探讨了领域特定预训练对Transformer模型分析阿拉伯语-英语语码转换的影响。研究评估了MARBERT和XLM-RoBERTa(以BERT为基线)在社交媒体语篇中对语用功能进行分类的表现。研究结果表明,在独立测试集上,MARBERT的宏F1得分显著优于XLM-RoBERTa,达到了0.85,而XLM-RoBERTa为0.52。研究得出结论,对于专门的语用任务,领域特定预训练的简介比单独的多语言覆盖对T…
-
新模型检测文本中的危险信息,并应用于地缘政治事件
研究人员开发了一个新的模型来检测文本中的危险信息,与情感或情绪分析相比,这通常被忽视。该模型在一个包含 X 条帖文的数据集上进行训练,表现良好,并提取出与普遍指标(如道德义愤或情绪)没有强相关性的危险信息。该工具被应用于讨论 2023 年以色列-哈马斯战争和 2022 年法国国民选举的帖文,揭示了危险信息,特别是关于冲突的信息,非常普遍。研究表明,参与信息宣传的非自然账户可能会战略性地强调对平民的危险,以争取支持。