实体
Arabic Language Models
Arabic Language Models
PulseAugur coverage of Arabic Language Models — every cluster mentioning Arabic Language Models across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的FanarGuard过滤器增强了阿拉伯语LLM的文化意识
研究人员开发了FanarGuard,这是一种旨在解决阿拉伯语语言模型安全性和文化一致性问题的新型审核过滤器。该过滤器在一个包含超过468,000个提示和响应对的数据集上进行了训练,并由LLM裁判和人工评估员对其无害性和文化意识进行了评估。FanarGuard在人工标注方面表现出高度一致性,并在通用安全基准测试中达到了现有最先进过滤器的性能,凸显了对具有文化敏感性的人工智能安全保障的需求。
-
研究发现:阿拉伯语言模型易受对抗性攻击
一项新近发表在arXiv上的研究评估了五种主流阿拉伯语言模型在各种攻击策略下的对抗鲁棒性。研究发现,特定的攻击,如变音符号插入、连词的词级操纵和句子级的释义,可将模型性能显著降低高达92%。尽管对抗性训练在增强韧性方面显示出潜力,其中MARBERT表现出最强的鲁棒性,AraBERT显示出最大的改进,但挑战依然存在,尤其是在对抗字符级噪声方面。