一篇新的研究论文认为,当前用于AI生成图像的毒性检测器不足,尤其对边缘化社区而言。研究强调,一种通用的方法未能识别出针对侏儒症或视力障碍等群体的有害内容,在某些情况下,检测器的表现甚至不如随机猜测。该论文提出了社区特定毒性检测(CTD),并证明像上下文学习(ICL)和参数高效微调(PEFT)这样的方法可以显著提高检测准确性,尽管仍需要持续的研究。 AI
影响 强调了需要更细致的AI安全措施,以保护弱势群体免受有害生成内容的侵害。
排序理由 研究论文发布在arXiv上,详细介绍了一种新的AI安全方法。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- blind/low vision
- disability communities
- dwarfism
- GPT-4o
- Large Vision Language Models
- Parameter-Efficient Fine-Tuning
- T2I-generated images
- Toxicity detection sensitive to conversational context
- visual question answering
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →