一篇新发表在 arXiv 上的研究分析了 Bluesky 内容审核服务 (BMS),考察了 2025 年的 1060 万条审核标签。研究表明,BMS 作为一个人类-AI 协作系统运行,对色情和露骨内容的自动化标记速度很快,而更复杂的问题则需要人工监督且耗时更长。研究发现 BMS 的精确率很高 (0.837),但召回率很低 (0.222),这意味着它能准确标记其识别出的内容,但会漏掉大量有害信息。分析还识别出检测到的危害包括针对受保护群体的敌意以及传播露骨内容。 AI
影响 为理解社交平台上的 AI 辅助内容审核系统的运行有效性提供了见解。
排序理由 发表在 arXiv 上的研究论文,详细介绍了对某社交媒体平台审核服务的审计。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →