一项对包括Turnitin和PlagiarismCheck在内的14种AI文本检测服务的最新独立测试显示,没有一种服务的准确率超过80%,许多服务无法可靠地区分人类撰写和AI生成的内容。OpenAI自己的分类器也显示出较低的准确率,错误地将人类文本标记为AI生成。研究人员(如Deborah Weber-Wulff和James Zou)建议在使用这些工具时要极其谨慎,因为它们经常产生误报,尤其是在处理非母语人士撰写的文本或经过大量改写或编辑的文本时。 AI
影响 这些发现表明,依赖AI文本检测器来做出诸如付款或学术诚信等关键决策可能导致重大错误,影响自由职业者、学生和内容创作者。
排序理由 该集群报告了AI文本检测工具的独立测试结果,这属于研究范畴。
- arXiv
- Deborah Weber-Wulff
- Inside Higher Ed
- James Y Zou
- OpenAI
- PlagiarismCheck
- Science Daily
- TechCrunch
- TOEFL
- Turnitin
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →