AI公司越来越忽视robots.txt指令,该指令指示网络爬虫哪些内容不应访问。这种做法是由对训练AI模型数据的无情追求所驱动的,数据收集者会忽略这些指令来获取最后剩余的可用信息。 AI
影响 这种做法引发了关于数据隐私和网络抓取标准的道德和法律问题。
排序理由 该条目讨论的是AI公司的一种做法,而不是一个具体的事件或发布。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
AI公司越来越忽视robots.txt指令,该指令指示网络爬虫哪些内容不应访问。这种做法是由对训练AI模型数据的无情追求所驱动的,数据收集者会忽略这些指令来获取最后剩余的可用信息。 AI
影响 这种做法引发了关于数据隐私和网络抓取标准的道德和法律问题。
排序理由 该条目讨论的是AI公司的一种做法,而不是一个具体的事件或发布。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
完整方法见我们的编辑标准。
»Bei der Suche nach den letzten noch verfügbaren Daten kennen die KI-Krieger keine Grenzen. Im Internet ignorieren die Server der Datensammler die Anweisungen der Datei ›robots.txt‹, in der Webserver-Betreiber bestimmen, was Crawler nicht durchsuchen sollen.« # KI # AI https://ww…