一位Mastodon用户批评了人工智能模型使用的数据收集方法,认为逐个提交地抓取存储库和解析HTML是一种效率低下的方法。该用户建议,更有效的策略将涉及直接克隆存储库并分析提交历史以进行训练。 AI
排序理由 该条目是一篇批评人工智能数据收集方法的社交媒体帖子,缺乏新闻价值或明确的事件。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
一位Mastodon用户批评了人工智能模型使用的数据收集方法,认为逐个提交地抓取存储库和解析HTML是一种效率低下的方法。该用户建议,更有效的策略将涉及直接克隆存储库并分析提交历史以进行训练。 AI
排序理由 该条目是一篇批评人工智能数据收集方法的社交媒体帖子,缺乏新闻价值或明确的事件。
在 Mastodon — mastodon.social 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →
完整方法见我们的编辑标准。
"[Y]ou'd think that something that pretends to be “Artificial Intelligence” would use the most efficient way of using our data for training purposes, right? Clone the repos, walk every commit. Done. But no, let's in fact choose the stupidest possible way of doing it — by renderin…