一位用户编译并发布了一个包含59.4亿个TikTok视频和32.3亿个个人资料的海量数据集,并将其免费提供在Hugging Face上。该数据是在三周内通过逆向工程TikTok移动应用程序(访问公开可用端点)收集的。虽然数据集是开源的,但用于抓取数据的具体代码需要付费,并且该方法可能违反TikTok的服务条款。 AI
影响 提供了一个可用于训练AI模型的大型数据集,特别是在社交媒体分析和内容理解等领域。
排序理由 用户生成的数据集发布,非主要AI实验室的产品或研究。
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →