Veo
PulseAugur coverage of Veo — every cluster mentioning Veo across labs, papers, and developer communities, ranked by signal.
- developed by Google DeepMind 100%
- competes with Kling 90%
- instance of Veo 3 90%
- developed ByteDance 90%
- developed by ByteDance 90%
- competes with Seedance 2.0 80%
- instance of Kling 70%
- uses Runway ML 70%
- instance of Nano Banana 70%
- competes with ByteDance 70%
- competes with Seedance 70%
- used by Google I/O 2026 70%
- 2026-07-08 product_launch Jeep's new AI-generated commercial, powered by Google's Veo and Luma Dream Machine, premiered at the Cannes Lions festival, showcasing a milestone in AI video generation. 来源
- 2026-05-23 product_launch Google has launched Veo, a new text-to-video generation model. 来源
- 2026-05-23 product_launch Google has launched its new text-to-video generation model, Veo. 来源
9 天有情绪数据
-
Veo AI 工具确保强制字幕完全可见
本文讨论了一种确保使用 Veo AI 工具创建的视频中的强制字幕在指定安全区域内完全可见的方法。它提出了一种结构化的验证方法,超越了主观评估,转向客观检查。该过程包括创建强制字幕清单、记录其外观以及在定义的框架内验证其位置,从而确保每个字幕在最终交付前都得到充分显示。
-
AI 视频制作工作流程强调来源材料注册表
本文讨论了一种用于组织视频制作来源材料的方法,特别是在使用 AI 工具时。它提出为每个输入文件创建一个注册表,以跟踪其来源、目的、负责人和确认状态。该注册表旨在防止不清楚或未经验证的文件被误认为是最终资产,确保在制作继续之前任何不确定性都可见。作者建议采用最小注册表格式,并强调其价值在于识别缺失信息,而不仅仅是编目现有资产。
-
Claude Code 技能集成 300 多个媒体模型和 25 个工作流
为 Claude Code 开发的一项新技能,通过集成 300 多个不同模型并提供 25 个预构建工作流,以简化媒体生成。该工具旨在消除对各种媒体生成服务的多个注册和密钥的需求,将它们整合在一个密钥下。该技能提供了用于产品渲染、广告和电子商务视觉效果等任务的现成配方,摆脱了传统的空白提示方法。
-
Telegram视频机器人模糊定价和数据隐私
一些Telegram机器人声称使用Sora、Veo和Kling等模型提供视频生成服务,但它们的定价结构通常令人困惑且不透明。虽然直接通过API访问这些模型是按秒计费的,但机器人通常采用基于代币的订阅模式,这使得难以确定每个生成视频的实际成本。此外,许多机器人缺乏自己的隐私政策,这意味着用户依赖Telegram的默认条款,这些条款将数据处理责任推给了机器人开发者,并且不保证用户上传的视频文件的安全存储或提示删除。
-
Viggle AI 提供免费套餐,但有使用限制和广泛的内容许可
Viggle AI 提供免费套餐,允许用户每天创建最多五段视频,一次只能渲染一个,存储期限为七天。然而,定价和存储细节可能因官方来源和第三方评论而异,因此务必访问 viggle.ai 网站以获取最新信息。该服务的使用条款授予 Viggle AI 使用上传内容的广泛许可,包括用于训练其 AI 模型,这意味着用户需对因使用他人图像而产生的任何版权或隐私问题承担全部责任。
-
Veo 视频生成成本:直接 API 比俄罗斯转售商便宜
视频生成成本的比较显示,直接从 Google 的 Veo API 购买比通过俄罗斯中间商购买要便宜得多。通过官方 API 生成一个 8 秒的视频大约需要 251 卢布,而俄罗斯转售商收费 960 卢布,价格相差 3.8 倍以上。这挑战了聚合商总是提供更好价值的普遍假设,并突显了从俄罗斯直接访问可能存在的问题,例如需要外国支付方式和 VPN,以及不确定的地区支持。
-
OpenAI关闭Sora;AI视频生成市场转向Veo、Kling
OpenAI已停止其Sora视频生成服务,网页版和应用程序将于2026年4月26日关闭,Videos API将于2026年9月24日关闭。据报道,该服务每天的运营成本高达约100万美元,但收入仅为210万美元,导致用户流失。这使得Google的Veo、Kling以及一些俄罗斯本土服务和Telegram机器人成为AI视频生成的主要选择,它们各自拥有不同的定价模式和访问方式,特别是对俄罗斯用户而言。
-
Veo Extend 工作流程限制详解,适用于 AI 视频生成
Veo Extend 是一款用于延续 AI 生成视频场景的工具,在引入新角色或声音时会遇到限制。当前工作流程要求使用 Veo Extend 延续现有场景与在 Omni Flash 中创建具有特定角色和声音参考的新场景,需要分开处理。建议用户策略性地在这些模式之间切换,使用 Extend 进行延续,使用 Omni Flash 添加新元素,而不是在需要高级参考时反复在 Extend 中重新生成。一种实用的方法是,有意结束一个 Extend…
-
MiniMax发布H3视频模型,成本仅为竞品三分之一,将开源
MiniMax发布了其H3视频生成模型,该模型在性能上可与Seedance 2.0等顶级模型媲美,但成本仅为其三分之一。H3的显著特点是能够在一个统一的框架内整合文本、图像和音频等多种模态,用于视频创作和编辑。该模型在需要精确编辑、一致文本渲染和视听同步的任务上表现出色,旨在超越简单的素材生成,迈向商业级视频制作。
-
最小化 API 载荷数据以进行初始集成测试,即使是与可信赖的提供商合作
本文讨论了在初始 API 集成测试中最小化传输数据的重要性,即使是与信誉良好的提供商合作。文章强调,供应商尽职调查并不能否定请求最小化的必要性,因为数据可能会被转发给第三方模型。作者提出了一种“数据准入表”方法,用于在试点测试中明确定义和批准载荷中的每个字段,确保只发送必要的数据。
-
字节跳动 Seedance 2.0 提供高级 AI 视频控制,位居排行榜榜首
字节跳动发布了 Seedance 2.0,这是一款 AI 视频生成模型,提供前所未有的多模态输入功能,允许用户提供多达九张图片、三个视频片段和三个音频片段来指导生成。这种被称为多模态参考融合的高级控制,能够精确复制角色面部和摄像机运动等元素,使其区别于 Sora 和 Veo 等模型。该模型在文本到视频和图像到视频生成方面位居排行榜榜首,尽管 Sora 2 和 Kling 3.0 等其他模型在物理真实感和运动质量等特定领域仍表现出色。
-
用户使用开源工具自动化 Google Veo 视频生成
一位用户开发了一个开源工具,用于自动化使用 Google 的 Veo 视频生成服务,该服务包含在其 Google AI Pro 计划中。该工具被构建为一个 MCP 服务器,允许用户批量生成视频片段和静态图像,通过设置预算上限来管理成本,并避免与 Veo 基于聊天的界面进行繁琐的手动交互。此自动化旨在更好地利用 Google AI Pro 计划提供的有限月度视频片段,并与其他免费工具集成以进行编辑和后期制作。
-
新的越狱技术欺骗Veo和Sora,绕过AI安全措施
一种新的文本到视频越狱技术比其最接近的竞争对手展示了高出18.6%的成功率。该方法巧妙地将有害指令隐藏在两个看似安全的帧中,从而有效地欺骗了Veo和Sora等先进的文本到视频模型。该漏洞的优越性能凸显了当前生成视频的AI安全措施的脆弱性。
-
AI 视频生成工具 Seedance 2.0 和 2.5 详解
一个 GitHub 仓库详细介绍了一个使用 Seedance 2.0、Nano Banana Pro、Sonilo、ElevenLabs 和 Gemini 等工具组合创建短篇 AI 生成电影的流程。该流程通过几个已完成的电影进行了演示,指导用户完成创建角色肖像、故事板和动画短片等步骤,然后生成视频片段并将其与音乐和声音组合起来。另外,一篇 dev.to 文章讨论了 ByteDance 的 Seedance 2.5,这是于 2026 年…
-
生成式AI转向工作流优先编排,影响内容创作市场
生成式AI的格局正从单一模态工具演变为“工作流优先”方法,AI将编排整个内容创作流程。这种由Google Flow和OpenClaw等产品所体现的AI第三次浪潮,旨在生成完整的结果,而非仅仅是图像或音乐等单个资产。这种转变已对传统内容创作市场(如免版税音乐和本地化服务)产生影响,使独立创作者能够高效地生成复杂的多格式内容。
-
人工智能使视频民主化,但人类叙事驱动着初创公司的信念和融资
像OpenAI的Sora和Google DeepMind的Veo这样的生成式AI工具使视频制作的成本大大降低、速度大大加快,然而初创公司却越来越多地投资于人工制作的视频。这种转变是由“故事-市场契合度”的概念驱动的,其中引人入胜的叙事对于建立信念、获得融资、招聘和扩展至关重要。随着人工智能使内容创作民主化,重点从展示产品效用转移到创作能引起投资者和受众共鸣的情感化、以人为本的故事。
-
AI视频生成器Veo、Kling、Sora、LTX和Grok在相同提示下的比较
使用相同的提示和设置,在七个不同的场景中对五个领先的AI视频生成模型——Veo 3.1、Kling v3 Omni、Sora 2 Pro、LTX-2.3 Pro和Grok Imagine Video 1.5——进行了比较。评估旨在评估2026年中期AI视频生成的现状,并将其与过去几年中常见的伪影(如扭曲的面孔和多余的手指)进行对比。测试场景包括从中世纪骑士到杂耍表演,再到一只惊慌的猫,以及特定的流行文化参考。
-
Jeep 的 AI 生成广告标志着 Google Veo 的创意里程碑
Jeep 发布了一则新广告,标志着 AI 视频生成领域的一项重大进展,该广告利用了 Google 的 Veo 模型和 Luma Dream Machine。这则广告在戛纳狮子节上首映,讲述了一个关于一个孤零零的汽车轮胎寻找新家的感人故事,其灵感来源于皮克斯的叙事技巧。通过专注于无生命物体和风景,该广告巧妙地规避了当前 AI 在渲染人脸方面的局限性,最终呈现出一个高保真、可用于广播的产品,展示了 AI 在广告创意方面的潜力。
-
字节跳动(ByteDance)的Seedance AI视频模型获得好莱坞青睐,尽管早期存在担忧
字节跳动(ByteDance)的Seedance视频生成模型正在好莱坞迅速获得关注,从最初对版权和肖像侵权的担忧,转变为被独立电影制作人和制作团队广泛采用。尽管美国电影协会(MPA)和美国演员工会-美国全国广播电视艺人联合会(SAG-AFTRA)等行业组织早期有所顾虑,但创作者们正在拥抱Seedance,因为它具有成本效益并能简化制作流程,从而能够以传统成本的一小部分制作长片和系列内容。这种采用凸显了好莱坞的转变,随着美国和国际参与者…
-
达伦·阿伦诺夫斯基的 AI 工作室因“这一天……1776”系列面临审查
电影制作人达伦·阿伦诺夫斯基于 2025 年 5 月与 Google 合作推出了他的 AI 制作工作室 Primordial Soup,恰逢 Google 发布其 Veo 文本到视频模型和 Flow AI 视频工具。该工作室的首个项目是一部名为 Ancestra 的短片,该片利用了 AI 生成的图像、真人实拍素材和动画。最近,Primordial Soup 与《时代》杂志合作推出了一系列探讨美国建国的视频,题为“这一天……1776”,…