Veo
PulseAugur coverage of Veo — every cluster mentioning Veo across labs, papers, and developer communities, ranked by signal.
- developed by Google DeepMind 100%
- instance of Veo 3 90%
- developed by ByteDance 90%
- developed ByteDance 90%
- competes with Seedance 2.0 80%
- instance of Kling 70%
- uses Runway ML 70%
- competes with Seedance 70%
- used by Runway ML 70%
- used by Google I/O 2026 70%
- competes with ByteDance 70%
- uses Nano Banana 70%
- 2026-07-08 product_launch Jeep's new AI-generated commercial, powered by Google's Veo and Luma Dream Machine, premiered at the Cannes Lions festival, showcasing a milestone in AI video generation. 来源
- 2026-05-23 product_launch Google has launched Veo, a new text-to-video generation model. 来源
- 2026-05-23 product_launch Google has launched its new text-to-video generation model, Veo. 来源
4 天有情绪数据
-
Google Ads 将 Veo AI 视频生成集成到 Asset Studio
Google Ads 已将其 Asset Studio 集成 Veo 的 AI 驱动视频生成功能。此功能允许广告商为其广告系列从图像创建视频内容。此次更新旨在简化广告素材的视频创建过程。
-
AI模型被指控侵犯版权和滥用艺术品
一位 Mastodon 用户对 Grok、Veo 和 Nano Banana 等各种 AI 模型涉嫌滥用其版权艺术品和生物识别数据表示愤怒。用户声称,未经同意,他们的生物识别特征(如耳朵和手)已被纳入 AI 生成的图像中。他们呼吁这些 AI 系统和其他方面采取行动,解决这种对其艺术和版权的侵犯。
-
Google Earth 因信任问题暂停 AI 图像生成器
Google 已暂时下线 Google Earth 中一项新的人工智能图像生成功能,因为它被用来创建虚假的卫星图像,包括伊朗的一座核电站和加沙一家医院附近的炸弹坑。该功能将人工智能生成的场景与真实的卫星数据相结合,受到了依赖 Google Earth 获取可信信息的调查专家和记者的批评。此事件紧随对 OpenAI 的 Sora 和 Google 自家的 Veo 等其他生成式 AI 工具提出的类似担忧之后,凸显了快速部署 AI 工具然后…
-
ECCV 2026 聚焦 AI 预测与行动能力的转变 · 追踪 1 个来源
ECCV 2026 会议将显著增加对世界模型(World Models)和具身人工智能(Embodied AI)的研究,设有 13 个相关研讨会,这标志着人工智能正从理解世界转向预测和行动。这一转变的驱动力在于生成式 AI 的进步使得世界预测能力得到提升,以及机器人和自主系统对新学习范式日益增长的需求。关键讨论将围绕构建、评估和将这些模型整合到可操作的系统中,中国研究人员正积极参与定义边界、建立评估指标以及在真实机器人上部署模型。
-
Adobe 将 AI 生成器直接集成到 Premiere 视频编辑时间线中
Adobe 正在通过新的生成式媒体工具增强其 Premiere 视频编辑软件,旨在直接在时间线内简化 AI 内容创作。此功能允许编辑者在不离开项目的情况下生成视频片段、音效、音乐和声景,可从 Adobe Firefly、Google Veo、Runway、Luma 和 Kling 等各种模型中进行选择。此外,Premiere 还将推出用于说话人分离和音乐淡入淡出的 AI 音频工具测试版,而 After Effects 将集成 AI 助…
-
Google AI 推出 Gemini Omni 1.1 Flash 和 FlowbyGoogle 升级
Google AI 宣布对其 FlowbyGoogle 平台进行升级,包括 Gemini 应用的场景扩展功能。这些增强功能将面向全球 Gemini Plus、Pro 和 Ultra 订阅用户推出,并且也将集成到 GoogleAIStudio 和 Gemini Enterprise Agent Platform 中。此外,Google AI 还推出了 Gemini Omni 1.1 Flash,这是一款专为视频生成和编辑设计的新型多模态…
-
新研究探讨了大型语言模型和视觉-语言模型的先进越狱技术及检测方法
研究人员正在开发先进的方法来测试大型语言模型和视觉-语言模型在面对越狱尝试时的安全性和鲁棒性。SEAV等新框架专注于验证模型响应的正确性和程序准确性,而不仅仅是语义上的合理性。其他研究引入了元自适应攻击,该攻击会优化攻击者本身以利用多模态模型的漏洞,在GPT-4o和Gemini 3 Pro Preview等领先模型上取得了高成功率。此外,还在探索通过分析模型激活来检测未见过越狱攻击的方法,旨在提高安全评估的泛化能力和效率。
-
Veo AI 工具确保强制字幕完全可见
本文讨论了一种确保使用 Veo AI 工具创建的视频中的强制字幕在指定安全区域内完全可见的方法。它提出了一种结构化的验证方法,超越了主观评估,转向客观检查。该过程包括创建强制字幕清单、记录其外观以及在定义的框架内验证其位置,从而确保每个字幕在最终交付前都得到充分显示。
-
AI 视频制作工作流程强调来源材料注册表
本文讨论了一种用于组织视频制作来源材料的方法,特别是在使用 AI 工具时。它提出为每个输入文件创建一个注册表,以跟踪其来源、目的、负责人和确认状态。该注册表旨在防止不清楚或未经验证的文件被误认为是最终资产,确保在制作继续之前任何不确定性都可见。作者建议采用最小注册表格式,并强调其价值在于识别缺失信息,而不仅仅是编目现有资产。
-
Claude Code 技能集成 300 多个媒体模型和 25 个工作流
为 Claude Code 开发的一项新技能,通过集成 300 多个不同模型并提供 25 个预构建工作流,以简化媒体生成。该工具旨在消除对各种媒体生成服务的多个注册和密钥的需求,将它们整合在一个密钥下。该技能提供了用于产品渲染、广告和电子商务视觉效果等任务的现成配方,摆脱了传统的空白提示方法。
-
Telegram视频机器人模糊定价和数据隐私
一些Telegram机器人声称使用Sora、Veo和Kling等模型提供视频生成服务,但它们的定价结构通常令人困惑且不透明。虽然直接通过API访问这些模型是按秒计费的,但机器人通常采用基于代币的订阅模式,这使得难以确定每个生成视频的实际成本。此外,许多机器人缺乏自己的隐私政策,这意味着用户依赖Telegram的默认条款,这些条款将数据处理责任推给了机器人开发者,并且不保证用户上传的视频文件的安全存储或提示删除。
-
Viggle AI 提供免费套餐,但有使用限制和广泛的内容许可
Viggle AI 提供免费套餐,允许用户每天创建最多五段视频,一次只能渲染一个,存储期限为七天。然而,定价和存储细节可能因官方来源和第三方评论而异,因此务必访问 viggle.ai 网站以获取最新信息。该服务的使用条款授予 Viggle AI 使用上传内容的广泛许可,包括用于训练其 AI 模型,这意味着用户需对因使用他人图像而产生的任何版权或隐私问题承担全部责任。
-
Veo 视频生成成本:直接 API 比俄罗斯转售商便宜
视频生成成本的比较显示,直接从 Google 的 Veo API 购买比通过俄罗斯中间商购买要便宜得多。通过官方 API 生成一个 8 秒的视频大约需要 251 卢布,而俄罗斯转售商收费 960 卢布,价格相差 3.8 倍以上。这挑战了聚合商总是提供更好价值的普遍假设,并突显了从俄罗斯直接访问可能存在的问题,例如需要外国支付方式和 VPN,以及不确定的地区支持。
-
OpenAI关闭Sora;AI视频生成市场转向Veo、Kling
OpenAI已停止其Sora视频生成服务,网页版和应用程序将于2026年4月26日关闭,Videos API将于2026年9月24日关闭。据报道,该服务每天的运营成本高达约100万美元,但收入仅为210万美元,导致用户流失。这使得Google的Veo、Kling以及一些俄罗斯本土服务和Telegram机器人成为AI视频生成的主要选择,它们各自拥有不同的定价模式和访问方式,特别是对俄罗斯用户而言。
-
Veo Extend 工作流程限制详解,适用于 AI 视频生成
Veo Extend 是一款用于延续 AI 生成视频场景的工具,在引入新角色或声音时会遇到限制。当前工作流程要求使用 Veo Extend 延续现有场景与在 Omni Flash 中创建具有特定角色和声音参考的新场景,需要分开处理。建议用户策略性地在这些模式之间切换,使用 Extend 进行延续,使用 Omni Flash 添加新元素,而不是在需要高级参考时反复在 Extend 中重新生成。一种实用的方法是,有意结束一个 Extend…
-
MiniMax发布H3视频模型,成本仅为竞品三分之一,将开源
MiniMax发布了其H3视频生成模型,该模型在性能上可与Seedance 2.0等顶级模型媲美,但成本仅为其三分之一。H3的显著特点是能够在一个统一的框架内整合文本、图像和音频等多种模态,用于视频创作和编辑。该模型在需要精确编辑、一致文本渲染和视听同步的任务上表现出色,旨在超越简单的素材生成,迈向商业级视频制作。
-
最小化 API 载荷数据以进行初始集成测试,即使是与可信赖的提供商合作
本文讨论了在初始 API 集成测试中最小化传输数据的重要性,即使是与信誉良好的提供商合作。文章强调,供应商尽职调查并不能否定请求最小化的必要性,因为数据可能会被转发给第三方模型。作者提出了一种“数据准入表”方法,用于在试点测试中明确定义和批准载荷中的每个字段,确保只发送必要的数据。
-
字节跳动 Seedance 2.0 提供高级 AI 视频控制,位居排行榜榜首
字节跳动发布了 Seedance 2.0,这是一款 AI 视频生成模型,提供前所未有的多模态输入功能,允许用户提供多达九张图片、三个视频片段和三个音频片段来指导生成。这种被称为多模态参考融合的高级控制,能够精确复制角色面部和摄像机运动等元素,使其区别于 Sora 和 Veo 等模型。该模型在文本到视频和图像到视频生成方面位居排行榜榜首,尽管 Sora 2 和 Kling 3.0 等其他模型在物理真实感和运动质量等特定领域仍表现出色。
-
用户使用开源工具自动化 Google Veo 视频生成
一位用户开发了一个开源工具,用于自动化使用 Google 的 Veo 视频生成服务,该服务包含在其 Google AI Pro 计划中。该工具被构建为一个 MCP 服务器,允许用户批量生成视频片段和静态图像,通过设置预算上限来管理成本,并避免与 Veo 基于聊天的界面进行繁琐的手动交互。此自动化旨在更好地利用 Google AI Pro 计划提供的有限月度视频片段,并与其他免费工具集成以进行编辑和后期制作。
-
新的越狱技术欺骗Veo和Sora,绕过AI安全措施
一种新的文本到视频越狱技术比其最接近的竞争对手展示了高出18.6%的成功率。该方法巧妙地将有害指令隐藏在两个看似安全的帧中,从而有效地欺骗了Veo和Sora等先进的文本到视频模型。该漏洞的优越性能凸显了当前生成视频的AI安全措施的脆弱性。