Google Vids
PulseAugur coverage of Google Vids — every cluster mentioning Google Vids across labs, papers, and developer communities, ranked by signal.
- 2026-07-17 product_launch Google Vids launched Gemini Omni and personal AI avatars, enhancing video creation capabilities. 来源
- 2026-07-17 product_launch Google Vids launched new features including Gemini Omni, AI avatars, and script-level voice controls. 来源
- 2026-07-16 product_launch Google Vids launched new text-to-video editing and selfie avatar features. 来源
- 2026-07-16 product_launch Google Vids has been updated with new AI features, including personalized avatars and Gemini Omni integration. 来源
- 2026-07-13 product_launch Google Vids expanded its AI-powered presentation-to-video feature to support seven new languages. 来源
- 2026-06-25 product_launch Google Vids has launched significant enhancements to its AI avatar features, including expanded customization options and new action-directing capabilities. 来源
2 天有情绪数据
-
新的VIDS-Seg方法提高了儿科心脏成像中的AI安全性
研究人员开发了VIDS-Seg,一种用于医学图像分割的不确定性量化新方法,特别针对儿科心脏超声。该方法基于VIDS框架,使用摊销变分推断来适应分布变化,使模型能够识别其在儿童等代表性不足的亚组上可能失败的情况。在左心室分割测试中,VIDS-Seg在保持基线准确性的同时,提供了更可靠的与分割误差相关的估计不确定性,从而实现了更稳定的射血分数估计和对婴儿心脏功能障碍的更好检测。
-
新的ViDS系统使用3D面部追踪进行逼真的肖像动画
研究人员开发了ViDS,一种新颖的视频扩散着色器,它利用3D面部追踪来创建逼真且保留身份的肖像动画。该系统从参考图像中重建3D可变形模型(3DMM)网格,并使用驱动视频中的表情和姿势数据对其进行动画处理。ViDS采用视频扩散模型作为神经着色器,利用3DMM法线贴图中的密集几何线索生成逼真的动画,从而保持原始外观和身份。与以前的方法相比,该方法在表情和姿势控制方面有所改进,并且自回归扩散采样过程增强了生成片段之间的一致性。
-
AI进展:实时编辑、新的Google Vids功能以及英伟达的物理AI合作伙伴关系
Decart推出了Lucy 2.5,这是一款专为30FPS视频流实时编辑设计的AI。与此同时,Google正在通过Gemini Omni和个人头像等新功能增强其视频创作工具Google Vids。在另一项发展中,英伟达正与包括FANUC和富士通在内的20多家日本公司建立合作伙伴关系,以推进物理AI领域。
-
Google Vids 集成 Gemini Omni 和 AI 头像,增强视频创作能力
Google Vids 已通过 Gemini Omni 更新,使用户能够通过自然语言提示和图像生成和编辑视频。该平台还引入了个性化 AI 头像,允许用户以数字替身的形式出现在自己的视频中。这些新功能,包括脚本级语音控制和为生成内容添加的 SynthID 数字水印,正在向符合条件的 Google Workspace 和 AI Pro 订阅用户推出。
-
Google Vids 新增文本生成视频和自拍虚拟形象功能
Google Vids 推出了包括文本生成视频编辑和自拍虚拟形象在内的多项新功能。订阅用户现在可以使用文本提示生成和编辑视频,并从自拍创建个性化的会说话的虚拟形象。然而,这些高级功能的访问权限仅限于该服务的付费套餐。
-
Google Vids 新增个性化 AI 头像和 Gemini Omni 集成
Google Vids 已更新,允许用户创建自己的个性化 AI 头像用于视频创作。该工具现已集成 Gemini Omni,可通过文本提示结合参考图像生成视频,并提供背景替换和灯光调整等高级编辑功能。此次更新将 Google Vids 定位为 Google Workspace 中一个全面的视频创作平台,与专业的 AI 视频初创公司展开竞争。
-
Google Slides演示文稿转视频功能现已支持日语
Google 推出了一个由 AI 驱动的新功能,用于 Google Slides,可自动将演示文稿转换为视频。该工具名为 Google Vids,可以根据幻灯片内容生成脚本、旁白、背景音乐和动画。该功能现已支持日语,扩大了其可访问性。
-
Google Vids 为 AI 驱动的演示转视频功能新增 7 种语言
Google Vids 是一款由 AI 驱动的工具,可以将 Google Slides 演示文稿转换为视频,现已扩展支持七种新语言。该应用程序利用 Gemini AI,可以生成脚本、添加配音以及插入音乐和动画。此次扩展对于国际团队和教育工作者来说是一个重大利好,无需第三方服务即可将本地化的幻灯片无缝转换为带旁白的视频素材。该功能正在向 Google Workspace 的各个层级以及订阅了 Google AI Pro 或 Ultra …
-
Google Vids 通过更多定制和动作增强 AI 头像
Google Vids 已显著增强了其面向 Workspace 用户的 AI 头像功能,将预设头像库从 23 个扩展到 53 个,并增加了对 16 种新语言的支持,总数达到 24 种。此次更新还引入了使用 Nano Banana Pro 创建自定义头像的功能,并提供 30 多种不同的语音选项。一项关键的新功能允许用户通过文本提示来指挥头像,使其能够执行行走或与上传的图像进行交互等动作,从而使它们在生成的视频中成为更具动态性的叙事者。
-
Google Vids 将幻灯片转换为 AI 视频;Raycast 为 Windows 应用添加智能聊天
Google Vids 推出了一项新功能,可将 Google Slides 演示文稿转换为视频,并包含 AI 生成的脚本和故事板。该平台还支持 24 种语言的 AI 虚拟形象和配音,允许用户通过文本命令控制虚拟形象的移动和交互。另外,Raycast 更新的 Windows 应用程序现在包含一个 AI 驱动的智能聊天功能,使用户能够在对话中访问和切换最新的 AI 模型,并为 Mac 和 Windows 提供新的内联替换功能,以简化日常任务。
-
Google 为免费视频宣传片提供 24 种语言的 AI 头像
Google 现在免费提供其 AI 驱动的自定义头像,允许用户无需付费订阅即可使用多达 24 种语言制作视频宣传片。此功能以前需要订阅,旨在增强 Google Vids 的功能。
-
Google DeepMind 发布 Lyria 3 Pro,用于创作更长、更具可定制性的 AI 音乐
Google DeepMind 推出了 Lyria 3 Pro,这是一款先进的 AI 音乐生成模型,能够创作长达三分钟的曲目。新版本增强了对音乐创作的控制,允许用户指定前奏、主歌和副歌等元素。Lyria 3 Pro 将被集成到各种 Google 产品中,包括面向企业的 Vertex AI、Google AI Studio、付费订阅用户的 Gemini 应用以及 Google Vids,旨在提供可扩展、高保真的音频制作和创意工具。
-
Google DeepMind 发布 Gemini 3.1 Flash TTS、Live 和 Lite 模型
Google DeepMind 推出了一系列 Gemini 3.1 Flash 模型,包括用于高级文本到语音的 Flash TTS、用于实时对话的 Flash Live 以及用于成本高效、大批量工作负载的 Flash-Lite。这些模型提供了改进的自然度、表现力和速度,其中 Flash TTS 在语音质量基准测试中获得了高 Elo 分数,Flash Live 在复杂任务完成方面表现强劲。TTS 和 Live 模型生成的所有音频都使用 …
-
Google DeepMind 增强 Veo 3.1 视频模型,提升一致性和控制力
Google DeepMind 发布了 Veo 3.1,这是一个更新的视频生成模型,增强了用户的一致性、创意和控制力。新版本为移动优先内容提供原生竖屏输出,支持 upscaling 至 1080p 和 4K 分辨率,并提高了角色和场景的身份及背景一致性。这些改进正与 Flow 工具中的新编辑功能一起,集成到 Gemini 应用、YouTube 和 Vertex AI 等各种 Google 产品中。