Veo 3.1 更新:垂直视频、4K 输出和角色一致性
- Aisha Washington

- 6月6日
- 讀畢需時 5 分鐘

Google 的发布 Veo 3.1 代表了生成式视频如何融入专业工作流程的明显转变。该更新于 2026 年 1 月中旬发布,不仅带来了更高的保真度——尽管跃升至 4K 值得关注——更重要的是工作流程的集成。该工具现已通过 Gemini API、Google AI Studio 和 Vertex AI 全面上线。
对于开发者和创作者而言,重点在于控制。提示的“老虎机”时代正在让位于精准的导演,具体通过原生竖屏模式和“Ingredients”系统等新功能实现。
以下是实际可用的功能、用户在真实场景中的发现,以及如何使用这些新功能。
代理式工作流:自动化 Veo 3.1

在深入规格之前,最有趣的发展并非来自 Google 的文档,而是早期采用者找到的更好驱动软件的方法。
用户正在绕过标准聊天界面,转而采用“代理式”工作流。社区中出现的一种实用方法是 chaining Veo 3.1 与 Claude Code 等高级编码代理。
社区的使用方式
用户不再为每个片段手动提示,而是设置自动化链条。您提供脚本或“角色表”(定义主体的静态图像),代理会指示 Google 工具链生成视频素材。
一位用户指出,从静态角色表到完整动画的过渡“完美无瑕”,保留了通常会在其他模型中幻化的特定物理细节。这证实了模型对输入图像的遵循度已显著提高。如果您正在构建自动化内容管道,API 现在提供了足够结构,让 AI 完成繁重工作而无需持续人工修正。
Veo 3.1 的核心功能

官方发布说明突出了三项主要功能变化:更好的移动支持、更高的分辨率以及更紧密的叙事控制。
Veo 3.1 原生竖屏模式
视频生成模型历来将竖版视频视为事后考虑,通常只是裁剪横版生成结果,从而破坏构图。Veo 3.1 引入了对 9:16 宽高比的原生支持。
这对面向 YouTube Shorts 或 TikTok 的开发者至关重要。当您通过 API 请求竖版视频时,模型会专门针对该画幅进行构图。您不会因裁剪而丢失像素数据;主体从一开始就被正确地框定在手机屏幕中。这表明 Google 意图将这项技术从“电影实验”转向“日常社交媒体驱动”。
使用“Ingredients”实现角色一致性
AI 视频中最持久的痛点是身份漂移——角色在不同镜头间更换面孔。Google 在 Veo 3.1 中通过更新的“Ingredients to Video”功能解决了这一问题。
该功能允许您向模型提供特定的视觉上下文——“ingredients”——来决定输出外观。
多镜头引导: 您现在最多可提供三张参考图像来指导生成。
工作流集成: 推荐的管道是使用 Nano Banana Pro(Gemini 3 Pro Image 的内部代号)生成高质量基础素材,然后将其输入 Veo。
结果是一个比以往迭代更好地理解物体永久性的系统。如果您分别向模型展示角色和背景,它会以正确的光照和物理交互将它们合成。
4K 分辨率与 1080p 标准
视觉保真度已提升。API 和 Vertex AI 现已支持以 1080p 和 4K 输出 Veo 3.1 内容。虽然 1080p 足以满足大多数社交用例,但 4K 选项面向“电影”群体——使用 AI 制作 B-roll 或故事板且需要在大型显示器上呈现的电影人。
请注意成本影响。标准分辨率的价格模式与 Veo 3 保持一致,但请求 4K 生成会产生溢价。
分析:Veo 3.1 与竞争对手对比

对 Veo 3.1 的反馈有助于明确 Google 与 Sora 等竞争对手的定位。
物理与“精选”质量
反馈表明 Veo 3.1 在物理一致性方面表现优异。虽然其他模型可能产生更“梦幻”或混乱的运动,但 Veo 似乎优先考虑接地气的运动。这使其不易出现 AI 视频中常见的怪异变形 artifact。它是为商业和专业用途——库存素材、广告、电影——而非仅用于模因生成而设计的。
安全与验证
本周期的一项关键更新是 SynthID 的全面集成。Veo 3.1 生成的每一帧都包含这种不可感知的数字水印。
社区测试证实,Gemini 可以立即识别由 Veo 创建的视频。用户可以将片段上传到 Gemini App,询问“这是 AI 吗?”,并获得验证响应。这种透明度可能是企业采用的必要条件,因为未标记 AI 内容的法律责任风险正在上升。
技术实施指南

访问: 更新已在 Google AI Studio 中上线供实验,在 Vertex AI 中供生产使用。
编码: Python、Go 和 Java 的库已更新。
模型选择:
测试用:veo-3.1-generate-preview。
生产用:veo-3.1-generate-4k(若需要高分辨率)。
提示: 若为移动设备生成,请在 JSON 负载中明确将宽高比定义为 9:16,以触发原生竖屏训练。
Google 将此更新定位为实用工具而非玩具。改进的一致性和水印表明,他们已准备好让这些工具进入实际生产环境,而非仅停留在研究实验室。
FAQ:Veo 3.1 更新
如何专门访问 Veo 3.1?
您可以通过 Google AI Studio、Gemini API 或 Vertex AI 访问。它还集成到 YouTube Shorts 和 Google Vids 等面向消费者的工具中,不过 API 访问能让您对宽高比等参数获得最大控制。
Veo 3.1 是否比上一版本收费更高?
标准分辨率生成的价格与 Veo 3 保持一致。但是,在 Veo 3.1 中使用新的 4K 输出功能,由于计算负载增加,每秒生成视频的费用会更高。
Veo 3.1 能否在不同视频中保持角色一致?
可以。通过使用“Ingredients”功能,您可以上传角色或风格的参考图像(最多三张)。模型会将这些作为锚点,在不同生成中保持身份一致性。
Veo 3.1 中的原生竖屏模式是什么?
与其他裁剪横版视频的工具不同,Veo 3.1 生成的视频专门针对 9:16 宽高比。这确保主体在手机屏幕上被正确框定,而不会损失分辨率或图像质量。
如何判断视频是否由 Veo 3.1 制作?
模型生成的所有内容都包含 SynthID 数字水印。您可以将视频上传到 Gemini App 并 要求其验证内容是否为 AI 生成,它将检测到水印。
获取 Veo 高质量起始图像的最佳方式是什么?
Google 建议使用 Nano Banana Pro(Gemini 3 Pro Image)模型。用该模型生成初始素材,可提供 Veo 3.1 获得最佳视频输出所需的高保真输入“ingredients”。


