top of page

Veo 3.1 更新:垂直视频、4K 输出和角色一致性

Veo 3.1 Update: Vertical Video, 4K Output, and Character Consistency

Google 的发布 Veo 3.1 代表了生成式视频如何融入专业工作流程的明显转变。该更新于 2026 年 1 月中旬发布,不仅带来了更高的保真度——尽管跃升至 4K 值得关注——更重要的是工作流程的集成。该工具现已通过 Gemini API、Google AI Studio 和 Vertex AI 全面上线。

对于开发者和创作者而言,重点在于控制。提示的“老虎机”时代正在让位于精准的导演,具体通过原生竖屏模式和“Ingredients”系统等新功能实现。

以下是实际可用的功能、用户在真实场景中的发现,以及如何使用这些新功能。

代理式工作流:自动化 Veo 3.1

The Agentic Workflow: Automating Veo 3.1

在深入规格之前,最有趣的发展并非来自 Google 的文档,而是早期采用者找到的更好驱动软件的方法。

用户正在绕过标准聊天界面,转而采用“代理式”工作流。社区中出现的一种实用方法是 chaining Veo 3.1 与 Claude Code 等高级编码代理。

社区的使用方式

用户不再为每个片段手动提示,而是设置自动化链条。您提供脚本或“角色表”(定义主体的静态图像),代理会指示 Google 工具链生成视频素材。

一位用户指出,从静态角色表到完整动画的过渡“完美无瑕”,保留了通常会在其他模型中幻化的特定物理细节。这证实了模型对输入图像的遵循度已显著提高。如果您正在构建自动化内容管道,API 现在提供了足够结构,让 AI 完成繁重工作而无需持续人工修正。

Veo 3.1 的核心功能

Core Features in Veo 3.1

官方发布说明突出了三项主要功能变化:更好的移动支持、更高的分辨率以及更紧密的叙事控制。

Veo 3.1 原生竖屏模式

视频生成模型历来将竖版视频视为事后考虑,通常只是裁剪横版生成结果,从而破坏构图。Veo 3.1 引入了对 9:16 宽高比的原生支持。

这对面向 YouTube Shorts 或 TikTok 的开发者至关重要。当您通过 API 请求竖版视频时,模型会专门针对该画幅进行构图。您不会因裁剪而丢失像素数据;主体从一开始就被正确地框定在手机屏幕中。这表明 Google 意图将这项技术从“电影实验”转向“日常社交媒体驱动”。

使用“Ingredients”实现角色一致性

AI 视频中最持久的痛点是身份漂移——角色在不同镜头间更换面孔。Google 在 Veo 3.1 中通过更新的“Ingredients to Video”功能解决了这一问题。

该功能允许您向模型提供特定的视觉上下文——“ingredients”——来决定输出外观。

  • 多镜头引导: 您现在最多可提供三张参考图像来指导生成。

  • 工作流集成: 推荐的管道是使用 Nano Banana Pro(Gemini 3 Pro Image 的内部代号)生成高质量基础素材,然后将其输入 Veo。

结果是一个比以往迭代更好地理解物体永久性的系统。如果您分别向模型展示角色和背景,它会以正确的光照和物理交互将它们合成。

4K 分辨率与 1080p 标准

视觉保真度已提升。API 和 Vertex AI 现已支持以 1080p 和 4K 输出 Veo 3.1 内容。虽然 1080p 足以满足大多数社交用例,但 4K 选项面向“电影”群体——使用 AI 制作 B-roll 或故事板且需要在大型显示器上呈现的电影人。

请注意成本影响。标准分辨率的价格模式与 Veo 3 保持一致,但请求 4K 生成会产生溢价。

分析:Veo 3.1 与竞争对手对比

Analysis: Veo 3.1 vs. The Competition

Veo 3.1 的反馈有助于明确 Google 与 Sora 等竞争对手的定位。

物理与“精选”质量

反馈表明 Veo 3.1 在物理一致性方面表现优异。虽然其他模型可能产生更“梦幻”或混乱的运动,但 Veo 似乎优先考虑接地气的运动。这使其不易出现 AI 视频中常见的怪异变形 artifact。它是为商业和专业用途——库存素材、广告、电影——而非仅用于模因生成而设计的。

安全与验证

本周期的一项关键更新是 SynthID 的全面集成。Veo 3.1 生成的每一帧都包含这种不可感知的数字水印。

社区测试证实,Gemini 可以立即识别由 Veo 创建的视频。用户可以将片段上传到 Gemini App,询问“这是 AI 吗?”,并获得验证响应。这种透明度可能是企业采用的必要条件,因为未标记 AI 内容的法律责任风险正在上升。

技术实施指南

Technical Implementation Guide

对于希望立即集成的开发者,以下是使用 Veo 3.1 功能的快速路径。

  1. 访问: 更新已在 Google AI Studio 中上线供实验,在 Vertex AI 中供生产使用。

  2. 编码: Python、Go 和 Java 的库已更新。

  3. 模型选择:

    • 测试用:veo-3.1-generate-preview。

    • 生产用:veo-3.1-generate-4k(若需要高分辨率)。

  4. 提示: 若为移动设备生成,请在 JSON 负载中明确将宽高比定义为 9:16,以触发原生竖屏训练。

Google 将此更新定位为实用工具而非玩具。改进的一致性和水印表明,他们已准备好让这些工具进入实际生产环境,而非仅停留在研究实验室。

FAQ:Veo 3.1 更新

如何专门访问 Veo 3.1?

您可以通过 Google AI Studio、Gemini API 或 Vertex AI 访问。它还集成到 YouTube Shorts 和 Google Vids 等面向消费者的工具中,不过 API 访问能让您对宽高比等参数获得最大控制。

Veo 3.1 是否比上一版本收费更高?

标准分辨率生成的价格与 Veo 3 保持一致。但是,在 Veo 3.1 中使用新的 4K 输出功能,由于计算负载增加,每秒生成视频的费用会更高。

Veo 3.1 能否在不同视频中保持角色一致?

可以。通过使用“Ingredients”功能,您可以上传角色或风格的参考图像(最多三张)。模型会将这些作为锚点,在不同生成中保持身份一致性。

Veo 3.1 中的原生竖屏模式是什么?

与其他裁剪横版视频的工具不同,Veo 3.1 生成的视频专门针对 9:16 宽高比。这确保主体在手机屏幕上被正确框定,而不会损失分辨率或图像质量。

如何判断视频是否由 Veo 3.1 制作?

模型生成的所有内容都包含 SynthID 数字水印。您可以将视频上传到 Gemini App 并 要求其验证内容是否为 AI 生成,它将检测到水印。

获取 Veo 高质量起始图像的最佳方式是什么?

Google 建议使用 Nano Banana Pro(Gemini 3 Pro Image)模型。用该模型生成初始素材,可提供 Veo 3.1 获得最佳视频输出所需的高保真输入“ingredients”。

 
 

免费开始

一款本地优先的AI助手,具备个人知识管理功能

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)M-Chip Mac

在你的大脑里添加一个搜索栏

Ask remio

记住一切

​无需整理

bottom of page