对于媒体团队来说,Veo API 访问不再只是简单地一行切换模型即可。在你将创作者流量接入 Google 的视频模型之前,你需要核实模型 ID、直接提供方访问、计价单位、异步任务行为、路由状态、降级策略以及生成后使用证明。这正是这份《用于多提供商视频路由的 Veo API 访问清单》的目的。
当你在决定 Veo 是否应成为默认视频路由、是否应作为多提供商策略中的一条路由,或者是否应采用位于网关之外的 Google 直连工作流时,都可以使用这份清单。它面向产品、工程和媒体运营团队,帮助他们在将文本转视频和图像转视频任务投入生产之前,进行可重复的检查。
这份《用于多提供商视频路由的 Veo API 访问清单》已根据 Google Gemini API 文档、Google Gemini API 定价、Flatkey 模型页面、Flatkey 快速入门文档以及 Flatkey 模型目录,于 2026 年 9 月 15 日完成核对。请将每个价格和路由状态都视为带日期的公开快照,并在将生产流量切换过去之前重新检查你的账户条款。
快速答案:Veo API 访问需要检查什么
如果你只有时间快速浏览一遍,请在路由生产任务之前核实以下七个字段:
| 检查项 | 重要原因 | 发布安全快照 |
|---|---|---|
| 直接 Google 模型系列 | Google 现在将通用视频生成指南与 Veo 专属文档分开。 | Google 的视频概览表示,Gemini API 提供 Gemini Omni Flash 和 Veo;当你需要场景扩展、最后一帧控制或旧版 Veo 工作流时,它建议将 Gemini Omni Flash 作为默认视频模型,并将 Veo 3.1 作为默认视频模型。 |
| Veo 模型 ID | 生产任务必须固定精确的模型 ID,而不只是“Veo”。 | Google 的 Veo 文档列出了 veo-3.1-generate-preview、veo-3.1-fast-generate-preview 和 veo-3.1-lite-generate-preview;Flatkey 公共模型页面验证了 Standard 和 Fast 路由,而在本次刷新期间,Lite Flatkey 模型页面返回了 404。 |
| 计费单位 | 视频成本会按时长、分辨率、接受的片段和重试次数累积。 | Google 按秒列出 Veo 3.1 的价格。Flatkey 模型页面显示 Standard 和 Fast 的按秒路由价格,并采用“起价”定价。 |
| 异步任务模型 | 视频生成是一种排队式生产工作流。 | Google 通过长时间运行的操作来记录 Veo 生成:提交、轮询直到 done,然后下载文件。 |
| 输出约束 | 时长、宽高比、分辨率、音频和参考控制决定回退是否有效。 | Google 记录了 4 秒、6 秒和 8 秒的时长选项,16:9 和 9:16,原生音频,720p/1080p/4k 选项,以及按模型划分的参考图像/扩展约束。 |
| 网关路由状态 | 只有特定路由可用且可观测时,网关路由才有价值。 | 对 Standard 和 Fast 进行检查的 Flatkey 模型页面显示 availability_status: available,以及包括 openai-video、gemini 和 openai 在内的端点系列。 |
| 使用证明 | 财务和运营在任务完成后需要证明材料。 | Flatkey 快速入门文档描述了使用 https://router.flatkey.ai/v1、兼容 OpenAI SDK 的设置,以及用于查看模型、令牌、延迟和成本的 Usage Logs。 |
简而言之:在比较创意质量之前,先运行这份用于多提供商视频路由的 Veo API 访问清单。一个提示演示可能看起来不错,但生产路由仍可能缺少计费证据、队列行为或有效的回退契约。
用于多提供商视频路由的 Veo API 访问清单
将这份用于多提供商视频路由的 Veo API 访问清单作为上线门槛。只有在精确的环境、账户、模型 ID、路由和计费界面都已检查后,才将对应行标记为完成。
| 步骤 | 所需证据 | 通过条件 |
|---|---|---|
| 1. 确认视频路由类别 | 直接 Gemini API、Flatkey 路由,或混合多提供商策略。 | 团队知道客户端是在直接调用 Google、Flatkey 的路由器,还是两者都在用。 |
| 2. 选定准确的 Veo 模型 ID | 对于已验证的 Flatkey 路由,使用 veo-3.1-generate-preview 或 veo-3.1-fast-generate-preview;直接使用 Google 的团队也可以评估 Lite。 | 生产配置中没有任何任务使用通用的 veo 别名。 |
| 3. 固定输出契约 | 提示类型、参考图像、宽高比、分辨率、时长、原生音频预期、扩展要求。 | 回退路由可以保留相同的用户可见承诺,否则该任务不具备回退资格。 |
| 4. 统一定价口径 | 每秒价格、时长、分辨率、重试策略、可接受片段率。 | 审批使用的是每个可接受片段的预估成本,而不只是原始每秒价格。 |
| 5. 构建异步处理 | 任务表、操作 ID、轮询/退避、超时、取消路径、存储交接。 | 应用可以承受长时间运行的任务和延迟完成,而不会出现重复计费意外。 |
| 6. 检查路由健康状况 | 提供商访问权限、Flatkey 路由状态、测试请求、错误类别、延迟范围。 | 冒烟测试会记录请求 ID、模型 ID、时长、路由、完成状态和成本。 |
| 7. 设置回退策略 | 允许的回退提供商、被阻止输出的行为、重试预算、降级消息。 | 回退不能在不提示的情况下更改片段时长、宽高比或音频承诺。 |
| 8. 验证可观测性 | 日志、成本台账、路由、重试次数、最终资产 URL、审核决策。 | 产品、工程和财务都可以检查同一条任务记录。 |
| 9. 上线前复核 | Google 文档、Google 定价、Flatkey 模型页面、Flatkey 定价页面、内部运行手册。 | 定价和可用性在发布说明中标注了日期。 |
如需更广泛的路由策略,可将此清单与 Flatkey 的 多模态代理路由指南配合使用。在批准某个模型行之前,先参考 AI 模型目录指南 来解读目录。
确认 Veo 是否是合适的 Google 视频路由
第一个访问问题不是“我们能调用 Veo 吗?”而是“这个工作流应该使用 Veo 还是其他 Google 视频模型?”Google 的 Gemini API 视频概览说明它同时提供 Gemini Omni Flash 和 Veo。同一概览将 Gemini Omni Flash 定位为默认视频模型,并在团队需要场景扩展、最后一帧控制或旧版 Veo 流程时,指引他们使用 Veo 3.1。
这种区分很重要,因为 Veo API 访问通常会因创意需求而进入路线图:更好的电影感运动、高分辨率输出、原生音频、参考控制,或从现有生成场景进行扩展。如果任务是通用视频理解或更广泛的多模态工作,你的路由决策可能会不同。
当任务依赖以下一个或多个特性时,请使用 Veo:
- 带原生音频的短生成片段。
- 在所选模型和账户支持的情况下,输出为 720p、1080p 或 4k。
16:9或9:16输出,时长可控。- 首帧、末帧或扩展行为。
- Google 账号治理或直接 Gemini API 操作语义。
当团队需要将 Veo 与其他视频生成提供商进行比较、集中支出,或在文本、图像、音频和视频模型之间保持一致的路由审核流程时,请使用网关路由。Seedance vs Veo API 对比是当决策具体涉及 Veo 与 Seedance 时的相邻内部阅读材料。
选择当前的 Veo 模型 ID
在这份用于多提供商视频路由的 Veo API 访问清单中,模型 ID 规则很简单:不要把“Veo”配置为生产标签。请配置一个精确的模型 ID,并记录选择它的原因。
| 模型 ID | 文档说明位置 | 何时使用 | 本次刷新中检查的 Flatkey 路由状态 |
|---|---|---|---|
veo-3.1-generate-preview | Google Veo 文档和定价;Flatkey 公共模型页面。 | 你需要标准的 Veo 3.1 路由,并且可以接受更高的路由成本。 | 公共 Flatkey 页面返回 200,并显示了可用的路由元数据。 |
veo-3.1-fast-generate-preview | Google Veo 文档和定价;Flatkey 公共模型页面。 | 你希望获得更低成本、更快的 Veo 通道,并且已经针对你的提示词类别测试过质量。 | 公共 Flatkey 页面返回 200,并显示了可用的路由元数据。 |
veo-3.1-lite-generate-preview | Google Veo 文档和定价。 | 你正在评估 Google Lite 的直接行为及其限制。 | 在本次刷新期间,Flatkey 的公共 Lite 模型页面返回了 404,因此本文不声称存在可用的 Flatkey Lite 路由。 |
Google 的文档将 Veo 3.1 系列标记为预览版。请将其视为发布管理约束:你的生产清单应包括有日期的访问检查、账户权限、与部署相关的允许区域(如果适用)、安全拦截行为、延迟测试以及回滚路径。
在路由前标准化 Veo API 定价
用于多提供商视频路由的 Veo API 访问清单应将定价按作业成本而非模型名称成本进行比较。应从产品暴露的准确时长和分辨率开始,再加上重试率和可接受片段率。
| 路由 | 2026年9月15日检查的公开定价快照 | 8秒规划示例 | 备注 |
|---|---|---|---|
直接使用 Google veo-3.1-generate-preview | 在 720p 或 1080p 时为 $0.40/sec;在 4k 时为 $0.60/sec。 | 在 720p/1080p 时为 $3.20;在 4k 时为 $4.80。 | Google 表示 Veo 3.1 不提供免费套餐,并且只有在视频成功生成时才收费。 |
直接使用 Google veo-3.1-fast-generate-preview | 在 720p 时为 $0.10/sec;在 1080p 时为 $0.12/sec;在 4k 时为 $0.30/sec。 | 在 720p 时为 $0.80;在 1080p 时为 $0.96;在 4k 时为 $2.40。 | 在质量测试后,适合作为草稿或更低成本的 Google 视频线路候选。 |
直接使用 Google veo-3.1-lite-generate-preview | 在 720p 时为 $0.05/sec;在 1080p 时为 $0.08/sec;不支持 4k。 | 在 720p 时为 $0.40;在 1080p 时为 $0.64。 | 本文仅验证了直接 Google 定价;Flatkey Lite 路由未验证。 |
Flatkey veo-3.1-generate-preview | 模型页面显示的按秒定价从 $0.32/sec 起。 | 8 秒起为 $2.56。 | 上线前请验证实时路由设置和计费。 |
Flatkey veo-3.1-fast-generate-preview | 模型页面显示的按秒定价从 $0.08/sec 起。 | 8 秒起为 $0.64。 | 上线前请验证实时路由设置和计费。 |
主要的路由错误是:因为某个回退看起来每秒更便宜就批准了它,然后才发现它改变了分辨率、音频行为、参考控制或可接受片段率。最终比较应按如下方式运行:
accepted_clip_cost:
total_generation_cost: "$ billed for all attempts"
accepted_clips: "通过品牌、安全、动作和渠道 QA 的片段"
formula: "total_generation_cost / accepted_clips"如果某条路由的原始成本更低,但产生了更多被拒绝的片段,那么实际生产成本可能更高。
将 Veo 视为异步视频作业
Google 的 Veo 文档使用长时间运行操作模式。客户端提交生成请求,接收一个 operation 对象,轮询直到操作完成,然后下载生成的视频。Google 的文档还说明,生成的视频会存储两天,必须在该窗口内下载。
这意味着 Veo API 访问需要一个作业系统,而不仅仅是一个请求封装。你的客户端应记录:
- 内部作业 ID。
- 提供方 operation ID 或网关 request ID。
- 模型 ID。
- 输入类型和参考资源。
- 时长、分辨率和宽高比。
- 开始时间、轮询次数、完成时间、超时状态。
- 安全拦截、提供方错误、重试次数,以及如有使用的回退路由。
- 最终资产位置和保留/删除策略。
- 最终计费金额和使用日志链接。
对于 Flatkey 用户,Flatkey API 快速入门是进行基础 URL 设置的下一步。该快速入门文档说明了 https://router.flatkey.ai/v1 以及与 OpenAI SDK 兼容的配置;对于生产环境视频,请保持同样的规范,但要针对你打算使用的具体视频端点和模型路由进行冒烟测试。
验证 Flatkey 路由状态和端点系列
Flatkey 路由验证应在模型页面和你自己的账户日志中进行。
在本次更新中,公开的 Flatkey 模型页面返回 200 的有:
https://flatkey.ai/models/veo-3.1-generate-previewhttps://flatkey.ai/models/veo-3.1-fast-generate-preview
这些页面显示 Google 为供应商,availability_status: available,按秒计费,并且端点系列包括 openai-video、gemini 和 openai。veo-3.1-lite-generate-preview 的公开页面返回 404,因此可以做出的安全结论有限:Google 直接文档化了 Lite,但本次更新未验证 Flatkey 上的 Lite 路由。
在生产环境之前,截取模型行的屏幕截图或导出记录,然后运行一个小型冒烟测试,并确认它出现在 Usage Logs 中。Flatkey 的模型目录和定价页面应当纳入带日期的发布检查清单。
在不同视频提供商之间设置回退规则
对于视频来说,回退比文本更难。文本模型的回退可能保留意图,但风格不同。视频模型的回退可能改变片段长度、镜头行为、参考遵循程度、音频、分辨率、成本以及审核结果。
在启用自动重试之前,请使用以下回退矩阵:
| 故障类别 | 重试同一路由? | 允许回退? | 运维说明 |
|---|---|---|---|
| 临时性路由错误 | 是,在设定的重试预算内。 | 是,如果输出契约等价。 | 保留幂等性,这样重试不会产生重复的用户收费。 |
| 安全或政策阻断 | 否,除非输入已更改,否则不要自动重试。 | 通常不允许。 | 应请求修改提示词/参考素材,而不是静默切换提供商。 |
| 未达到延迟阈值 | 也许可以,如果任务对用户不可见。 | 可以,用于草稿线路。 | 显示进度状态,避免重复的隐藏重试。 |
| 已达到预算上限 | 否。 | 否,除非更便宜的路由已预先批准。 | 预算上限应当停止工作,而不是掩盖支出。 |
| 功能不受支持 | 否。 | 仅当回退支持所需功能时才可以。 | 不要在需要原生音频的场景中回退到无声视频,除非这是产品决策。 |
对于多提供商视频团队,关键是按工作流类别进行路由:
- 原生音频的 Google 片段。
- 低成本的 Veo 草稿片段。
- 参考素材较重的创作者片段。
- 更长的社交视频任务。
- 高分辨率导出任务。
- 需要把被阻止输出返回给编辑的人工审核任务。
这正是统一网关发挥作用的地方:它为工程团队提供一个路由入口,为产品团队提供一个定义模型策略的入口,也为财务团队提供一本可审查的总账。它并不会消除验证每条路由准确输出行为的需要。
运行发布冒烟测试
在向创作者流量开放 Veo API 访问之前,先在预发布环境中运行这份用于多提供商视频路由的 Veo API 访问清单冒烟测试:
- 创建三个具有代表性的任务:仅提示词的横向视频片段、引用图片的纵向视频片段,以及原生音频视频片段。
- 使用计划用于生产环境的完全相同的时长和分辨率,在所选的 Veo 路由上运行每个任务。
- 记录操作 ID、请求 ID、模型 ID、路由、开始时间、完成时间和输出 URL。
- 验证该任务是否出现在 Flatkey 使用日志或直接的 Google 使用记录中。
- 确认总成本与预期的按秒计费单价、时长和分辨率一致。
- 强制发生一次可重试失败,并确认幂等性可防止重复的最终记录。
- 强制发生一个被阻止或被拒绝的任务,并确认 UI 会要求提供修订后的输入,而不是静默回退。
- 确认生成的资源会在提供商保留窗口到期前下载并存储。
- 在发布前与产品、工程和财务一起审查最终证据。
可复制的 Veo 访问记录
在你的发布清单或路由代码库中使用这份用于多提供商视频路由的 Veo API 访问清单记录:
veo_access_record:
checked_at: "YYYY-MM-DD"
owner: "team or person"
route_mode: "direct_google | flatkey | mixed"
model_id: "veo-3.1-fast-generate-preview"
provider_docs_checked:
- "Google Gemini API video overview"
- "Google Gemini API Veo docs"
- "Google Gemini API pricing"
flatkey_checks:
model_page_status: "200"
availability_status: "available"
endpoint_family: "openai-video"
usage_logs_verified: true
output_contract:
duration_seconds: 8
aspect_ratio: "16:9"
resolution: "720p"
native_audio_required: true
reference_images_required: 0
cost_review:
billing_unit: "per_second"
displayed_unit_price: "record current account/page value"
retry_budget: "max attempts"
accepted_clip_cost_target: "USD"
async_handling:
operation_id_saved: true
polling_backoff: "configured"
timeout_policy: "configured"
asset_download_window: "before provider expiry"
fallback_policy:
enabled: false
allowed_routes: []
contract_preserved: true
rollback:
owner: "team or person"
trigger: "error rate, cost, latency, quality, safety"
action: "disable route or switch workflow class"常见问题
如何获取 Veo API 访问权限?
从 Google 的 Gemini API 文档和你的 Google 账号访问权限开始,然后决定该路由是应直接通过 Google 运行,还是通过 Flatkey 之类的网关运行。使用用于多提供商视频路由的 Veo API 访问清单来验证线上模型页面,并在生产流量之前运行一次预发布请求。
我应该使用哪个 Veo 模型 ID?
当你需要标准的 Veo 3.1 通道时,使用 veo-3.1-generate-preview。当 Fast 质量满足你的工作流且更低的按秒路由适用时,使用 veo-3.1-fast-generate-preview。仅在你的 Flatkey 账户或模型页面确认存在可用的 Lite 路由时,才将 veo-3.1-lite-generate-preview 与直接 Google 文档进行对照评估。
Veo API 定价是如何计算的?
Google 按生成秒数列出 Veo 3.1 的价格,不同模型和分辨率对应不同费率。Flatkey 模型页面也会显示已验证的 Veo Standard 和 Fast 页面对应的按秒路由价格。你的生产环境审核应将单价乘以时长、分辨率、重试次数和可接受片段率。
Veo 可以与其他视频生成模型一起路由吗?
可以,但回退必须保留用户可见的输出契约。除非产品明确允许这种降级,否则不要将原生音频、8 秒、1080p 的 Veo 任务自动回退为静音、更短、分辨率更低的任务。
Flatkey 用户在生产前应验证什么?
检查 Flatkey 模型页面、模型目录、定价页面、路由健康状况和使用日志。然后运行针对视频的冒烟测试,而不是假设一个与 OpenAI 兼容的文本快速入门就能证明视频行为。
最终结论
用于多提供商视频路由的 Veo API 访问清单最终应以有日期的证据收尾,而不是偏好。冻结模型 ID,按已接受片段规范化定价,为异步任务进行设计,验证 Flatkey 路由或直接的 Google 账户,并且仅在能保留输出契约时才批准回退。然后使用 Flatkey 的模型目录、定价页面、快速入门和使用日志,在上线后继续保持生产路由可审计。



