Model and Modality Playbooks2026年9月15日Flatkey Team

用于多提供商视频路由的 Veo API 访问清单

使用这份 Veo API 访问清单来验证模型 ID、定价单位、异步任务、路由状态、回退规则和使用证明。

用于多提供商视频路由的 Veo API 访问清单

对于媒体团队来说,Veo API 访问不再只是简单地一行切换模型即可。在你将创作者流量接入 Google 的视频模型之前,你需要核实模型 ID、直接提供方访问、计价单位、异步任务行为、路由状态、降级策略以及生成后使用证明。这正是这份《用于多提供商视频路由的 Veo API 访问清单》的目的。

当你在决定 Veo 是否应成为默认视频路由、是否应作为多提供商策略中的一条路由,或者是否应采用位于网关之外的 Google 直连工作流时,都可以使用这份清单。它面向产品、工程和媒体运营团队,帮助他们在将文本转视频和图像转视频任务投入生产之前,进行可重复的检查。

这份《用于多提供商视频路由的 Veo API 访问清单》已根据 Google Gemini API 文档、Google Gemini API 定价、Flatkey 模型页面、Flatkey 快速入门文档以及 Flatkey 模型目录,于 2026 年 9 月 15 日完成核对。请将每个价格和路由状态都视为带日期的公开快照,并在将生产流量切换过去之前重新检查你的账户条款。

快速答案:Veo API 访问需要检查什么

如果你只有时间快速浏览一遍,请在路由生产任务之前核实以下七个字段:

检查项重要原因发布安全快照
直接 Google 模型系列Google 现在将通用视频生成指南与 Veo 专属文档分开。Google 的视频概览表示,Gemini API 提供 Gemini Omni Flash 和 Veo;当你需要场景扩展、最后一帧控制或旧版 Veo 工作流时,它建议将 Gemini Omni Flash 作为默认视频模型,并将 Veo 3.1 作为默认视频模型。
Veo 模型 ID生产任务必须固定精确的模型 ID,而不只是“Veo”。Google 的 Veo 文档列出了 veo-3.1-generate-previewveo-3.1-fast-generate-previewveo-3.1-lite-generate-preview;Flatkey 公共模型页面验证了 Standard 和 Fast 路由,而在本次刷新期间,Lite Flatkey 模型页面返回了 404。
计费单位视频成本会按时长、分辨率、接受的片段和重试次数累积。Google 按秒列出 Veo 3.1 的价格。Flatkey 模型页面显示 Standard 和 Fast 的按秒路由价格,并采用“起价”定价。
异步任务模型视频生成是一种排队式生产工作流。Google 通过长时间运行的操作来记录 Veo 生成:提交、轮询直到 done,然后下载文件。
输出约束时长、宽高比、分辨率、音频和参考控制决定回退是否有效。Google 记录了 4 秒、6 秒和 8 秒的时长选项,16:99:16,原生音频,720p/1080p/4k 选项,以及按模型划分的参考图像/扩展约束。
网关路由状态只有特定路由可用且可观测时,网关路由才有价值。对 Standard 和 Fast 进行检查的 Flatkey 模型页面显示 availability_status: available,以及包括 openai-videogeminiopenai 在内的端点系列。
使用证明财务和运营在任务完成后需要证明材料。Flatkey 快速入门文档描述了使用 https://router.flatkey.ai/v1、兼容 OpenAI SDK 的设置,以及用于查看模型、令牌、延迟和成本的 Usage Logs。

简而言之:在比较创意质量之前,先运行这份用于多提供商视频路由的 Veo API 访问清单。一个提示演示可能看起来不错,但生产路由仍可能缺少计费证据、队列行为或有效的回退契约。

用于多提供商视频路由的 Veo API 访问清单

将这份用于多提供商视频路由的 Veo API 访问清单作为上线门槛。只有在精确的环境、账户、模型 ID、路由和计费界面都已检查后,才将对应行标记为完成。

步骤所需证据通过条件
1. 确认视频路由类别直接 Gemini API、Flatkey 路由,或混合多提供商策略。团队知道客户端是在直接调用 Google、Flatkey 的路由器,还是两者都在用。
2. 选定准确的 Veo 模型 ID对于已验证的 Flatkey 路由,使用 veo-3.1-generate-previewveo-3.1-fast-generate-preview;直接使用 Google 的团队也可以评估 Lite。生产配置中没有任何任务使用通用的 veo 别名。
3. 固定输出契约提示类型、参考图像、宽高比、分辨率、时长、原生音频预期、扩展要求。回退路由可以保留相同的用户可见承诺,否则该任务不具备回退资格。
4. 统一定价口径每秒价格、时长、分辨率、重试策略、可接受片段率。审批使用的是每个可接受片段的预估成本,而不只是原始每秒价格。
5. 构建异步处理任务表、操作 ID、轮询/退避、超时、取消路径、存储交接。应用可以承受长时间运行的任务和延迟完成,而不会出现重复计费意外。
6. 检查路由健康状况提供商访问权限、Flatkey 路由状态、测试请求、错误类别、延迟范围。冒烟测试会记录请求 ID、模型 ID、时长、路由、完成状态和成本。
7. 设置回退策略允许的回退提供商、被阻止输出的行为、重试预算、降级消息。回退不能在不提示的情况下更改片段时长、宽高比或音频承诺。
8. 验证可观测性日志、成本台账、路由、重试次数、最终资产 URL、审核决策。产品、工程和财务都可以检查同一条任务记录。
9. 上线前复核Google 文档、Google 定价、Flatkey 模型页面、Flatkey 定价页面、内部运行手册。定价和可用性在发布说明中标注了日期。

如需更广泛的路由策略,可将此清单与 Flatkey 的 多模态代理路由指南配合使用。在批准某个模型行之前,先参考 AI 模型目录指南 来解读目录。

确认 Veo 是否是合适的 Google 视频路由

第一个访问问题不是“我们能调用 Veo 吗?”而是“这个工作流应该使用 Veo 还是其他 Google 视频模型?”Google 的 Gemini API 视频概览说明它同时提供 Gemini Omni Flash 和 Veo。同一概览将 Gemini Omni Flash 定位为默认视频模型,并在团队需要场景扩展、最后一帧控制或旧版 Veo 流程时,指引他们使用 Veo 3.1。

这种区分很重要,因为 Veo API 访问通常会因创意需求而进入路线图:更好的电影感运动、高分辨率输出、原生音频、参考控制,或从现有生成场景进行扩展。如果任务是通用视频理解或更广泛的多模态工作,你的路由决策可能会不同。

当任务依赖以下一个或多个特性时,请使用 Veo:

  • 带原生音频的短生成片段。
  • 在所选模型和账户支持的情况下,输出为 720p、1080p 或 4k。
  • 16:99:16 输出,时长可控。
  • 首帧、末帧或扩展行为。
  • Google 账号治理或直接 Gemini API 操作语义。

当团队需要将 Veo 与其他视频生成提供商进行比较、集中支出,或在文本、图像、音频和视频模型之间保持一致的路由审核流程时,请使用网关路由。Seedance vs Veo API 对比是当决策具体涉及 Veo 与 Seedance 时的相邻内部阅读材料。

选择当前的 Veo 模型 ID

在这份用于多提供商视频路由的 Veo API 访问清单中,模型 ID 规则很简单:不要把“Veo”配置为生产标签。请配置一个精确的模型 ID,并记录选择它的原因。

模型 ID文档说明位置何时使用本次刷新中检查的 Flatkey 路由状态
veo-3.1-generate-previewGoogle Veo 文档和定价;Flatkey 公共模型页面。你需要标准的 Veo 3.1 路由,并且可以接受更高的路由成本。公共 Flatkey 页面返回 200,并显示了可用的路由元数据。
veo-3.1-fast-generate-previewGoogle Veo 文档和定价;Flatkey 公共模型页面。你希望获得更低成本、更快的 Veo 通道,并且已经针对你的提示词类别测试过质量。公共 Flatkey 页面返回 200,并显示了可用的路由元数据。
veo-3.1-lite-generate-previewGoogle Veo 文档和定价。你正在评估 Google Lite 的直接行为及其限制。在本次刷新期间,Flatkey 的公共 Lite 模型页面返回了 404,因此本文不声称存在可用的 Flatkey Lite 路由。

Google 的文档将 Veo 3.1 系列标记为预览版。请将其视为发布管理约束:你的生产清单应包括有日期的访问检查、账户权限、与部署相关的允许区域(如果适用)、安全拦截行为、延迟测试以及回滚路径。

在路由前标准化 Veo API 定价

用于多提供商视频路由的 Veo API 访问清单应将定价按作业成本而非模型名称成本进行比较。应从产品暴露的准确时长和分辨率开始,再加上重试率和可接受片段率。

路由2026年9月15日检查的公开定价快照8秒规划示例备注
直接使用 Google veo-3.1-generate-preview在 720p 或 1080p 时为 $0.40/sec;在 4k 时为 $0.60/sec在 720p/1080p 时为 $3.20;在 4k 时为 $4.80Google 表示 Veo 3.1 不提供免费套餐,并且只有在视频成功生成时才收费。
直接使用 Google veo-3.1-fast-generate-preview在 720p 时为 $0.10/sec;在 1080p 时为 $0.12/sec;在 4k 时为 $0.30/sec在 720p 时为 $0.80;在 1080p 时为 $0.96;在 4k 时为 $2.40在质量测试后,适合作为草稿或更低成本的 Google 视频线路候选。
直接使用 Google veo-3.1-lite-generate-preview在 720p 时为 $0.05/sec;在 1080p 时为 $0.08/sec;不支持 4k。在 720p 时为 $0.40;在 1080p 时为 $0.64本文仅验证了直接 Google 定价;Flatkey Lite 路由未验证。
Flatkey veo-3.1-generate-preview模型页面显示的按秒定价从 $0.32/sec 起。8 秒起为 $2.56上线前请验证实时路由设置和计费。
Flatkey veo-3.1-fast-generate-preview模型页面显示的按秒定价从 $0.08/sec 起。8 秒起为 $0.64上线前请验证实时路由设置和计费。

主要的路由错误是:因为某个回退看起来每秒更便宜就批准了它,然后才发现它改变了分辨率、音频行为、参考控制或可接受片段率。最终比较应按如下方式运行:

accepted_clip_cost:
  total_generation_cost: "$ billed for all attempts"
  accepted_clips: "通过品牌、安全、动作和渠道 QA 的片段"
  formula: "total_generation_cost / accepted_clips"

如果某条路由的原始成本更低,但产生了更多被拒绝的片段,那么实际生产成本可能更高。

将 Veo 视为异步视频作业

Google 的 Veo 文档使用长时间运行操作模式。客户端提交生成请求,接收一个 operation 对象,轮询直到操作完成,然后下载生成的视频。Google 的文档还说明,生成的视频会存储两天,必须在该窗口内下载。

这意味着 Veo API 访问需要一个作业系统,而不仅仅是一个请求封装。你的客户端应记录:

  • 内部作业 ID。
  • 提供方 operation ID 或网关 request ID。
  • 模型 ID。
  • 输入类型和参考资源。
  • 时长、分辨率和宽高比。
  • 开始时间、轮询次数、完成时间、超时状态。
  • 安全拦截、提供方错误、重试次数,以及如有使用的回退路由。
  • 最终资产位置和保留/删除策略。
  • 最终计费金额和使用日志链接。

对于 Flatkey 用户,Flatkey API 快速入门是进行基础 URL 设置的下一步。该快速入门文档说明了 https://router.flatkey.ai/v1 以及与 OpenAI SDK 兼容的配置;对于生产环境视频,请保持同样的规范,但要针对你打算使用的具体视频端点和模型路由进行冒烟测试。

验证 Flatkey 路由状态和端点系列

Flatkey 路由验证应在模型页面和你自己的账户日志中进行。

在本次更新中,公开的 Flatkey 模型页面返回 200 的有:

  • https://flatkey.ai/models/veo-3.1-generate-preview
  • https://flatkey.ai/models/veo-3.1-fast-generate-preview

这些页面显示 Google 为供应商,availability_status: available,按秒计费,并且端点系列包括 openai-videogeminiopenaiveo-3.1-lite-generate-preview 的公开页面返回 404,因此可以做出的安全结论有限:Google 直接文档化了 Lite,但本次更新未验证 Flatkey 上的 Lite 路由。

在生产环境之前,截取模型行的屏幕截图或导出记录,然后运行一个小型冒烟测试,并确认它出现在 Usage Logs 中。Flatkey 的模型目录定价页面应当纳入带日期的发布检查清单。

在不同视频提供商之间设置回退规则

对于视频来说,回退比文本更难。文本模型的回退可能保留意图,但风格不同。视频模型的回退可能改变片段长度、镜头行为、参考遵循程度、音频、分辨率、成本以及审核结果。

在启用自动重试之前,请使用以下回退矩阵:

故障类别重试同一路由?允许回退?运维说明
临时性路由错误是,在设定的重试预算内。是,如果输出契约等价。保留幂等性,这样重试不会产生重复的用户收费。
安全或政策阻断否,除非输入已更改,否则不要自动重试。通常不允许。应请求修改提示词/参考素材,而不是静默切换提供商。
未达到延迟阈值也许可以,如果任务对用户不可见。可以,用于草稿线路。显示进度状态,避免重复的隐藏重试。
已达到预算上限否。否,除非更便宜的路由已预先批准。预算上限应当停止工作,而不是掩盖支出。
功能不受支持否。仅当回退支持所需功能时才可以。不要在需要原生音频的场景中回退到无声视频,除非这是产品决策。

对于多提供商视频团队,关键是按工作流类别进行路由:

  • 原生音频的 Google 片段。
  • 低成本的 Veo 草稿片段。
  • 参考素材较重的创作者片段。
  • 更长的社交视频任务。
  • 高分辨率导出任务。
  • 需要把被阻止输出返回给编辑的人工审核任务。

这正是统一网关发挥作用的地方:它为工程团队提供一个路由入口,为产品团队提供一个定义模型策略的入口,也为财务团队提供一本可审查的总账。它并不会消除验证每条路由准确输出行为的需要。

运行发布冒烟测试

在向创作者流量开放 Veo API 访问之前,先在预发布环境中运行这份用于多提供商视频路由的 Veo API 访问清单冒烟测试:

  1. 创建三个具有代表性的任务:仅提示词的横向视频片段、引用图片的纵向视频片段,以及原生音频视频片段。
  2. 使用计划用于生产环境的完全相同的时长和分辨率,在所选的 Veo 路由上运行每个任务。
  3. 记录操作 ID、请求 ID、模型 ID、路由、开始时间、完成时间和输出 URL。
  4. 验证该任务是否出现在 Flatkey 使用日志或直接的 Google 使用记录中。
  5. 确认总成本与预期的按秒计费单价、时长和分辨率一致。
  6. 强制发生一次可重试失败,并确认幂等性可防止重复的最终记录。
  7. 强制发生一个被阻止或被拒绝的任务,并确认 UI 会要求提供修订后的输入,而不是静默回退。
  8. 确认生成的资源会在提供商保留窗口到期前下载并存储。
  9. 在发布前与产品、工程和财务一起审查最终证据。

可复制的 Veo 访问记录

在你的发布清单或路由代码库中使用这份用于多提供商视频路由的 Veo API 访问清单记录:

veo_access_record:
  checked_at: "YYYY-MM-DD"
  owner: "team or person"
  route_mode: "direct_google | flatkey | mixed"
  model_id: "veo-3.1-fast-generate-preview"
  provider_docs_checked:
    - "Google Gemini API video overview"
    - "Google Gemini API Veo docs"
    - "Google Gemini API pricing"
  flatkey_checks:
    model_page_status: "200"
    availability_status: "available"
    endpoint_family: "openai-video"
    usage_logs_verified: true
  output_contract:
    duration_seconds: 8
    aspect_ratio: "16:9"
    resolution: "720p"
    native_audio_required: true
    reference_images_required: 0
  cost_review:
    billing_unit: "per_second"
    displayed_unit_price: "record current account/page value"
    retry_budget: "max attempts"
    accepted_clip_cost_target: "USD"
  async_handling:
    operation_id_saved: true
    polling_backoff: "configured"
    timeout_policy: "configured"
    asset_download_window: "before provider expiry"
  fallback_policy:
    enabled: false
    allowed_routes: []
    contract_preserved: true
  rollback:
    owner: "team or person"
    trigger: "error rate, cost, latency, quality, safety"
    action: "disable route or switch workflow class"

常见问题

如何获取 Veo API 访问权限?

从 Google 的 Gemini API 文档和你的 Google 账号访问权限开始,然后决定该路由是应直接通过 Google 运行,还是通过 Flatkey 之类的网关运行。使用用于多提供商视频路由的 Veo API 访问清单来验证线上模型页面,并在生产流量之前运行一次预发布请求。

我应该使用哪个 Veo 模型 ID?

当你需要标准的 Veo 3.1 通道时,使用 veo-3.1-generate-preview。当 Fast 质量满足你的工作流且更低的按秒路由适用时,使用 veo-3.1-fast-generate-preview。仅在你的 Flatkey 账户或模型页面确认存在可用的 Lite 路由时,才将 veo-3.1-lite-generate-preview 与直接 Google 文档进行对照评估。

Veo API 定价是如何计算的?

Google 按生成秒数列出 Veo 3.1 的价格,不同模型和分辨率对应不同费率。Flatkey 模型页面也会显示已验证的 Veo Standard 和 Fast 页面对应的按秒路由价格。你的生产环境审核应将单价乘以时长、分辨率、重试次数和可接受片段率。

Veo 可以与其他视频生成模型一起路由吗?

可以,但回退必须保留用户可见的输出契约。除非产品明确允许这种降级,否则不要将原生音频、8 秒、1080p 的 Veo 任务自动回退为静音、更短、分辨率更低的任务。

Flatkey 用户在生产前应验证什么?

检查 Flatkey 模型页面、模型目录、定价页面、路由健康状况和使用日志。然后运行针对视频的冒烟测试,而不是假设一个与 OpenAI 兼容的文本快速入门就能证明视频行为。

最终结论

用于多提供商视频路由的 Veo API 访问清单最终应以有日期的证据收尾,而不是偏好。冻结模型 ID,按已接受片段规范化定价,为异步任务进行设计,验证 Flatkey 路由或直接的 Google 账户,并且仅在能保留输出契约时才批准回退。然后使用 Flatkey 的模型目录、定价页面、快速入门和使用日志,在上线后继续保持生产路由可审计。