Model and Modality Playbooks2026年9月15日Flatkey Team

用于 OpenAI 兼容工作流的 Imagen API 定价与路由检查

使用这份 2026 年 9 月 Imagen API 定价与路由清单,在上线前核对 Gemini 图像模型价格、弃用状态、Flatkey 路由以及可接受图片成本。

用于 OpenAI 兼容工作流的 Imagen API 定价与路由检查

更新于 2026 年 9 月 15 日。

用于 OpenAI 兼容工作流的 Imagen API 定价与路由检查现在首先从迁移检查开始,而不是价格查询。Google 目前的图像生成文档表明,旧版 Imagen 模型已弃用,并将于 2026 年 8 月 17 日关闭,而 Google 的弃用表列出了 imagen-4.0-generate-001imagen-4.0-ultra-generate-001imagen-4.0-fast-generate-001,并将 gemini-3.1-flash-image 作为推荐替代项。

对于仍在搜索“Imagen API pricing”的团队来说,实际问题是:应该用哪个当前图像模型来替换该路由,它按什么单位计费,以及你的 OpenAI 兼容工作流是否真的能通过你计划使用的端点调用它?

Flatkey 负责运营层面的部分:保留一个密钥、一个余额、一张账单,以及一个用于当前路由的模型目录。但路由检查仍然很重要。Flatkey 的图像指南将适用于 gpt-image-2 的 OpenAI Images 兼容路由与适用于 Gemini 图像模型的原生 Gemini generateContent 路由区分开来,并警告 Gemini 图像模型不能通过 /v1/images/generations/v1/images/edits 调用。

快速答案:Imagen 现在只是一个迁移关键词

如果你的待办事项里写着“Imagen API”,请将其视为一个旧标签,并在发布前确认当前的 Gemini 图像模型。到 2026 年 9 月 15 日,基于来源的检查如下:

检查项需要验证什么为什么重要
模型生命周期Imagen 4 的模型 ID 已关闭;gemini-2.5-flash-image 已弃用,并将于 2026 年 10 月 2 日关闭。过时的模型 ID 可能通过代码审查,但在运行时失败。
当前替代项Google 将 Imagen 4 用户指向 gemini-3.1-flash-image;Google 还列出了 gemini-3.1-flash-lite-imagegemini-3-pro-image,以满足不同的成本和保真度需求。替代项的选择会同时改变成本和质量预期。
计费单位Gemini 图像输出按图像输出 token 计价,并按分辨率给出每张图片的示例。按单张图片规划的数字可能会掩盖提示、编辑、被拒绝输出和重试成本。
端点家族Flatkey 的 OpenAI Images 兼容端点用于 gpt-image-2;Gemini 图像模型使用原生 Gemini generateContent“OpenAI 兼容”并不意味着每个图像模型都属于 /v1/images/generations
路由状态发布前请确认当前的 Flatkey 模型行、端点类型、定价表达式和公共状态页面。模型目录和上游可用性变化速度比产品路线图更快。

这就是用于 OpenAI 兼容工作流的 Imagen API 定价与路由检查的核心:统一价格单位,选择当前模型,然后测试你的代码将使用的准确路由。

需要统一的当前 Google 图像模型定价

在规划时,请将提供方定价作为事实来源,然后在提交预算之前将其与 Flatkey 仪表板和使用账本进行比较。Google 的定价页面列出了以下当前图像行:

当前模型Google 命名付费输入价格付费图像输出价格Google 的每张图示例
gemini-3.1-flash-imageNano Banana 2$0.50 per 1M 文本/图像 tokens$60.00 per 1M 图像输出 tokens在 0.5K 时为 $0.045,在 1K 时为 $0.067,在 2K 时为 $0.101,在 4K 时为 $0.151
gemini-3.1-flash-lite-imageNano Banana 2 Lite$0.25 per 1M 文本/图像/视频 tokens$30.00 per 1M 图像输出 tokens每 1K 图像 $0.0336;批量输出每 1K 图像 $0.0168
gemini-3-pro-imageNano Banana Pro$2.00 per 1M 文本/图像 tokens;图像输入等效为每张图像 $0.0011$120.00 per 1M 图像输出 tokens每 1K/2K 图像 $0.134;每 4K 图像 $0.24
gemini-2.5-flash-imageNano Banana legacy已弃用使用前请检查Google 警告称它将于 2026 年 10 月 2 日关闭

决定因素不是“哪一行最便宜”。媒体团队应将每个模型映射到一种工作类别:

  • 在高吞吐草稿生成中使用 gemini-3.1-flash-lite-image,因为此类场景的硬性约束是延迟和成本。
  • 当你需要更强的文本渲染、一致性以及最高 4K 的输出选项时,使用 gemini-3.1-flash-image 作为通用替代路径。
  • 对于本地化、grounding、品牌一致性和创意控制足以证明更高输出 token 费率合理的复杂生产资产,使用 gemini-3-pro-image

然后将同一组提示分别通过每个候选模型运行,并比较已接受图像成本,而不仅仅是列出的输出价格。

为什么标注的 token 价格不等于已接受图像成本

图像工作流比文本工作流有更多隐藏成本。一个提示可能生成一张可用图像、五张被拒绝图像,或者由于安全拦截、路由不匹配、超时或艺术指导失败而没有任何可交付结果。编辑工作流还会增加输入图像成本和额外重试。

对每条候选路由都使用以下公式:

accepted_image_cost =
  (successful_request_cost + failed_request_cost + retry_cost + edit_input_cost)
  / accepted_assets

分别跟踪这些输入:

指标定义在哪里检查
成功请求成本至少返回一个图像候选项的请求成本。服务商账单和 Flatkey 使用台账。
失败请求成本路由错误、安全拦截、空图像部分以及仍然消耗用量的客户端超时所产生的成本。错误日志、状态页面和使用台账。
重试成本在提示、seed、尺寸、安全或品牌审核失败后重新生成的成本。创意 QA 队列和运行日志。
编辑输入成本用于编辑的参考图像、遮罩和之前输出的成本。请求负载日志和模型用量。
已接受资产通过人工或自动创意 QA,并进入活动、产品界面或资产库的图像。DAM、CMS、活动跟踪器或评审委员会。

对于生产规划,请在上线文档中保留两个数字:计划输出的已列供应商成本,以及根据你自己的提示集测得的已接受图像成本。

OpenAI 兼容工作流的路由检查

OpenAI 兼容的文本路由通常只需一行 base_url 更改。图像路由需要额外一道检查,因为图像 API 并不能互换。

Flatkey 的 OpenAI Images 兼容 API 参考文档记录了:

POST https://router.flatkey.ai/v1/images/generations
POST https://router.flatkey.ai/v1/images/edits

这些路由接受面向该通道公开的模型的 OpenAI Images 风格请求结构,例如 gpt-image-2。Flatkey 的 Gemini 指南记录了通过以下方式进行 Gemini 图像生成:

POST https://router.flatkey.ai/v1beta/models/{model}:generateContent

请求必须在响应配置中包含图像输出,且生成的图像会以 Gemini 响应部分中的内联图像数据返回。如果你将 Gemini 图像模型发送到 OpenAI Images 端点,Flatkey 的文档警告该请求可能返回 get_channel_failed

在上线前,将端点家族写入你的集成契约中:

工作负载模型家族Flatkey 路由家族主要验证
OpenAI Images 风格生成gpt-image-2/v1/images/generations确认图像返回在 data[0].b64_json 中。
OpenAI Images 风格编辑gpt-image-2/v1/images/edits确认 multipart 图像上传、可选 mask,以及 base64 结果处理。
Gemini 图像生成或编辑gemini-3.1-flash-image, gemini-3.1-flash-lite-image, gemini-3-pro-image/v1beta/models/{model}:generateContent确认请求中的图像模态,以及响应中的内联图像数据。
遗留 Imagen 待办项旧的 imagen-* ID不要假设路由可用替换为当前的 Gemini/Nano Banana 行,并对确切的模型 ID 进行冒烟测试。

这张路由表应当放在你的定价表旁边。只有在路由家族被证明可用后,成本估算才算具备上线条件。

上线前的 Flatkey 检查

将 Flatkey 作为控制平面检查,而不是源头验证的替代品。一个实用的发布评审应包括:

  1. 打开 Flatkey 模型目录并搜索确切的模型 ID。
  2. 确认供应商、路由状态、支持的端点类型以及定价展示。
  3. 将 Flatkey 当前的模型行与 Google 的定价页面进行比较。
  4. 检查 Flatkey 状态页面是否有正在发生的事故或路由降级。
  5. 从与生产将使用相同的环境中运行一次冒烟请求。
  6. 确认你的应用所期望的结果格式:OpenAI Images 风格输出使用 b64_json,或 Gemini 输出使用内联图像数据。
  7. 在发布工单中记录请求 ID、模型 ID、端点、延迟、输出大小和成本。
  8. 在创意批处理作业运行前添加允许列表或预算护栏。

目标不是把你的团队锁定在某一家提供商上。目标是让模型切换变得无感:当前模型行、明确的端点族、使用账本,以及清晰的回退标准。

Imagen 迁移工作的上线检查清单

在替换旧版 Imagen 调用或为一个兼容 OpenAI 的应用新增 Gemini 图像路由时,请使用此清单。

步骤通过条件
生命周期检查没有任何活动代码路径引用 imagen-4.0-generate-001imagen-4.0-ultra-generate-001imagen-4.0-fast-generate-001
替换检查发布工单中写明了当前模型,例如 gemini-3.1-flash-imagegemini-3.1-flash-lite-imagegemini-3-pro-image
端点检查代码对 Gemini 图像模型使用 Flatkey /v1beta/models/{model}:generateContent,而不是 /v1/images/generations
定价检查预算表包含提供商输出 token 价格、预期分辨率、重试比例以及已接受图像成本。
限流检查批处理方案考虑了 RPM、TPM、RPD 和 IPM 限制;预览或实验性限制按更严格标准处理。
响应检查解析器能够处理文本部分、图像部分、空图像结果和安全拦截。
水印检查相关方知晓 Google 表示 Gemini 生成的图像包含 SynthID 水印。
回退检查已使用相同的提示词契约和审核标准测试回退路由。
账本检查在冒烟测试之后以及首次生产批次之后,都会检查 Flatkey 使用日志。

如果任意一行未通过,不要将其视为创意问题,而要视为生产就绪问题。

如何为兼容 OpenAI 的工作流运行 Imagen API 定价与路由检查

按以下顺序运行检查:

  1. 从 Google 的 Gemini API 定价Gemini 弃用说明Nano Banana 图像生成速率限制页面开始。
  2. 将这些提供商事实与当前的 gemini-3.1-flash-image 的 Flatkey 模型行进行比较。
  3. 在 Flatkey 的 图像生成指南兼容 OpenAI Images 的 API 参考中确认路由行为。
  4. 运行冒烟测试,然后将 Flatkey 使用账本中的成本与已接受图像数量进行比较。

这个顺序可让用于兼容 OpenAI 的工作流的 Imagen API 定价与路由检查始终建立在官方定价、当前模型生命周期以及你的应用实际会调用的路由之上。

如果您仍在比较模型家族,请先阅读 GPT Image vs Imagen APIGPT Image vs Gemini Image API。如果您需要更完整的操作模型,请参考 Image Generation API 实用指南图像生成 API 指标指南

对于构建 agentic 媒体管线的团队,可将此检查清单与 多模态代理路由手册 以及 AI 模型目录指南 配合使用。然后在上线前验证实时的 Flatkey 模型目录定价页面状态页面 以及 Flatkey 图像生成文档

常见问题

Imagen API 现在仍然适合新项目吗?

通常不适合。Google 当前文档将 Imagen 模型标记为已弃用,并说明它们将于 2026 年 8 月 17 日关闭。对于新项目,请从当前的 Gemini/Nano Banana 图像模型开始,并在实施前确认准确的模型 ID。

我可以通过兼容 OpenAI Images 的端点调用 Gemini 图像模型吗?

不能通过 Flatkey 的 /v1/images/generations/v1/images/edits 路由调用。Flatkey 的文档说明 Gemini 图像模型使用原生 Gemini generateContent;兼容 OpenAI Images 的路由适用于在该端点家族中提供的图像模型,例如 gpt-image-2

哪个当前模型应替代 Imagen 4?

Google 的弃用表将 gemini-3.1-flash-image 列为 Imagen 4 模型 ID 的替代项。实际上,团队应针对自己的提示词集测试 gemini-3.1-flash-imagegemini-3.1-flash-lite-imagegemini-3-pro-image,因为成本、延迟和创意接受率会因工作负载而异。

财务在批准批量任务前应审核什么?

请查看服务商的输出 token 价格、预期分辨率、图片数量、重试比例、被拒输出比例、编辑/参考图像使用情况,以及实测的已接受图片成本。单一的每张图片价格不足以支撑生产级活动。

结论

用于 OpenAI 兼容工作流的 Imagen API 定价与路由检查,最终应以路由测试收尾,而不是表格。Imagen 4 已过关闭日期,gemini-2.5-flash-image 处于较早的弃用路径上,而当前的 Gemini 图像模型使用的路由家族与 Flatkey 的 OpenAI Images 兼容端点不同。

使用 Flatkey 将模型访问、计费和使用情况检查集中在一个地方。然后在上线前让每个图像工作流证明四件事:当前模型 ID、当前定价单位、正确的端点家族,以及实测的已接受图片成本。