Preços da API de geração de imagens por IA são difíceis de comparar porque os provedores não vendem todos a mesma unidade. O OpenAI GPT Image usa estimativas de custo de imagem baseadas em tokens, os modelos de imagem do Google Gemini combinam preços de tokens de texto, imagem de entrada e imagem de saída, e o Google Imagen часто é apresentado como um preço direto por imagem. Se você comparar apenas o número principal, pode deixar passar cobranças por imagem de entrada, níveis de resolução de saída, descontos de batch/flex, novas tentativas e o status de catálogo específico da rota.
Este guia normaliza as unidades atuais por trás de GPT Image, Gemini Image e Imagen, e então mostra como verificar as mesmas linhas em preços da Flatkey. A verificação de origem foi executada em 17 de junho de 2026, Asia/Shanghai, usando a documentação oficial de orientação de preços para geração de imagens da OpenAI, preços da API Gemini do Google, preços do Google Vertex AI e um snapshot ao vivo da página pública de preços da Flatkey. Trate cada preço abaixo como uma ajuda de planejamento em um ponto específico no tempo e verifique as linhas atuais do provedor e do painel da Flatkey antes do tráfego de produção.
Resposta Rápida: Como Comparar Preços de API de Geração de Imagens com IA
Use quatro colunas sempre que comparar preços de API de geração de imagens com IA:
- Unidade de geração: saída de imagem baseada em tokens, por imagem gerada, por imagem de entrada ou uma unidade roteada específica do painel.
- Resolução e qualidade: quadrada, paisagem, retrato, 1K, 2K, 4K, baixa, média, alta, padrão, rápida ou ultra.
- Entradas extras: texto do prompt, imagens de referência, máscaras, edições, grounding/pesquisa, imagens parciais e novas tentativas.
- Evidência de rota: linha exata do modelo Flatkey, tipo de endpoint, status, logs de uso e rótulo atual de preço.
Na prática: o GPT Image exige cálculo de tokens e qualidade, o Gemini Image exige cálculo de equivalência entre tokens e imagem, e o Imagen exige verificações de preço por imagem, descontinuação e rota de recursos. A Flatkey pode ajudar a centralizar linhas de modelo, suporte a endpoints e logs de uso, mas a linha selecionada ainda precisa de verificação.
Comparação de Unidades de Preço
A tabela abaixo é a visão de normalização central para preços da API de geração de imagens por IA. Ela evita intencionalmente classificar os modelos como os “mais baratos” porque cada provedor expõe unidades diferentes e cada modelo atende a um fluxo de trabalho distinto.
| Família de Provedor | Unidade Oficial Atual | Exemplos de Pontos de Preço Públicos Verificados | Verificações de Custo Oculto | Verificação da Flatkey |
|---|---|---|---|---|
| OpenAI GPT Image 2 | Estimativa de tokens de saída da imagem mais tokens de entrada de texto e imagem. | A calculadora do guia de imagens da OpenAI lista o GPT Image 2 em $0.006, $0.053 e $0.211 para exemplos low, medium e high de 1024x1024; 1536x1024 medium é listado em $0.041. | Tokens de prompt, tokens de entrada de imagem de referência, qualidade, tamanho, formato de saída, streaming de imagem parcial, novas tentativas e edições. | Verifique gpt-image-2 ou openai/gpt-image-2, tipo de endpoint, tipo de cota, rótulo de preço atual e status. |
| Google Gemini 3 Pro Image | Entrada de texto/imagem por 1M tokens e saída de imagem por 1M tokens de imagem, expressa como equivalentes de imagem. | O Google AI lista a entrada standard paga em $2.00 por 1M tokens de texto/imagem e a saída de imagem em $120 por 1M tokens, equivalente a $0.134 por imagem de 1K/2K e $0.24 por imagem de 4K. | Tokens de imagem de entrada, resolução de saída, cobranças de grounding de pesquisa na web/imagem, tipo de nível e se batch/flex ou priority se aplica. | Verifique as linhas gemini-3-pro-image e gemini-3-pro-image-preview, tipo de endpoint e status de disponibilidade. |
| Google Gemini 2.5 Flash Image | Entrada de texto/imagem por 1M tokens e saída mostrada como um equivalente por imagem. | O Google AI lista a entrada standard em $0.30 por 1M tokens de texto/imagem e a saída em $0.039 por imagem 1024x1024; a saída batch/flex é $0.0195 por imagem. | Comportamento do modelo de prévia, elegibilidade batch/flex, tokens de entrada, tamanho de saída, novas tentativas e suporte à rota. | O snapshot de 17 de junho da Flatkey mostrou gemini-2.5-flash-image como disponível com tipos de endpoint gemini e openai. |
| Google Imagen 4 | Por imagem gerada nas tabelas de preços da Gemini API e do Vertex AI. | O Google AI lista o Imagen 4 Fast em $0.02, Standard em $0.04 e Ultra em $0.06 por imagem. | Cronograma de descontinuação, tipo de recurso, upscaling, edição, recontextualização de produto, prova virtual e status da rota. | O snapshot de 17 de junho da Flatkey listou linhas do Imagen 4 com tipos de endpoint image-generation, gemini e openai, mas com status unknown_failure. |
Preços de Imagem do OpenAI GPT: Primeiro a Matemática dos Tokens
O guia atual de geração de imagens da OpenAI diz que os modelos GPT Image podem gerar e editar imagens por meio da Image API e também podem ser usados pelo tool de geração de imagens da Responses API. Para gpt-image-2, a seção oficial de custos diz para estimar tokens de saída com base na qualidade e no tamanho solicitados e, em seguida, contabilizar tokens de entrada de texto e tokens de entrada de imagem se a solicitação editar ou referenciar imagens.
Isso torna o GPT Image diferente de um simples SKU por imagem. O preço visível de um ativo gerado pode mudar quando você altera quality, size, imagens de entrada, parciais em streaming ou comportamento de retry. Os exemplos da calculadora da OpenAI mostram o GPT Image 2 nestas estimativas pontuais:
| Configuração do GPT Image 2 | 1024x1024 | 1024x1536 | 1536x1024 | Observação de Planejamento |
|---|---|---|---|---|
| Baixo | $0.006 | $0.005 | $0.005 | Útil para rascunhos, miniaturas e iteração rápida. |
| Médio | $0.053 | $0.041 | $0.041 | Um padrão prático para benchmark antes da qualidade final. |
| Alto | $0.211 | $0.165 | $0.165 | Use para ativos finais, não para cada prévia. |
Dois detalhes importam para preços da API de geração de imagens por IA: a OpenAI observa que solicitações de edição com imagens de referência podem usar mais tokens de entrada, e cada imagem parcial no streaming adiciona 100 tokens de saída de imagem. Para orçamentos de produção, separe configurações de "prévia" e "render final" em vez de deixar cada ação do usuário chamar uma rota de qualidade final.
Preços de Imagem Gemini: Preços por Token com Equivalentes de Imagem
A página de preços da API Gemini do Google separa os modelos nativos de geração de imagens dos modelos gerais de texto. Os modelos de imagem Gemini ainda usam preços por token nos bastidores, mas a página de preços muitas vezes fornece um número equivalente por imagem, para que as equipes possam planejar sem multiplicar manualmente os tokens de saída de imagem.
Para o Gemini 3 Pro Image, o Google AI lista o preço padrão pago de entrada em US$ 2,00 por 1M de tokens de texto/imagem e informa que a entrada de imagem é definida em 560 tokens, ou US$ 0,0011 por imagem. A mesma página lista a saída de imagem em US$ 120 por 1M de tokens, com exemplos de US$ 0,134 por imagem de saída de 1K/2K e US$ 0,24 por imagem de saída de 4K. Os exemplos de batch/flex reduzem esses valores de saída para US$ 0,067 e US$ 0,12, respectivamente.
Para o Gemini 2.5 Flash Image, o Google AI lista a entrada paga padrão em US$ 0,30 por 1M de tokens de texto/imagem e a saída em US$ 0,039 por imagem. A nota de rodapé diz que a saída de imagem é precificada em US$ 30 por 1M de tokens, com imagens de saída 1024x1024 consumindo 1290 tokens. A mesma página lista batch e flex para saída em US$ 0,0195 por imagem e prioridade em US$ 0,0702 por imagem.
No preço do Google Cloud Vertex AI, os preços de imagem Gemini podem aparecer com nomes de modelo e contexto de rota diferentes. Por exemplo, a página do Vertex lista a saída de imagem do Gemini 3 Pro Image em US$ 120 por 1M de tokens e inclui uma nota de rodapé mapeando 1120 tokens para US$ 0,134 para 1K/2K e 2000 tokens para US$ 0,24 para 4K. Ela também lista exemplos de saída do Gemini 3.1 Flash Image por resolução. Se sua equipe usa Vertex AI em vez da API Gemini, não assuma o mesmo comportamento de rota, nome de modelo ou nível da página da API Gemini.
Preços do Imagen: por imagem, mas atenção à descontinuação e ao tipo de recurso
O Imagen parece mais simples porque o Google lista preços diretos por imagem. Na página de preços da Gemini API consultada para este artigo, o Imagen 4 Fast custa US$ 0,02 por imagem, o Imagen 4 Standard custa US$ 0,04 por imagem e o Imagen 4 Ultra custa US$ 0,06 por imagem. A página de preços do Vertex AI também lista o Imagen 4 Fast a US$ 0,02, o Imagen 4 a US$ 0,04 e o Imagen 4 Ultra a US$ 0,06 por imagem gerada.
A ressalva é a atualização. A página de preços da Gemini API do Google inclui um aviso de que os modelos Imagen 4 imagen-4.0-generate-001, imagen-4.0-ultra-generate-001 e imagen-4.0-fast-generate-001 estão descontinuados e programados para encerrar em 17 de agosto de 2026, com orientação de migração para o Gemini 2.5 Flash Image. Esse aviso é um problema operacional muito maior do que uma diferença de um centavo no preço.
O tipo de recurso também importa. O Vertex AI lista preços separados do Imagen para upscaling, legendagem visual, perguntas e respostas visuais, recontextualização de produto e prova virtual. Um preço “por imagem” para geração de texto para imagem não é automaticamente o mesmo preço de uma edição, de uma etapa de upscaling ou de um fluxo de trabalho de imagem de produto.
Flatkey Catalog Snapshot Para Modelos de Imagem
A página pública de preços da Flatkey foi verificada em 17 de junho de 2026, Asia/Shanghai. A página de preços renderizada no servidor informou 638 modelos de IA e a versão de preços 5a90f2b86c08bd983a9a2e6d66c255f4eaef9c4bc934386d2b6ae84ef0ff1f1f. A mesma página expôs famílias de endpoints incluindo gemini, image-generation, openai e openai-response. Isso importa porque a precificação da API de geração de imagens por IA por meio de um gateway precisa corresponder tanto à linha do modelo quanto ao tipo de endpoint.
| Linha da Flatkey Verificada | Tipos de Endpoint | Campos de Preço Vistos | Status no Snapshot | Ação Antes da Produção |
|---|---|---|---|---|
gpt-image-2 |
openai |
model_ratio: 3.325, completion_ratio: 6, image_ratio: 1.6 |
unknown_failure |
Confirme se a linha selecionada oferece suporte ao formato de solicitação de imagem pretendido antes de qualquer lançamento. |
openai/gpt-image-2 |
openai |
quota_type: 1, model_price: 0.063 |
unknown_failure |
Não copie este número sem confirmar a unidade atual do painel e o comportamento da rota. |
gemini-2.5-flash-image |
gemini, openai |
model_ratio: 0.15, completion_ratio: 100 |
available |
Execute um pequeno teste de rota e confirme se o app deve chamar o endpoint no estilo Gemini ou no estilo OpenAI. |
gemini-3-pro-image-preview |
gemini, openai |
model_ratio: 1, completion_ratio: 60 |
available |
Confirme o nome de preview/stable e os limites de taxa antes de criar uma rota de longa duração. |
imagen-4.0-fast-generate-001, imagen-4.0-generate-001, imagen-4.0-ultra-generate-001 |
image-generation, gemini, openai |
model_ratio: 37.5, completion_ratio: 1 |
unknown_failure |
Trate isso apenas como presença de catálogo datada; também considere o aviso de descontinuação do Imagen 4 da Google em 17 de agosto de 2026. |
Esta evidência da Flatkey não significa que cada linha de imagem esteja pronta para produção hoje. Significa que o catálogo atual pode ser usado como ponto de partida para comparação de provedores, seleção de rota, revisão de cotas e registro de logs. A porta de entrada real para produção é uma verificação atual do painel somada a um pequeno teste de smoke.
Uma Fórmula de Normalização para o Planejamento de Custos de Imagens
Use esta fórmula normalizada antes de escolher um provedor ou rota:
Custo estimado do fluxo de trabalho de imagem =
custo do texto do prompt
+ custo da imagem de entrada ou da edição
+ custo da saída de imagem gerada
+ custo parcial da imagem ou da prévia
+ custo de retentativa e falha
+ custo unitário específico do gateway ou da rota
Para o GPT Image, o custo da saída de imagem gerada é determinado pelos tokens de saída de imagem. Para o Gemini Image, os números publicados equivalentes a imagem são derivados dos preços por token e das contagens de tokens esperadas. Para o Imagen, o custo da imagem gerada geralmente aparece como um preço por imagem, mas edições e recursos de imagem relacionados podem ter preços separados. O Flatkey então adiciona a camada operacional: linha exata, suporte ao endpoint, grupo, tipo de quota, status da rota e registro real de uso.
Lista de verificação de compras para APIs de geração de imagens
Uma equipe que compara preços de API de geração de imagens por IA deve coletar estes campos antes de aprovar um modelo para produção:
| Campo | Por que Finanças se importa | Por que Engenharia se importa |
|---|---|---|
| ID exato do modelo | Evita orçar com base no SKU errado. | Evita chamadas para aliases, prévias ou linhas descontinuadas. |
| Caminho do endpoint | Confirma qual livro-razão de uso será cobrado. | Confirma o corpo da requisição, o comportamento do SDK e o formato da resposta. |
| Resolução e qualidade da saída | Separa o gasto de prévia do gasto da renderização final. | Controla a latência, a UX, a pressão de retry e o armazenamento. |
| Tratamento de imagem de entrada | Edições e imagens de referência podem adicionar custo. | Máscaras, referências e uploads de imagens mudam a estrutura da requisição. |
| Status de descontinuação ou prévia | Uma rota barata pode se tornar um custo de migração. | Rotas de prévia e descontinuadas precisam de alternativas. |
| Logs de uso do Flatkey | Mostra o custo real após retries e falhas. | Mostra a linha do modelo, o status da rota, a taxa de erro e o sinal de rollback. |
Modelo: Compare Um Prompt Entre Rotas
Use um prompt controlado e uma configuração de saída ao comparar rotas. Altere apenas uma variável de cada vez.
Execução do benchmark
- Categoria do prompt: conceito de produto, asset de marketing, mockup de UI ou edição
- Destino da saída: rascunho, pré-visualização ou final
- Tamanho: fixo entre provedores, quando possível
- Qualidade/camada: fixa ou documentada como específica do provedor
- Imagens de entrada: nenhuma, uma referência ou edição com máscara
- Rota A: linha de base direta do provedor
- Rota B: linha e endpoint selecionados pela Flatkey
- Log: status, latência, tentativas, saída aceita, unidade de uso, custo final
Isso fornece uma comparação real de preços de API de geração de imagens com IA em vez de uma planilha que ignora imagens rejeitadas, bloqueios de moderação, tentativas e diferenças de roteamento.
Quando a Flatkey Ajuda com Preços de Imagens
A Flatkey é útil quando a geração de imagens faz parte de um fluxo de trabalho multimodal maior. Um aplicativo de produção pode usar um modelo para reescrita de prompts, GPT Image ou Gemini Image para geração, uma linha do Imagen para uma rota criativa específica e um modelo com capacidade de visão para revisão. O valor da Flatkey é a camada compartilhada de acesso à API: uma chave, visibilidade por linha de modelo, opções de endpoint, logs de uso, cotas e uma superfície de preços única.
Isso não elimina a devida diligência no nível do provedor. Apenas torna as verificações mais fáceis de repetir. Para preços da API de geração de imagens por IA, o fluxo de trabalho mais seguro da Flatkey é:
- Abra preços da Flatkey e procure a linha exata do modelo.
- Confirme a família do provedor, os tipos de endpoint, o grupo, o tipo de cota e o rótulo de preço atual.
- Compare com a documentação oficial de preços da OpenAI ou do Google para o mesmo modelo e rota.
- Execute um teste rápido de baixo risco pelo endpoint confirmado.
- Revise os logs da Flatkey para linha de modelo, status, unidade de uso e custo.
- Defina limites de cota antes de expor o recurso aos usuários em produção.
- Documente rotas de fallback para modelos de pré-visualização ou modelos descontinuados.
Guias de Preços Relacionados
Se você estiver construindo um modelo de custos mais amplo, combine esta página com Preços da API de Imagem da OpenAI, Comparação de Preços de Modelos de IA e GPT Image 2 API via Flatkey. Esses artigos abordam verificações específicas de fornecedores e padrões mais amplos de precificação de modelos; este guia foca nas unidades de precificação de imagens entre provedores.
Perguntas frequentes
Qual é a melhor forma de comparar preços de API de geração de imagens por IA?
Compare unidades normalizadas, não apenas os preços de destaque. Registre o custo do texto do prompt, o custo da imagem de entrada, o custo da saída gerada, a resolução, a qualidade, o comportamento de retry e a rota exata da Flatkey ou do provedor usada.
O GPT Image é precificado por imagem?
As orientações atuais do GPT Image 2 da OpenAI usam estimativas de tokens de saída com base em qualidade e tamanho, além de tokens de entrada de texto e imagem. O guia fornece exemplos de calculadora por imagem, mas o modelo de custo é orientado por tokens.
O Gemini Image é precificado por imagem?
O Google lista preços por token e saídas equivalentes a imagens. O Gemini 3 Pro Image usa preços de token de saída de imagem com exemplos como US$ 0,134 para saídas padrão de 1K/2K, enquanto o Gemini 2.5 Flash Image lista exemplos de saída como US$ 0,039 por imagem de 1024x1024.
O Imagen é precificado por imagem?
As páginas de preços da API Gemini e do Vertex AI do Google listam a geração do Imagen 4 como preços diretos por imagem, como US$ 0,02 para Fast, US$ 0,04 para Standard e US$ 0,06 para Ultra. Verifique o tipo de recurso e o status de descontinuação antes de confiar no Imagen 4 para novos trabalhos em produção.
Como devo verificar os preços da API de geração de imagens por IA na Flatkey?
Procure a linha exata do modelo em preços da Flatkey, confirme o tipo de endpoint, o grupo, o tipo de quota, o status de disponibilidade e o rótulo de preço atual; depois execute um pequeno teste smoke e compare o log de uso com sua estimativa.
Recomendação final: trate o preço da API de geração de imagens por IA como um custo de fluxo de trabalho, não como o preço de um único modelo. Comece com as unidades oficiais do provedor, normalize as configurações da solicitação e, em seguida, use a Flatkey para verificar a linha do modelo, o endpoint, os logs de uso e os controles de quota. Ver preços antes de levar o tráfego de imagens para produção.



