Model and Modality Playbooks22 de setembro de 2026Flatkey

DeepSeek V4 vs GPT-5: A Opção Frontier Mais Barata?

Compare os preços do DeepSeek V4 vs GPT-5, custos de cache, contexto e verificações de roteamento antes de escolher a rota de API mais barata.

DeepSeek V4 vs GPT-5: A Opção Frontier Mais Barata?

DeepSeek V4 vs GPT-5: A Opção Frontier Mais Barata?

DeepSeek V4 vs GPT-5: A Opção Frontier Mais Barata? é a pergunta errada se você comparar apenas o preço por token de um único destaque. É a pergunta certa se você comparar uma carga de trabalho real: entrada não armazenada em cache, entrada em cache, comprimento de saída, tentativas, suporte a recursos e a rota que você pode verificar em produção.

A resposta curta: as rotas atuais da API do DeepSeek V4 geralmente são mais baratas do que o GPT-5 nas tarifas públicas por token, especialmente quando você pode usar deepseek-flash ou executar durante a janela fora de pico do DeepSeek. Mas "opção frontier mais barata" não deve significar "sempre escolher DeepSeek". O GPT-5 ainda entra na comparação quando você precisa de ferramentas específicas da OpenAI, entrada de imagem pela rota GPT, comportamento da Responses API ou um baseline de avaliação conhecido do GPT. Trate DeepSeek V4 vs GPT-5 como uma decisão de roteamento, não de marca.

Até esta verificação da fonte em 22 de setembro de 2026, a documentação da API do DeepSeek lista deepseek-flash como DeepSeek-V4.1-Flash e deepseek-v4-pro como DeepSeek-V4-Pro-0813. A página oficial do GPT-5 da OpenAI lista gpt-5 a US$ 1,25 por 1M tokens de entrada, US$ 0,125 por 1M tokens de entrada em cache e US$ 10 por 1M tokens de saída. Isso torna real a diferença de preço publicada, mas a resposta segura para produção ainda é normalizar pela saída aceita.

Resposta Rápida: DeepSeek V4 vs GPT-5

Se sua carga de trabalho é geração de texto sensível a custo, assistência de codificação, revisão de contexto longo ou roteamento de agentes, comece testando o DeepSeek V4.1 Flash contra o GPT-5. Se a rota passar nos seus testes rápidos de recursos e no limite de saída aceita, é provável que seja o padrão de menor custo. Se a carga de trabalho depender do comportamento de ferramentas específicas do GPT, de baselines de modelo da OpenAI ou de um caminho direto de suporte da OpenAI, mantenha o GPT-5 no conjunto de candidatos.

Ponto de decisãoRota DeepSeek V4Rota GPT-5
Menor custo publicado por tokenGeralmente deepseek-flash, especialmente fora de picoNão é o mais barato por preço de token
Candidato DeepSeek de maior qualidadedeepseek-v4-proCompare com gpt-5 ou uma rota GPT mais nova, se seu benchmark permitir
Margem de contexto e saídaOs documentos do DeepSeek listam 1M de contexto e 384K de saída máxima para os modelos atuais da API do DeepSeekOs documentos da OpenAI listam uma janela de contexto de 400K, 272K de entrada máxima e 128K de saída máxima para o GPT-5
Comparação de entrada em cacheAs taxas de cache-hit do DeepSeek são muito baixas na tabela oficial de preçosA entrada em cache do GPT-5 custa US$ 0,125 por 1M tokens
Verificações de recursosJSON, chamadas de ferramentas, Responses API, API da Anthropic, modo de pensamento e suporte de visão específico do modeloChat Completions, Responses, streaming, saídas estruturadas, chamada de função, cache de prompt, entrada de imagem e ferramentas suportadas do Responses
Melhor primeira ação do FlatkeyVerifique deepseek-flash e deepseek-v4-pro no diretório de modelos e em /v1/modelsVerifique a disponibilidade de gpt-5 e a linha exata do modelo GPT que você pretende chamar

A conclusão prática: DeepSeek V4 vs GPT-5 só vira uma vitória de custo para o DeepSeek depois que seu parser, chamadas de ferramentas, meta de latência e política de fallback ainda passam.

Snapshot Atual de Preços Oficiais

Os preços da DeepSeek são por 1M de tokens e são divididos por cache hit, cache miss, saída e janelas de pico/fora de pico. A OpenAI precifica os tokens de texto do GPT-5 com linhas de input, input em cache e output.

Rota do modeloCache hit de inputCache miss de input / inputOutputNotas
deepseek-flash fora de pico$0.003$0.15$0.60DeepSeek-V4.1-Flash
deepseek-flash pico$0.006$0.30$1.20DeepSeek-V4.1-Flash
deepseek-v4-pro fora de pico$0.022$0.66$1.98DeepSeek-V4-Pro-0813
deepseek-v4-pro pico$0.044$1.32$3.96O input não em cache no pico pode ficar ligeiramente acima do input do GPT-5
gpt-5 padrão$0.125 input em cache$1.25 input$10.00Preços padrão de tokens da OpenAI GPT-5

Essa tabela responde à pergunta restrita sobre taxa por token. O DeepSeek Flash é mais barato que o GPT-5 em todas as linhas de taxa por token listadas. O DeepSeek V4 Pro é mais barato que o GPT-5 em input em cache e output, e mais barato em input não em cache fora de pico, mas sua linha de input não em cache no pico é ligeiramente mais alta do que o input do GPT-5. Então a resposta correta para DeepSeek V4 vs GPT-5 não é "o DeepSeek sempre vence". É "o DeepSeek normalmente vence na comparação de taxa por token, mas verifique a combinação exata".

A fórmula de custo que realmente importa

Use o custo por output aceito, não o preço bruto por token:

accepted_output_cost =
  (
    uncached_input_tokens * input_price
    + cached_input_tokens * cached_input_price
    + output_tokens * output_price
    + retry_tokens
    + fallback_tokens
  )
  / accepted_outputs

Por exemplo, uma solicitação com 100K tokens de input não em cache e 20K tokens de output custa cerca de:

RotaJanela de preçoCusto aproximado da solicitação antes de retries
deepseek-flashfora de pico$0.027
deepseek-flashpico$0.054
deepseek-v4-profora de pico$0.1056
deepseek-v4-propico$0.2112
gpt-5padrão$0.325

A mesma conta fica mais favorável ao DeepSeek quando o input com cache hit domina. Ela fica menos favorável se sua rota DeepSeek precisar de mais retries, produzir mais JSON rejeitado ou fazer fallback para outro modelo com mais frequência.

É por isso que a decisão DeepSeek V4 vs GPT-5 deve ser registrada por workload. Uma resposta barata que seu app rejeita não é barata.

Por que pico e fora de pico mudam a resposta

A página de preços da DeepSeek diz que as tarifas fora de pico são metade das tarifas de pico. Ela define as horas de pico como 01:00-04:00 e 06:00-10:00 UTC, de segunda a sexta-feira, excluindo feriados públicos chineses. Todas as outras horas são fora de pico, incluindo fins de semana e feriados públicos chineses.

Se seu tráfego for agendável em lote, enfileirado ou agentic em vez de bloquear o usuário, o agendamento fora de pico pode mudar materialmente o resultado de DeepSeek V4 vs GPT-5. Para tráfego interativo, assuma que algumas solicitações cairão em janelas de pico e faça o orçamento com base na linha mais alta.

Use esta regra:

Tipo de carga de trabalhoPremissa de preços mais segura
Chat em tempo real, assistente de codificação, agente voltado ao usuárioOrce o DeepSeek ao preço de pico, a menos que os dados de tráfego provem o contrário
Resumo em lote, avaliações noturnas, jobs de enriquecimentoConsidere o agendamento fora do pico e, depois, verifique os logs reais de uso
Fluxos de trabalho de agentes mistosSepare as rotas de primeiro plano e de segundo plano
Orçamento corporativoRegistre no scorecard do modelo as linhas de pico e fora do pico

Encaixe de Funcionalidades Antes do Encaixe de Preço

Uma tabela de preços não pode dizer se a rota de um modelo se encaixa no seu produto. Antes de mover tráfego de produção, teste os recursos que seu aplicativo realmente usa.

FuncionalidadeVerificação da rota DeepSeek V4Verificação da rota GPT-5
Chat completionsPrompts curtos sem streaming e com streamingPrompts curtos sem streaming e com streaming
Responses APIConfirme os parâmetros suportados e os campos ignoradosConfirme o comportamento de Responses e as saídas das ferramentas
JSON / saída estruturadaValide contra seu schema e o caminho de correçãoValide contra seu schema e o caminho de correção
Chamadas de ferramentasAnalise os argumentos da chamada de ferramenta e as tentativas de повторAnalise os argumentos da chamada de ferramenta e as tentativas de retry
Contexto longoTeste entradas longas reais, não enchimento sintético de tokensTeste entradas longas reais, não enchimento sintético de tokens
VisãoOs docs da DeepSeek listam visão para Flash e não para ProOs docs da OpenAI listam entrada de imagem para GPT-5
Leitura de usoConfirme modelo, contagem de tokens, custo, status e latênciaConfirme modelo, contagem de tokens, custo, status e latência

Não assuma que compatível com OpenAI significa comportamento idêntico. Isso quer dizer que a superfície de integração pode ser semelhante o suficiente para testar rapidamente. A decisão DeepSeek V4 vs GPT-5 ainda precisa passar pelo seu parser, pela sua camada de ferramentas e pela sua barra de aceitação do usuário.

Provedor Direto Ou Roteador Flatkey?

Você pode comparar o DeepSeek V4 e o GPT-5 diretamente com chaves do provedor. Você também pode rotear ambos pelo Flatkey quando quiser um único cliente compatível com OpenAI, um único saldo, um único catálogo de modelos e um único caminho de revisão de uso.

O quickstart do Flatkey mostra o SDK da OpenAI apontando para:

https://router.flatkey.ai/v1

A vantagem operacional não é que um roteador torne magicamente todos os modelos equivalentes. A vantagem é que você pode manter o cliente estável enquanto altera o ID do modelo e, então, revisar o uso de tokens e o custo em um só lugar.

Use este registro de rota antes de testar:

route_test:
  question: "DeepSeek V4 vs GPT-5"
  base_url: "https://router.flatkey.ai/v1"
  candidates:
    - deepseek-flash
    - deepseek-v4-pro
    - gpt-5
  required_checks:
    - account_accessible_model_ids
    - pricing_units
    - feature_smoke_tests
    - usage_log_readback
    - accepted_output_cost
    - fallback_policy
  launch_rule: "Promova somente se o custo da saída aceita e a qualidade forem aprovados"

Para detalhes de configuração, use o guia de acesso à API da DeepSeek e o início rápido da API da Flatkey. Se você estiver substituindo strings antigas de modelos DeepSeek, use a lista de verificação de migração para o DeepSeek V4 antes de alterar a configuração de produção.

Um scorecard prático

Use este scorecard em vez de uma conclusão de uma linha do tipo "modelo mais barato".

CriterionWeightHow to score it
Custo do output aceito30%Custo após retries, outputs rejeitados e fallback
Compatibilidade de recursos20%Streaming, ferramentas, JSON, entrada de imagem, contexto longo, Responses API
Latência e concorrência15%p50, p90, taxa de timeout, limites do provedor
Qualidade na sua tarefa20%Taxa de aprovação em evals, revisão humana, taxa de bugs, aceitação do cliente
Controle operacional10%Logs de uso, rollback, allowlists, revisão de faturamento
Requisito de fornecedor ou conformidade5%Contrato, controles de dados, requisito de provedor direto

Normalmente, a DeepSeek deve vencer na primeira linha. O GPT-5 pode vencer ou continuar necessário nas linhas de recurso, baseline ou controle de fornecedor. A Flatkey ajuda quando o seu problema real é alternar rotas sem reescrever a aplicação toda vez que um modelo muda.

Quando o DeepSeek V4 É O Melhor Padrão

Escolha o DeepSeek V4 primeiro quando:

  • Você é sensível a preço e consegue avaliar rapidamente a qualidade do output aceito.
  • Sua carga de trabalho é focada em texto, código ou contexto longo.
  • Sua aplicação pode encaminhar o trabalho em lote para janelas fora de pico.
  • Você consegue tolerar testar o comportamento dos recursos antes do lançamento.
  • Você quer um candidato de baixo custo ao lado das rotas Qwen, Gemini, Claude e GPT.

É aqui que DeepSeek V4 vs GPT-5 se torna uma resposta forte para SEO e uma resposta prática de produto: a DeepSeek é a rota a testar primeiro quando a pressão por custo é real.

Quando o GPT-5 Ainda Deve Entrar no Teste

Mantenha o GPT-5 na comparação quando:

  • Seu baseline de eval existente foi construído com GPT-5.
  • Você depende de ferramentas específicas da OpenAI na Responses API ou do comportamento de entrada de imagem.
  • Você precisa de suporte direto da OpenAI, procurement ou alinhamento de documentação.
  • Seu produto já expõe uma rota GPT para clientes.
  • Um modelo mais novo da OpenAI é o verdadeiro alvo, mas o GPT-5 continua sendo o ponto de comparação legado.

Uma ressalva importante: a documentação atual do GPT-5 da OpenAI descreve o GPT-5 como seu modelo anterior para tarefas de codificação, raciocínio e agentic e recomenda o GPT-6 Astra como o modelo mais recente. Se o seu comprador está pedindo a rota frontier mais nova da OpenAI em vez do GPT-5 especificamente, não finja silenciosamente que o GPT-5 é a opção mais recente da OpenAI. Mantenha a correspondência com o título do artigo, mas atualize a conversa com o comprador.

Recomendação Final

Para a maioria dos fluxos de trabalho de API sensíveis a custo, DeepSeek V4 vs GPT-5 começa com uma vitória da DeepSeek nos preços de token publicados. Use deepseek-flash como o primeiro teste de baixo custo, adicione deepseek-v4-pro quando precisar de uma opção DeepSeek mais robusta e mantenha gpt-5 como o baseline GPT quando o comportamento específico da OpenAI for importante.

Então faça a decisão final com base nos logs:

  1. Verifique os IDs dos modelos nos documentos do provedor ou no diretório de modelos da Flatkey.
  2. Execute o mesmo conjunto de prompts no DeepSeek e no GPT-5.
  3. Meça o custo do output aceito, não o custo bruto de tokens.
  4. Verifique nos logs de uso o modelo, as contagens de tokens, o custo, o status e a latência.
  5. Promova a rota mais barata apenas se a qualidade, o comportamento do parser e o risco de fallback passarem.

O papel da Flatkey é tornar esse teste reversível: uma base URL compatível com OpenAI, uma chave, um catálogo de modelos e um único lugar para revisar o uso. Essa é a maneira mais segura de responder DeepSeek V4 vs GPT-5: The Cheapest Frontier Option? sem transformar um artigo de preços em uma alegação de benchmark sem suporte.

Perguntas Frequentes

O DeepSeek V4 é mais barato que o GPT-5?

Nas tarifas de tokens publicadas atualmente, o DeepSeek Flash é mais barato que o GPT-5 nas linhas de tokens listadas, e o DeepSeek V4 Pro é mais barato no output e no input em cache. O input sem cache de pico do DeepSeek V4 Pro é ligeiramente mais alto que o input do GPT-5, então a resposta exata depende da sua combinação de input, cache, output e pico/fora de pico.

O DeepSeek V4 Pro é o mesmo que o DeepSeek V4.1 Flash?

Não. A tabela de preços atual do DeepSeek lista deepseek-flash como DeepSeek-V4.1-Flash e deepseek-v4-pro como DeepSeek-V4-Pro-0813. Trate-os como rotas de modelos separadas, com preços e verificações de recursos separados.

Devo substituir o GPT-5 pelo DeepSeek V4?

Substitua apenas após um teste de carga de trabalho. O DeepSeek pode ser a rota mais barata, mas você ainda precisa verificar a aceitação do output, as chamadas de ferramenta, o comportamento do JSON, a latência, os logs de uso e o rollback.

Posso comparar ambos por meio de um único cliente compatível com OpenAI?

Sim. Com a Flatkey, aponte o SDK da OpenAI para https://router.flatkey.ai/v1, use uma chave de API da Flatkey e altere o parâmetro model para a rota candidata que você está testando. Verifique os IDs de modelo disponíveis antes do lançamento.

Quais páginas internas da Flatkey devo ler em seguida?

Comece com Acesso à API do DeepSeek, Migração do DeepSeek V4, DeepSeek V4 Pro vs Flash, Roteamento Claude vs GPT API e o guia do catálogo de modelos de IA.