Model and Modality Playbooks2026年9月22日Flatkey

DeepSeek V4 vs GPT-5:最便宜的前沿选择?

在选择最便宜的 API 模型路线之前,先比较 DeepSeek V4 和 GPT-5 的定价、缓存成本、上下文和路由检查。

DeepSeek V4 vs GPT-5:最便宜的前沿选择?

DeepSeek V4 vs GPT-5:最便宜的前沿选择?

DeepSeek V4 vs GPT-5:最便宜的前沿选择? 如果你只比较一个标题级别的 token 价格,那么这个问题就是错的。若你比较的是一个真实工作负载:未缓存输入、缓存输入、输出长度、重试、功能支持,以及你能在生产环境中验证的路由,这才是正确的问题。

简短答案:DeepSeek 当前的 V4 API 路由通常比 GPT-5 的公开 token 费率更便宜,尤其是当你可以使用 deepseek-flash 或者在 DeepSeek 的低峰时段运行时。但“最便宜的前沿选择”并不意味着“总是选 DeepSeek”。当你需要 OpenAI 特定工具、通过 GPT 路由进行图像输入、Responses API 行为,或者一个已知的 GPT 评测基线时,GPT-5 仍然应该纳入比较。把 DeepSeek V4 vs GPT-5 看作路由决策,而不是品牌决策。

截至 2026 年 9 月 22 日的这次来源检查,DeepSeek 的 API 文档将 deepseek-flash 列为 DeepSeek-V4.1-Flash,将 deepseek-v4-pro 列为 DeepSeek-V4-Pro-0813。OpenAI 官方 GPT-5 页面将 gpt-5 的价格列为每 1M 输入 tokens 1.25 美元、每 1M 缓存输入 tokens 0.125 美元,以及每 1M 输出 tokens 10 美元。这使得公开价格差距真实存在,但安全的生产环境答案仍然是按可接受输出进行归一化。

快速答案:DeepSeek V4 vs GPT-5

如果你的工作负载是对成本敏感的文本生成、编码辅助、长上下文审阅或 agent 路由,请先测试 DeepSeek V4.1 Flash 对比 GPT-5。若该路由通过你的功能冒烟测试和可接受输出阈值,它很可能是更低成本的默认选择。若工作负载依赖 GPT 特定的工具行为、OpenAI 模型基线或直接的 OpenAI 支持路径,请把 GPT-5 保留在候选集里。

决策点DeepSeek V4 路由GPT-5 路由
公开的最低 token 成本通常是 deepseek-flash,尤其在低峰时段按 token 价格看不是最便宜的
更高质量的 DeepSeek 候选deepseek-v4-pro如果你的基准允许,可对比 gpt-5 或更新的 GPT 路由
上下文与输出余量DeepSeek 文档列出当前 DeepSeek API 模型支持 1M 上下文和 384K 最大输出OpenAI 文档列出 GPT-5 的 400K 上下文窗口、272K 最大输入和 128K 最大输出
缓存输入对比DeepSeek 的缓存命中率在官方定价表中非常低GPT-5 缓存输入为每 1M tokens 0.125 美元
功能检查JSON、工具调用、Responses API、Anthropic API、thinking 模式,以及模型特定的视觉支持Chat Completions、Responses、流式传输、结构化输出、函数调用、提示缓存、图像输入,以及受支持的 Responses 工具
最佳的首个 Flatkey 操作在模型目录和 /v1/models 中验证 deepseek-flashdeepseek-v4-pro验证 gpt-5 的可用性,以及你打算调用的准确 GPT 模型行

实际结论:只有在你的解析器、工具调用、延迟目标和回退策略仍然通过时,DeepSeek V4 vs GPT-5 才会对 DeepSeek 形成成本优势。

当前官方定价快照

DeepSeek 的价格按每 100 万 token 计费,并按缓存命中、缓存未命中、输出,以及峰时/非峰时窗口拆分。OpenAI 对 GPT-5 文本 token 按输入、缓存输入和输出三行计费。

模型路径输入缓存命中输入缓存未命中 / 输入输出备注
deepseek-flash 非峰时$0.003$0.15$0.60DeepSeek-V4.1-Flash
deepseek-flash 峰时$0.006$0.30$1.20DeepSeek-V4.1-Flash
deepseek-v4-pro 非峰时$0.022$0.66$1.98DeepSeek-V4-Pro-0813
deepseek-v4-pro 峰时$0.044$1.32$3.96峰时未缓存输入可能会略高于 GPT-5 输入
gpt-5 标准$0.125 缓存输入$1.25 输入$10.00OpenAI GPT-5 标准 token 定价

这张表回答了狭义的 token 费率问题。DeepSeek Flash 在所列全部 token 费率行上都比 GPT-5 更便宜。DeepSeek V4 Pro 在缓存输入和输出上比 GPT-5 更便宜,在非峰时未缓存输入上也更便宜,但其峰时未缓存输入这一行略高于 GPT-5 输入。因此,准确的 DeepSeek V4 vs GPT-5 答案不是“DeepSeek 总是更优”。而是“DeepSeek 通常在 token 费率比较中更占优,但要看具体构成。”

真正重要的成本公式

使用“已接受输出成本”,而不是原始 token 价格:

accepted_output_cost =
  (
    uncached_input_tokens * input_price
    + cached_input_tokens * cached_input_price
    + output_tokens * output_price
    + retry_tokens
    + fallback_tokens
  )
  / accepted_outputs

例如,一个包含 100K 未缓存输入 token 和 20K 输出 token 的请求,大约需要:

路径价格窗口重试前的请求近似成本
deepseek-flash非峰时$0.027
deepseek-flash峰时$0.054
deepseek-v4-pro非峰时$0.1056
deepseek-v4-pro峰时$0.2112
gpt-5标准$0.325

当缓存命中输入占主导时,同样的计算会更有利于 DeepSeek。如果你的 DeepSeek 路径需要更多重试、产生更多被拒绝的 JSON,或者更频繁地回退到另一个模型,那么结果就会不那么有利。

这就是为什么 DeepSeek V4 vs GPT-5 的决策应该按工作负载分别记录。一个被你的应用拒绝的低价答案,并不便宜。

为什么峰时和非峰时会改变答案

DeepSeek 的定价页面说明,非峰时费率是峰时费率的一半。它将峰时定义为 UTC 时间周一至周五 01:00-04:00 和 06:00-10:00,且排除中国公共假期。其他所有时段都属于非峰时,包括周末和中国公共假期。

如果你的流量可以批处理、排队,或更偏向 agentic 而不是阻塞用户,那么非峰时调度会显著改变 DeepSeek V4 vs GPT-5 的结果。对于交互式流量,应假设部分请求会落在峰时窗口内,并按更高的费率行来预算。

使用这条规则:

工作负载类型更稳妥的定价假设
实时聊天、编码助手、面向用户的代理除非你的流量数据证明并非如此,否则按峰时费率为 DeepSeek 预留预算
批量摘要、夜间评测、丰富化任务考虑安排在低峰时段,然后核实实际使用日志
混合代理工作流将前台和后台路由分开
企业预算编制在模型评分卡中同时记录峰时和低峰两行数据

先看功能匹配,再看价格匹配

价格表无法告诉你某条模型路由是否适合你的产品。在将生产流量迁移之前,先测试你的应用实际使用的功能。

功能DeepSeek V4 路由检查GPT-5 路由检查
聊天补全短的非流式和流式提示词短的非流式和流式提示词
Responses API确认支持的参数和被忽略的字段确认 Responses 行为和工具输出
JSON / 结构化输出针对你的 schema 和修复路径进行验证针对你的 schema 和修复路径进行验证
工具调用解析工具调用参数和重试解析工具调用参数和重试
长上下文测试真实的长输入,而不是合成的 token 填充测试真实的长输入,而不是合成的 token 填充
视觉DeepSeek 文档将视觉能力列在 Flash 中,而非 ProOpenAI 文档将图像输入列为 GPT-5 的能力
使用回读确认模型、token 数量、成本、状态和延迟确认模型、token 数量、成本、状态和延迟

不要假设 OpenAI 兼容就意味着行为完全相同。它只意味着集成表面可能足够相似,便于快速测试。DeepSeek V4 vs GPT-5 的决策仍然必须经受你的解析器、你的工具层以及你的用户验收标准的检验。

直接用提供方还是用 Flatkey 路由器?

你可以使用提供方密钥直接比较 DeepSeek V4 和 GPT-5。你也可以在希望获得一个 OpenAI 兼容客户端、一个余额、一个模型目录以及一个统一的使用审查路径时,通过 Flatkey 路由两者。

Flatkey 的快速入门展示了将 OpenAI SDK 指向:

https://router.flatkey.ai/v1

这种运营优势并不是路由器神奇地让所有模型都变得相同。它的优势在于,你可以在保持客户端稳定的同时更换模型 ID,然后在一个地方查看 token 使用量和成本。

测试前请使用这条路由记录:

route_test:
  question: "DeepSeek V4 vs GPT-5"
  base_url: "https://router.flatkey.ai/v1"
  candidates:
    - deepseek-flash
    - deepseek-v4-pro
    - gpt-5
  required_checks:
    - account_accessible_model_ids
    - pricing_units
    - feature_smoke_tests
    - usage_log_readback
    - accepted_output_cost
    - fallback_policy
  launch_rule: "仅当接受输出成本和质量都通过时才上线"

有关设置详情,请使用 DeepSeek API access guideFlatkey API quickstart。如果您要替换旧的 DeepSeek 模型字符串,请在更改生产配置之前使用 DeepSeek V4 migration checklist

实用评分卡

请使用这张评分卡,而不是一句话的“最便宜模型”结论。

标准权重评分方式
接受输出成本30%重试、被拒绝的输出和回退后的成本
功能兼容性20%流式传输、工具、JSON、图像输入、长上下文、Responses API
延迟和并发15%p50、p90、超时率、提供商限制
您的任务上的质量20%评测通过率、人工审核、缺陷率、客户接受度
运营控制10%使用日志、回滚、允许列表、计费审查
供应商或合规要求5%合同、数据控制、直接供应商要求

DeepSeek 通常应该在第一项上胜出。GPT-5 可能会在功能、基线或供应商控制项上胜出,或者仍然是必要选项。当您的真实问题是无需每次模型变更都重写应用程序即可切换路由时,Flatkey 会很有帮助。

何时 DeepSeek V4 是更好的默认选择

以下情况优先选择 DeepSeek V4:

  • 您对价格敏感,并且可以快速评估接受输出质量。
  • 您的工作负载以文本、代码或长上下文为主。
  • 您的应用可以将批处理工作路由到低峰时段。
  • 您可以接受在上线前测试功能表现。
  • 您想要在 Qwen、Gemini、Claude 和 GPT 路由之外再增加一个低成本候选项。

这就是 DeepSeek V4 vs GPT-5 既能成为很强的 SEO 答案,也能成为实用产品答案的地方:当成本压力真实存在时,DeepSeek 是应该首先测试的路由。

何时 GPT-5 仍然值得纳入测试

以下情况请将 GPT-5 保留在对比中:

  • 您现有的评测基线是基于 GPT-5 构建的。
  • 您依赖 OpenAI 特定的 Responses API 工具或图像输入行为。
  • 您需要直接的 OpenAI 支持、采购或文档对齐。
  • 您的产品已经向客户提供了 GPT 路由。
  • 更高版本的 OpenAI 模型才是真正目标,但 GPT-5 仍是遗留对比点。

一个重要的注意事项:OpenAI 当前的 GPT-5 文档将 GPT-5 描述为其用于编码、推理和 agentic 任务的上一代模型,并建议使用 GPT-6 Astra 作为最新模型。如果您的买家是在询问最新的 OpenAI 前沿路由,而不是专指 GPT-5,那么不要默默假装 GPT-5 是最新的 OpenAI 选项。保留文章标题匹配,但更新与买家的对话。

最终建议

对于大多数成本敏感型 API 工作流,DeepSeek V4 vs GPT-5 应从 DeepSeek 在公开 token 价格上的胜出开始。将 deepseek-flash 作为低成本的首个测试,在您需要更高质量的 DeepSeek 候选项时再添加 deepseek-v4-pro,并在 OpenAI 特定行为很重要时保留 gpt-5 作为 GPT 基线。

然后从日志中做出最终判断:

  1. 通过提供方文档或 Flatkey 模型目录验证模型 ID。
  2. 用同一组提示分别运行 DeepSeek 和 GPT-5。
  3. 衡量的是可接受输出成本,而不是原始 token 成本。
  4. 检查使用日志中的模型、token 数、成本、状态和延迟。
  5. 只有在质量、解析器行为和回退风险都通过时,才推广最便宜的路径。

Flatkey 的作用是让这个测试可逆:一个 OpenAI 兼容的基础 URL、一个密钥、一个模型目录,以及一个查看使用情况的地方。这是回答 DeepSeek V4 vs GPT-5: The Cheapest Frontier Option? 的最安全方式,而不会把一篇定价文章变成一个缺乏依据的基准测试结论。

常见问题

DeepSeek V4 比 GPT-5 便宜吗?

根据当前公开的 token 费率,DeepSeek Flash 在列出的各 token 项上都比 GPT-5 便宜,而 DeepSeek V4 Pro 在输出和缓存输入上也更便宜。DeepSeek V4 Pro 的高峰期未缓存输入略高于 GPT-5 输入,因此准确答案取决于你的输入、缓存、输出,以及高峰/非高峰的组合。

DeepSeek V4 Pro 和 DeepSeek V4.1 Flash 是一样的吗?

不是。DeepSeek 目前的定价表将 deepseek-flash 列为 DeepSeek-V4.1-Flash,将 deepseek-v4-pro 列为 DeepSeek-V4-Pro-0813。应将它们视为不同的模型路径,并分别进行价格和功能检查。

我应该用 DeepSeek V4 替换 GPT-5 吗?

只有在完成工作负载测试后才替换。DeepSeek 可能是更便宜的路径,但你仍然需要检查输出接受率、工具调用、JSON 行为、延迟、使用日志和回滚。

我能否通过一个 OpenAI 兼容客户端同时比较两者?

可以。使用 Flatkey 时,将 OpenAI SDK 指向 https://router.flatkey.ai/v1,使用 Flatkey API 密钥,并把 model 参数改为你正在测试的候选路径。上线前先验证可用的模型 ID。

我接下来应该阅读哪些 Flatkey 内部页面?

DeepSeek API accessDeepSeek V4 migrationDeepSeek V4 Pro vs FlashClaude vs GPT API routing,以及 AI model catalog guide 开始。