模型目录

查看实时模型可用性、价格、端点支持和模型详情页。

ReasoningMultimodalLong ContextCoding

gpt-6-astra

GPT-6 Astra is built for harder reasoning, richer multimodal understanding, and long-context collaboration. It brings code, images, text, and task flow into one orbit — for work that needs sharper thinking, steadier output, and deeper memory.

了解更多

全部模型

共 96 个模型
模型官方价我们的价格折扣上下文延迟健康评分
glm-5.3Zhipu AI · GLMNew release输入$1.4/ 1M tokens输出$4.4/ 1M tokens缓存$0.26/ 1M tokens输入$1.12/ 1M tokens输出$3.52/ 1M tokens缓存$0.208/ 1M tokens-20.0% ↓1M600ms
100%
deepseek-v4-proDeepSeek · DeepSeekHOT输入$1.32/ 1M tokens输出$3.96/ 1M tokens缓存$0.044/ 1M tokens输入$1.056/ 1M tokens输出$3.168/ 1M tokens缓存$0.0352/ 1M tokens-20.0% ↓1M600ms
100%
gpt-5.6-solOpenAI · GPTHOT输入$5/ 1M tokens输出$30/ 1M tokens缓存$0.5/ 1M tokens输入$4/ 1M tokens输出$24/ 1M tokens缓存$0.4/ 1M tokens-20.0% ↓1M600ms
100%
kimi-k3Moonshot AI · KimiHOT输入$3/ 1M tokens输出$15/ 1M tokens缓存$0.3/ 1M tokens输入$2.4/ 1M tokens输出$12/ 1M tokens缓存$0.24/ 1M tokens-20.0% ↓1M600ms
100%
seedance-2.5ByteDance · SeedanceHOTfrom$0.084/ 秒from$0.084/ 秒-0.0% ↓600ms
100%
gpt-6-astraOpenAINew release输入$10/ 1M tokens输出$50/ 1M tokens缓存$1/ 1M tokens输入$8/ 1M tokens输出$40/ 1M tokens缓存$0.8/ 1M tokens-20.0% ↓600ms
100%
gpt-image-2.5-sunburstOpenAINew release输入$5/ 1M tokens输出$30/ 1M tokens缓存/ 1M tokens输入$4/ 1M tokens输出$24/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gpt-image-2.5-flareOpenAINew release$8/ 张$6.4/ 张-20.0% ↓600ms
100%
deepseek-v4-flashDeepSeek · DeepSeek输入$0.44/ 1M tokens输出$1.32/ 1M tokens缓存$0.014/ 1M tokens输入$0.352/ 1M tokens输出$1.056/ 1M tokens缓存$0.0112/ 1M tokens-20.0% ↓1M600ms
100%
gemma-4-26b-a4b-itGoogle输入$0.25/ 1M tokens输出$0.5/ 1M tokens缓存/ 1M tokens输入$0.2/ 1M tokens输出$0.4/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-1-deep-discoverFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-0-deep-researchFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-3.8-flashGoogle输入$2/ 1M tokens输出$8/ 1M tokens缓存/ 1M tokens输入$1.6/ 1M tokens输出$6.4/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
veo-3.1-generate-previewGooglefrom$0.4/ 秒from$0.32/ 秒-20.0% ↓600ms
100%
openai/gpt-image-2.5-flareOpenAI输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
openai/gpt-image-2.5-sunburstOpenAI输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-flash-lite-latestGoogle输入$0.1/ 1M tokens输出$0.4/ 1M tokens缓存$0.025/ 1M tokens输入$0.08/ 1M tokens输出$0.32/ 1M tokens缓存$0.02/ 1M tokens-20.0% ↓600ms
100%
nano-banana-pro-previewGoogle$0.12/ 张$0.096/ 张-20.0% ↓600ms
100%
gemma-4-31b-itGoogle输入$0.18/ 1M tokens输出$0.5/ 1M tokens缓存/ 1M tokens输入$0.144/ 1M tokens输出$0.4/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-0-deep-solveFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-1-deep-solveFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-3.1-flash-lite-previewGoogle输入$0.25/ 1M tokens输出$1.5/ 1M tokens缓存$0.025/ 1M tokens输入$0.2/ 1M tokens输出$1.2/ 1M tokens缓存$0.02/ 1M tokens-20.0% ↓600ms
100%
gemini-3.7-flashGoogle输入$1.5/ 1M tokens输出$7.5/ 1M tokens缓存$0.15/ 1M tokens输入$1.2/ 1M tokens输出$6/ 1M tokens缓存$0.12/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1.1-miniFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1.1Flatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-flash-latestGoogle输入$0.3/ 1M tokens输出$2.5/ 1M tokens缓存$0.075/ 1M tokens输入$0.24/ 1M tokens输出$2/ 1M tokens缓存$0.06/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-0-deep-discoverFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-pro-latestGoogle输入$2/ 1M tokens输出$12/ 1M tokens缓存$0.2/ 1M tokens输入$1.6/ 1M tokens输出$9.6/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓600ms
100%
Aapodex-1-1-deep-researchFlatkey catalog输入$75/ 1M tokens输出$75/ 1M tokens缓存/ 1M tokens输入$60/ 1M tokens输出$60/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
veo-3.1-fast-generate-previewGooglefrom$0.1/ 秒from$0.08/ 秒-20.0% ↓600ms
100%
deepseek-v3.2-thinkingDeepSeek · DeepSeek输入$0.29/ 1M tokens输出$0.42/ 1M tokens缓存$0.29/ 1M tokens输入$0.232/ 1M tokens输出$0.336/ 1M tokens缓存$0.232/ 1M tokens-20.0% ↓128K600ms
100%
deepseek-v3.2DeepSeek · DeepSeek输入$0.266/ 1M tokens输出$0.444/ 1M tokens缓存$0.0266/ 1M tokens输入$0.2128/ 1M tokens输出$0.3552/ 1M tokens缓存$0.02128/ 1M tokens-20.0% ↓128K600ms
100%
deepseek-v3.1DeepSeek · DeepSeek输入$0.21/ 1M tokens输出$0.79/ 1M tokens缓存$0.13/ 1M tokens输入$0.168/ 1M tokens输出$0.632/ 1M tokens缓存$0.104/ 1M tokens-20.0% ↓128K600ms
100%
deepseek-v3DeepSeek · DeepSeek输入$0.4/ 1M tokens输出$1.3/ 1M tokens缓存$0.4/ 1M tokens输入$0.32/ 1M tokens输出$1.04/ 1M tokens缓存$0.32/ 1M tokens-20.0% ↓128K600ms
100%
gemini-3.1-pro-previewGoogle · Gemini输入$2/ 1M tokens输出$12/ 1M tokens缓存$0.2/ 1M tokens输入$1.6/ 1M tokens输出$9.6/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓1M600ms
100%
gemini-3.1-pro-preview-customtoolsGoogle · Gemini输入$2/ 1M tokens输出$12/ 1M tokens缓存$0.2/ 1M tokens输入$1.6/ 1M tokens输出$9.6/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓1M600ms
100%
gemini-3.1-flash-liteGoogle · Gemini输入$0.25/ 1M tokens输出$1.5/ 1M tokens缓存$0.025/ 1M tokens输入$0.2/ 1M tokens输出$1.2/ 1M tokens缓存$0.02/ 1M tokens-20.0% ↓1M600ms
100%
gemini-3.1-flash-imageGoogle · Gemini$0.06/ 张$0.048/ 张-20.0% ↓600ms
100%
gemini-3.1-flash-lite-imageGoogle · Gemini$0.03/ 张$0.024/ 张-20.0% ↓600ms
100%
gemini-3.1-flash-tts-previewGoogle · Gemini输入$1/ 1M tokens输出$20/ 1M tokens缓存/ 1M tokens输入$0.8/ 1M tokens输出$16/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-3.5-flashGoogle · Gemini输入$1.5/ 1M tokens输出$9/ 1M tokens缓存$0.15/ 1M tokens输入$1.2/ 1M tokens输出$7.2/ 1M tokens缓存$0.12/ 1M tokens-20.0% ↓1M600ms
100%
gemini-3.6-flashGoogle · Gemini输入$1.5/ 1M tokens输出$7.5/ 1M tokens缓存$0.15/ 1M tokens输入$1.2/ 1M tokens输出$6/ 1M tokens缓存$0.12/ 1M tokens-20.0% ↓1M600ms
100%
gemini-3-pro-imageGoogle · Gemini$0.12/ 张$0.096/ 张-20.0% ↓600ms
100%
gemini-3.5-flash-liteGoogle · Gemini输入$0.3/ 1M tokens输出$2.5/ 1M tokens缓存$0.03/ 1M tokens输入$0.24/ 1M tokens输出$2/ 1M tokens缓存$0.024/ 1M tokens-20.0% ↓1M600ms
100%
gemini-2.5-proGoogle · Gemini输入$1.125/ 1M tokens输出$9/ 1M tokens缓存$0.1125/ 1M tokens输入$0.9/ 1M tokens输出$7.2/ 1M tokens缓存$0.09/ 1M tokens-20.0% ↓1M600ms
100%
gemini-2.5-flash-imageGoogle · Gemini$0.03/ 张$0.024/ 张-20.0% ↓600ms
100%
gemini-3-flash-previewGoogle · Gemini输入$0.07/ 1M tokens输出$0.43/ 1M tokens缓存$0.007/ 1M tokens输入$0.056/ 1M tokens输出$0.344/ 1M tokens缓存$0.0056/ 1M tokens-20.0% ↓1M600ms
100%
gemini-2.5-flashGoogle · Gemini输入$0.09/ 1M tokens输出$0.71/ 1M tokens缓存$0.0027/ 1M tokens输入$0.072/ 1M tokens输出$0.568/ 1M tokens缓存$0.00216/ 1M tokens-20.0% ↓1M600ms
100%
gemini-embedding-001Google · Gemini输入$0.15/ 1M tokens输出/ 1M tokens缓存/ 1M tokens输入$0.12/ 1M tokens输出/ 1M tokens缓存/ 1M tokens-20.0% ↓8K600ms
100%
gemini-2.5-flash-liteGoogle · Gemini输入$0.09/ 1M tokens输出$0.36/ 1M tokens缓存$0.0225/ 1M tokens输入$0.072/ 1M tokens输出$0.288/ 1M tokens缓存$0.018/ 1M tokens-20.0% ↓1M600ms
100%
gemini-2.5-pro-ttsGoogle · Gemini输入$1/ 1M tokens输出$20/ 1M tokens缓存/ 1M tokens输入$0.8/ 1M tokens输出$16/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-2.5-flash-ttsGoogle · Gemini输入$0.5/ 1M tokens输出$10/ 1M tokens缓存/ 1M tokens输入$0.4/ 1M tokens输出$8/ 1M tokens缓存/ 1M tokens-20.0% ↓600ms
100%
gemini-robotics-er-1.6-previewGoogle · Gemini输入$0.3/ 1M tokens输出$1.2/ 1M tokens缓存$0.3/ 1M tokens输入$0.24/ 1M tokens输出$0.96/ 1M tokens缓存$0.24/ 1M tokens-20.0% ↓128K600ms
100%
glm-5.2Zhipu AI · GLM输入$1.4/ 1M tokens输出$4.4/ 1M tokens缓存$0.26/ 1M tokens输入$1.12/ 1M tokens输出$3.52/ 1M tokens缓存$0.208/ 1M tokens-20.0% ↓1M600ms
100%
glm-5.1Zhipu AI · GLM输入$1.4/ 1M tokens输出$4.4/ 1M tokens缓存$0.26/ 1M tokens输入$1.12/ 1M tokens输出$3.52/ 1M tokens缓存$0.208/ 1M tokens-20.0% ↓205K600ms
100%
glm-5Zhipu AI · GLM输入$1/ 1M tokens输出$3.2/ 1M tokens缓存$0.2/ 1M tokens输入$0.8/ 1M tokens输出$2.56/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓205K600ms
100%
glm-5-turboZhipu AI · GLM输入$1.2/ 1M tokens输出$4/ 1M tokens缓存$0.24/ 1M tokens输入$0.96/ 1M tokens输出$3.2/ 1M tokens缓存$0.192/ 1M tokens-20.0% ↓205K600ms
100%
glm-4.7Zhipu AI · GLM输入$0.6/ 1M tokens输出$2.2/ 1M tokens缓存$0.11/ 1M tokens输入$0.48/ 1M tokens输出$1.76/ 1M tokens缓存$0.088/ 1M tokens-20.0% ↓205K600ms
100%
gpt-5.6-lunaOpenAI · GPT输入$0.2/ 1M tokens输出$1.2/ 1M tokens缓存$0.02/ 1M tokens输入$0.16/ 1M tokens输出$0.96/ 1M tokens缓存$0.016/ 1M tokens-20.0% ↓1M600ms
100%
gpt-5.5OpenAI · GPT输入$5/ 1M tokens输出$30/ 1M tokens缓存$0.5/ 1M tokens输入$4/ 1M tokens输出$24/ 1M tokens缓存$0.4/ 1M tokens-20.0% ↓1M600ms
100%
gpt-4o-miniOpenAI · GPT输入$0.15/ 1M tokens输出$0.6/ 1M tokens缓存$0.08/ 1M tokens输入$0.12/ 1M tokens输出$0.48/ 1M tokens缓存$0.064/ 1M tokens-20.0% ↓128K600ms
100%
gpt-5.4-miniOpenAI · GPT输入$0.75/ 1M tokens输出$4.5/ 1M tokens缓存$0.075/ 1M tokens输入$0.6/ 1M tokens输出$3.6/ 1M tokens缓存$0.06/ 1M tokens-20.0% ↓400K600ms
100%
gpt-5.6-terraOpenAI · GPT输入$2/ 1M tokens输出$12/ 1M tokens缓存$0.2/ 1M tokens输入$1.6/ 1M tokens输出$9.6/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓1M600ms
100%
gpt-5.4OpenAI · GPT输入$2.5/ 1M tokens输出$15/ 1M tokens缓存$0.25/ 1M tokens输入$2/ 1M tokens输出$12/ 1M tokens缓存$0.2/ 1M tokens-20.0% ↓1M600ms
100%
gpt-image-2OpenAI · GPT$0.011/ 张$0.0088/ 张-20.0% ↓600ms
100%
gpt-5-miniOpenAI · GPT输入$0.04/ 1M tokens输出$0.32/ 1M tokens缓存$0.0048/ 1M tokens输入$0.032/ 1M tokens输出$0.256/ 1M tokens缓存$0.00384/ 1M tokens-20.0% ↓400K600ms
100%
gpt-5.4-nanoOpenAI · GPT输入$0.2/ 1M tokens输出$1.25/ 1M tokens缓存$0.02/ 1M tokens输入$0.16/ 1M tokens输出$1/ 1M tokens缓存$0.016/ 1M tokens-20.0% ↓400K600ms
100%
gpt-4oOpenAI · GPT输入$2.5/ 1M tokens输出$10/ 1M tokens缓存$1.25/ 1M tokens输入$2/ 1M tokens输出$8/ 1M tokens缓存$1/ 1M tokens-20.0% ↓128K600ms
100%
gpt-4.1-miniOpenAI · GPT输入$0.4/ 1M tokens输出$1.6/ 1M tokens缓存$0.1/ 1M tokens输入$0.32/ 1M tokens输出$1.28/ 1M tokens缓存$0.08/ 1M tokens-20.0% ↓1M600ms
100%
grok-imagine-image-qualityxAI · Grok$0.05/ 张$0.04/ 张-20.0% ↓600ms
100%
grok-imagine-image-proxAI · Grok$0.05/ 张$0.04/ 张-20.0% ↓600ms
100%
grok-imagine-video-1.5xAI · Grok$0.11/ 秒$0.088/ 秒-20.0% ↓600ms
100%
grok-imagine-imagexAI · Grok$0.02/ 张$0.016/ 张-20.0% ↓600ms
100%
grok-imagine-videoxAI · Grok$0.09/ 秒$0.072/ 秒-20.0% ↓600ms
100%
kimi-k2.6Moonshot AI · Kimi输入$0.95/ 1M tokens输出$4/ 1M tokens缓存$0.16/ 1M tokens输入$0.76/ 1M tokens输出$3.2/ 1M tokens缓存$0.128/ 1M tokens-20.0% ↓262K600ms
100%
kimi-k2.5Moonshot AI · Kimi输入$0.6/ 1M tokens输出$3/ 1M tokens缓存$0.1/ 1M tokens输入$0.48/ 1M tokens输出$2.4/ 1M tokens缓存$0.08/ 1M tokens-20.0% ↓262K600ms
100%
macaron-v1-coding-ventiMacaron · Macaron输入$5.2/ 1M tokens输出$18.2/ 1M tokens缓存$1.3/ 1M tokens输入$4.16/ 1M tokens输出$14.56/ 1M tokens缓存$1.04/ 1M tokens-20.0% ↓1M600ms
100%
macaron-v1-ventiMacaron · Macaron输入$7/ 1M tokens输出$25/ 1M tokens缓存$2/ 1M tokens输入$5.6/ 1M tokens输出$20/ 1M tokens缓存$1.6/ 1M tokens-20.0% ↓1M600ms
100%
macaron-v1-tallMacaron · Macaron输入$1.8/ 1M tokens输出$10/ 1M tokens缓存$0.2/ 1M tokens输入$1.44/ 1M tokens输出$8/ 1M tokens缓存$0.16/ 1M tokens-20.0% ↓262K600ms
100%
MiniMax-H3MiniMax · MiniMaxfrom$0.08/ 秒from$0.08/ 秒-0.0% ↓600ms
100%
minimax-m2.7MiniMax · MiniMax输入$0.3/ 1M tokens输出$1.2/ 1M tokens缓存$0.06/ 1M tokens输入$0.24/ 1M tokens输出$0.96/ 1M tokens缓存$0.048/ 1M tokens-20.0% ↓205K600ms
100%
minimax-m2.5MiniMax · MiniMax输入$0.3/ 1M tokens输出$1.2/ 1M tokens缓存$0.03/ 1M tokens输入$0.24/ 1M tokens输出$0.96/ 1M tokens缓存$0.024/ 1M tokens-20.0% ↓205K600ms
100%
minimax-m2MiniMax · MiniMax输入$0.3/ 1M tokens输出$1.2/ 1M tokens缓存$0.3/ 1M tokens输入$0.24/ 1M tokens输出$0.96/ 1M tokens缓存$0.24/ 1M tokens-20.0% ↓205K600ms
100%
qwen3.8-maxAlibaba · Qwen输入$2/ 1M tokens输出$6/ 1M tokens缓存$0.25/ 1M tokens输入$1.6/ 1M tokens输出$4.8/ 1M tokens缓存$0.2/ 1M tokens-20.0% ↓1M600ms
100%
qwen3.7-maxAlibaba · Qwen输入$2.5/ 1M tokens输出$2.5/ 1M tokens缓存/ 1M tokens输入$2/ 1M tokens输出$2/ 1M tokens缓存/ 1M tokens-20.0% ↓1M600ms
100%
qwen3.7-plusAlibaba · Qwen输入$0.4/ 1M tokens输出$1.6/ 1M tokens缓存$0.08/ 1M tokens输入$0.32/ 1M tokens输出$1.28/ 1M tokens缓存$0.064/ 1M tokens-20.0% ↓256K600ms
100%
qwen3.6-max-previewAlibaba · Qwen输入$1.3/ 1M tokens输出$7.8/ 1M tokens缓存$0.13/ 1M tokens输入$1.04/ 1M tokens输出$6.24/ 1M tokens缓存$0.104/ 1M tokens-20.0% ↓1M600ms
100%
qwen3.6-plusAlibaba · Qwen输入$0.5/ 1M tokens输出$3/ 1M tokens缓存$0.05/ 1M tokens输入$0.4/ 1M tokens输出$2.4/ 1M tokens缓存$0.04/ 1M tokens-20.0% ↓256K600ms
100%
qwen3.5-27bAlibaba · Qwen输入$0.3/ 1M tokens输出$2.4/ 1M tokens缓存/ 1M tokens输入$0.24/ 1M tokens输出$1.92/ 1M tokens缓存/ 1M tokens-20.0% ↓128K600ms
100%
qwen3.5-397b-a17bAlibaba · Qwen输入$0.588/ 1M tokens输出$3.528/ 1M tokens缓存/ 1M tokens输入$0.4704/ 1M tokens输出$2.8224/ 1M tokens缓存/ 1M tokens-20.0% ↓128K600ms
100%
qwen3.5-plusAlibaba · Qwen输入$0.4/ 1M tokens输出$2.4/ 1M tokens缓存$0.04/ 1M tokens输入$0.32/ 1M tokens输出$1.92/ 1M tokens缓存$0.032/ 1M tokens-20.0% ↓128K600ms
100%
qwen3.5-flashAlibaba · Qwen输入$0.1/ 1M tokens输出$0.4/ 1M tokens缓存/ 1M tokens输入$0.08/ 1M tokens输出$0.32/ 1M tokens缓存/ 1M tokens-20.0% ↓128K600ms
100%
qwen3.5-35b-a3bAlibaba · Qwen输入$0.245/ 1M tokens输出$1.96/ 1M tokens缓存/ 1M tokens输入$0.196/ 1M tokens输出$1.568/ 1M tokens缓存/ 1M tokens-20.0% ↓128K600ms
100%
seedance-2.0-proByteDance · Seedancefrom$0.041312/ 秒from$0.037181/ 秒-10.0% ↓600ms
100%
seedance-2.0ByteDance · Seedancefrom$0.041312/ 秒from$0.037181/ 秒-10.0% ↓600ms
100%
sonilo-video-to-musicSonilo · Sonilo$0.009/ 次$0.0072/ 次-20.0% ↓600ms
100%