Claude APIの料金を解説: トークン料金、キャッシュ書き込み、そして実際のコストモデル
Claude APIの料金を2026年7月20日(月)時点で比較しているなら、まず理解すべき最も重要な点は、Claudeには単一の価格が存在しないということです。Anthropicの公式料金は、モデル階層、トークンが入力か出力か、プロンプトキャッシュが有効かどうか、ワークロードがBatch APIを使用できるかどうか、そしてリージョナルルーティングやデータレジデンシー制御を追加するかどうかによって決まります。
ここが、多くの料金まとめ記事が弱いところです。表をそのまま載せるだけで、実際に請求額を左右する要因を説明していません。このガイドでは、まずAnthropicの公式レートカードから始め、それをプロダクトチーム向けの実践的なコスト計算に落とし込みます。また、Claude APIの料金がAnthropicだけの問題ではなくなり、複数のモデルファミリーをまたぐ共有課金、ルーティング、アクセスに関する運用モデルの問題になる境界も扱います。
Claude API料金の概要
Anthropicの公式料金ページでは、Claude APIの利用料金は100万トークン単位で設定されています。2026年7月20日時点で、本番トラフィックを評価している多くのチームにとって最も有用な現在の行は次のとおりです:
| モデル | 基本入力 | 5分キャッシュ書き込み | 1時間キャッシュ書き込み | キャッシュヒット | 出力 |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 5 | 2026年8月31日までは$2 / MTok; 2026年9月1日以降は$3 / MTok | 導入価格は$2.50 / MTok; 標準価格は$3.75 / MTok | 導入価格は$4 / MTok; 標準価格は$6 / MTok | 導入価格は$0.20 / MTok; 標準価格は$0.30 / MTok | 導入価格は$10 / MTok; 標準価格は$15 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
上の表は、現在のClaude APIの料金に関する議論の中心ですが、あくまで出発点にすぎません。
多くのチームがClaude APIの料金で見落としていること
3つの詳細は、単なる一般的なモデル階層の要約よりも重要です。
1. プロンプトキャッシュは実際の請求額をすぐに変える
Anthropicは、プロンプトキャッシュが基本入力価格に対して次の倍率で適用されると説明しています:
| キャッシュ操作 | 倍率 | 意味 |
|---|---|---|
| 5分キャッシュ書き込み | 1.25x | 再利用のためにプロンプトを保存する対価として少額の上乗せを支払う |
| 1時間キャッシュ書き込み | 2x | より長いキャッシュ期間のために、事前により多く支払う |
| キャッシュ読み取り | 0.1x | キャッシュヒットのコストは通常の入力価格の10% |
だからこそ、繰り返し使うシステムプロンプト、長く再利用可能な指示、安定したナレッジパック、文書レビュー用コンテキストは、表の生の数値が示すよりもはるかに低い実効コストになることがあります。Anthropicは、5分間のキャッシュ書き込みは1回のキャッシュ読み取り後に元が取れ、1時間のキャッシュ書き込みは2回の読み取り後に元が取れると明示しています。
2. Batch API の料金は非同期ワークロードのコストを半分にする
Anthropicのドキュメントによると、Batch APIは入力トークンと出力トークンの両方に50%の割引を提供します。これは、バックフィル、オフライン分析、夜間の評価ジョブ、あるいは即時応答を必要としない大量の文書レビューキューにとって重要です。
多くのチームにとって、最も早いコスト削減はClaudeから離れることではありません。適切なClaudeワークロードをバッチモードに移すことです。
3. トークナイザーの変更は、単純な価格比較を歪めることがある
Anthropicはまた、Claude Opus 4.7以降のOpusモデルに加え、Claude Sonnet 5およびそれ以降の関連ファミリーが、同じテキストに対しておよそ30%多くのトークンを生成しうる新しいトークナイザーを使用していると述べています。これはモデルが割高だという意味ではありません。実際のClaude APIの料金は、表示価格だけでなく、あなた自身のプロンプトの形や出力スタイルに左右される、ということです。
ワークロード別のClaude API料金
適切な階層を選ぶ最も簡単な方法は、ブランドの知名度ではなくワークロードの形から考えることです。
| ワークロード | 最適なデフォルト階層 | 理由 | 主な注意点 |
|---|---|---|---|
| 分類、抽出、短いルーティングタスク | Claude Haiku 4.5 | 大量処理向けの現行最安エントリー価格 | 出力が多いプロンプトでは、見かけ上の節約が消えることがある |
| 一般的なプロダクトチャット、要約、アシスタントフロー | Claude Sonnet 4.6 または Sonnet 5 | 多くの本番環境チームにとって、コストと品質の最適なバランス | Sonnet 5 の導入価格は 2026年9月1日で終了 |
| より難しいコーディング、深い推論、難易度の高い多段エージェント | Claude Opus 4.8 | 最も高い能力上限を持つプレミアム推論階層 | 出力トークンは高価なので、プロンプトの規律が重要 |
| バックフィル、大量分析、夜間処理 | 同じモデルだが、Batch API 経由 | 同じモデル品質をより低い単価で利用可能 | 対話型のユーザー向けフローには不向き |
これは、多くの検索結果が省略する部分です。チームが購入しているのはモデル名ではありません。ワークロードのプロファイルです。
3つの簡単なコスト例
これらの例では、2026年7月20日時点のAnthropic公式の定価を使用しています。
Haiku 4.5 上の軽量サポート分類器
1か月で 20M の入力トークンと 4M の出力トークンを想定します。
| 項目 | コスト計算 | 合計 |
|---|---|---|
| 入力 | 20 x $1 |
$20 |
| 出力 | 4 x $5 |
$20 |
| 合計 | $40 |
狭い範囲のタスクでは、Claude APIの料金は主に入力量の問題です。
キャッシュヒットありの Sonnet 4.6 上での製品コパイロット
30M のキャッシュ未使用入力トークン、50M のキャッシュヒットトークン、そして 8M の出力トークンを想定します。
| 内訳 | コスト計算 | 合計 |
|---|---|---|
| キャッシュ未使用入力 | 30 x $3 |
$90 |
| キャッシュヒット | 50 x $0.30 |
$15 |
| 出力 | 8 x $15 |
$120 |
| 合計 | $225 |
ここで、Claude APIの料金は単純な料金表のようには見えなくなります。再利用されたコンテキストは、Sonnet の経済性を大きく変え得ます。
Batch API を通じた Opus 4.8 での非同期ドキュメントレビュー
12M の入力トークンと 3M の出力トークンを想定します。
| 内訳 | 標準 | Batch |
|---|---|---|
| 入力 | 12 x $5 = $60 |
12 x $2.50 = $30 |
| 出力 | 3 x $25 = $75 |
3 x $12.50 = $37.50 |
| 合計 | $135 | $67.50 |
オフライン作業では、最も役立つ Claude APIの料金に関する示唆は、しばしば「Opus は高い」ではありません。「ジョブを非同期で実行できるなら、プレミアム品質でも十分に ეკონომ的であり得る」ということです。
長いコンテキストと地域別料金に関する注意
Anthropic の最新の料金ドキュメントでは、次の 2 点も明確に示されています。
- Claude Opus 4.6、Claude Opus 4.7、Claude Opus 4.8、Claude Sonnet 4.6、そしてその後に掲載されている最新ファミリーは、標準料金で完全な 100万トークンのコンテキストウィンドウ を含みます。
- Claude 4.5 世代以降のモデルでは、リージョンまたはマルチリージョンのエンドポイントオプションにより、グローバルルーティングに対して 10% のプレミアム が加わる場合があり、また、サポートされている価格カテゴリでは米国限定の推論設定に 1.1倍 の係数が適用されることがあります。
つまり、隠れたコスト要因は通常、特別な長文コンテキスト料金ではありません。むしろ、過大なプロンプト、十分に活用されていないキャッシュ、または倍率を変える居住要件です。
Anthropic への直接アクセスで十分な場合
以下のすべてが当てはまるなら、Anthropic への直接アクセスは今でもすっきりした選択です。
- 本番で必要なモデルファミリーが Claude だけである。
- 請求を 1 つのプロバイダー関係の中に収められる。
- エンジニアリングが、1 つのシステム内でモデルアクセスと支出を直接管理することに慣れている。
- 財務や運用が、プロバイダーをまたいで共有できるルーティングと請求書の画面を必要としていない。
このような環境なら、ゲートウェイは早すぎるかもしれません。
Claude APIの料金が運用モデルの問題になるとき
チームがもはや Claude 専用ではなくなった瞬間に、購入判断は変わります。
それは通常、次のような場合に起こります:
- Claude に加えて、GPT、Gemini、DeepSeek、または他のファミリーを 1 つの統合レイヤーで使いたい
- 財務部門は、プロバイダーごとに請求が分散するのではなく、1 つの残高または 1 つの請求書を望んでいる
- エンジニアリング部門は、プロバイダーをまたいで 1 つのベース URL と 1 つのキー管理パターンを望んでいる
- 運用部門は、モデルレベルのリクエストログ、共有クォータ、または支出のレビューをより整理された形で行えることを望んでいる
これは、多くの Claude API pricing 記事が扱っていないギャップです。チームがマルチモデル化すると、実際の問題はトークンコストだけではありません。調整コストです。
Flatkey が適合する場所
2026年7月20日 月曜日 に確認した Flatkey の公開面は、特定の慎重な価値提案をサポートしています。
- ホームページ は、公式 GPT、Claude、Gemini、DeepSeek、Qwen、GLM、Seedance へのアクセスを含む、すべての公式モデル、1 つのキー を中心に Flatkey を位置づけています。
- 同じページには、Flatkey がリクエストを 公式エンドポイント にルーティングし、1 つのキーの背後で 160 以上のフロンティアモデル をサポートし、それらのルートを 毎時 検証すると記載されています。
- 料金ページ には、1 つの残高で GPT、Claude、Gemini、DeepSeek、画像、音声、動画 を 1 つの OpenAI 互換ゲートウェイ経由でルーティングできると記載されています。
- その料金ページには、利用が モデル、トークンタイプ、リクエストログ によって計測されること、またエンタープライズプランが より大きな月間利用量、請求書発行、調達、カスタムルーティング割引、またはチームレベルの制御 に適していることも記載されています。
安全な結論は、Flatkey がすべてのケースで Anthropic の定価より一定割合低い特定の公開 Claude 行を保証するということではありません。安全な結論は、Claude API pricing を評価しているチームが、Claude がスタックの一部にすぎなくなったとき、よりシンプルな制御プレーンも望むかもしれないということです。
それがあなたの状況であれば、現在の Flatkey の料金ページ を確認し、そのうえで AI API Gateway Architecture: One Key, Model Routing, and the End of Provider Account Sprawl および OpenRouter alternative for Claude API access: Flatkey vs OpenRouter for teams で、より広いモデルルーティングのワークフローと比較してください。
FAQ
現在の Claude API pricing はいくらですか?
2026年7月20日 時点で、Anthropic の公式料金ページには、現在の Claude ファミリーが 100 万トークンあたりの価格、加えて別々のプロンプトキャッシング列、バッチ価格、地域別価格の注記とともに掲載されています。多くのチームにとって、最も関連性が高い行は Haiku 4.5、Sonnet 4.6、Sonnet 5 の導入価格、および Opus 4.8 です。
Claude API pricing は入力トークンと出力トークンだけの話ですか?
いいえ。実際の Claude API pricing は、プロンプトキャッシング、バッチ処理、トークン化の挙動、長いプロンプトの形状、そして選択したデプロイ経路に適用される常駐または地域別価格の修正要素にも依存します。
プロンプトキャッシングは本当に Claude API コストを下げますか?
はい。Anthropicの料金ドキュメントによると、キャッシュ読み取りの料金は通常の入力価格の10%です。繰り返し使うプロンプトコンテキストでは、初回のキャッシュ書き込み後にワークロードの実効コストを大幅に下げられる可能性があります。
Batch APIはいつ重要になるのか?
Claudeのワークロードが非同期である場合は、常に重要になります。Anthropicによると、Batch APIの料金は入力トークンと出力トークンの両方に50%の割引が適用されるため、大規模なオフラインジョブの経済性が変わることがあります。
チームはいつAnthropicの直接料金表を超えて考えるべきか?
Claudeが使用中の唯一のプロバイダーではなくなったとき、チームは直接料金表を超えて考えるべきです。その時点では、分断された請求、ルーティング、アクセスに伴う運用コストが、純粋なトークン支出と同じくらい重要になることがあります。
結論
Claude APIの料金を評価する最善の方法は、1つの数字を尋ねるのをやめて、4つの質問をすることです。
- どのClaudeティアがこのワークロードに適しているか?
- このワークロードはプロンプトキャッシュの恩恵を受けられるか?
- 一部をBatch APIの料金に移行できるか?
- チームが運用すべきモデルファミリーは、まだClaudeだけか?
Anthropicの最新ドキュメントは最初の3つに答えています。4つ目の質問が重要になり始めているなら、次のステップは単なる価格比較ではありません。コントロールプレーンの比較です。
現在のAnthropicの料金ドキュメントを確認し、そのうえでFlatkeyの料金で、より広範なモデルアクセスと請求要件を比較してください。



