Techsy
お問い合わせ
始める

OpenAI、Claude & Gemini API コスト計算機

キャッシングとバッチ機能による節約効果を考慮し、プロバイダー間の月次コストを比較します。

GPT、Claude、GeminiのAPIコストは、入力トークン100万あたり0.15ドル〜75ドルの範囲で、出力トークンは通常3〜5倍高くなります。月間1,000万トークンの場合、GPT-4oは約775ドル、Claude Sonnet 4は約1,140ドル、Gemini 2.5 Proは約825ドルです。プロンプトキャッシュを使えばキャッシュされたトークンのコストを10分の1に削減でき、Batch APIを使えばリアルタイム性が不要な処理のコストを50%削減できます。この計算ツールでは、3社すべてのプロバイダーにわたる正確な使用量をシミュレーションできます。

ホーム/リソース/ツール/OpenAI、Claude & Gemini API コスト計算機
↓ 計算ツールを開く

入力項目

05 fields

推定月額コスト

● 信頼度:高

¥6,978 – ¥10,672

中央値見積もり: ¥8,209

内訳

入力トークン (10M × $2.50/M)¥3,731
出力トークン (3M × $10.00/M)¥4,478

メールアドレスと電話番号の入力が必要です。チームとの30分間のレビューコールを行います。

Japan のチームがあなたのスコープ全体をどのように見積もるのかをご覧ください →

こんな方におすすめ

ベンダーとの商談前に、openai api プロジェクトの規模感を把握したい創業者 新製品開発のための年度予算編成を行うCTOおよびエンジニアリングリーダー 一言のアイデアを財務部門に説明できる具体的な範囲に変換したいプロダクトマネージャー エージェントやフリーランスからの見積もりが妥当かどうかを検証したい調達担当チーム

計算ロジックについて

価格は2026年時点でOpenAI、Anthropic、Googleが公開している料金に基づいています。プロンプトキャッシュはキャッシュされた入力トークンのみに適用されます(通常はシステムプロンプトと安定したコンテキストが対象)。Batch APIは、24時間SLAの非リアルタイム処理において、入力トークンと出力トークンの両方に適用されます。

データソース

  • OpenAI公式API料金表
  • OpenAI Batch APIドキュメント
  • Anthropic公式API料金表
  • Anthropicプロンプトキャッシュドキュメント
  • Anthropic Message Batches API
  • Google AI / Gemini API料金表
  • OpenAIプロンプトキャッシュドキュメント

価格に影響する要素

モデルティアの選択

GPT-4.5、Claude Opus 4、Gemini 2.5 Proといったフロンティアモデルは、ミッドティアモデルと比べてトークンあたりのコストが5〜10倍高くなります。フロンティアモデルは、複雑な多段階ロジック、数学、曖昧なコード生成、深い世界知識を要するタスクなど、ミッドティアでは到底対応できない高度な推論タスクに限定して使用してください。それ以外はすべてClaude Sonnet 4、GPT-4o、Gemini Flashに振り分けます。コスト差は非常に大きく、適切なルーティングを行えば、混在ワークロードで支出を60〜80%削減できるのが一般的です。

プロンプトキャッシュ

Anthropicは入力トークンを5分間無料でキャッシュし、25%の追加料金で1時間まで延長できます。キャッシュされたトークンのコストは約90%削減されます。OpenAIは特定のエンドポイントで5〜10分間自動的にキャッシュし、設定は不要です。キャッシュは、システムプロンプトが2,000トークンを超え、リクエスト間で安定している場合に最も効果を発揮します。これは本番環境のチャットボットやRAGシステムの大半に当てはまります。安定した長いコンテキストを持ち、1分あたりのリクエスト数が多いワークロードほど、削減効果は大きくなります。

Batch API

OpenAIもAnthropicも、標準価格のちょうど50%引きでバッチエンドポイントを提供しています。引き換えにSLAは24時間です。バッチは分類、Embedding生成、要約、評価実行、その他のバックグラウンド処理に最適です。統合も極めてシンプルで、同じモデル・同じプロンプトを別のエンドポイントに送り、結果を待つキューを用意するだけです。多くのチームがバッチの存在を見過ごし、リアルタイム性が不要なワークロードにフルプライスを払い続けています。これは最も簡単に防げるAIコストの一つです。

出力トークン数

すべてのプロバイダーにおいて、出力トークンは入力トークンの3〜5倍のコストがかかります。しかし、ほとんどのレスポンスにはAPIがデフォルトで許容する4Kトークンの出力バッファは不要です。Yes/Noの回答を抽出するだけなら出力を10トークンに、短い要約を生成するなら200トークンに制限しましょう。モデルは頼んでもいないのに自分の推論を説明したがることが多く、その説明にも課金されています。max_tokensを適切に絞るだけで、品質を落とさず出力コストを30〜50%削減できることがほとんどです。

コンテキストウィンドウの大きさと価格は比例しない

主要プロバイダーはすべて、コンテキストウィンドウのサイズではなく消費トークン数に応じて課金します。5Kトークンのプロンプトに200Kのコンテキストウィンドウを使っても、5Kのコンテキストウィンドウを使ってもコストは完全に同じです。つまり、実際にコンテキストを埋めない限り、ロングコンテキストモデルが「割高」になることはありません。モデル選びはコンテキストウィンドウの大きさではなく、性能とトークン単価で判断しましょう。

費用を抑えるためのポイント

最初に取り組むべき最適化はプロンプトキャッシングです。他を差し置いて、まずこれを有効にしてください。Anthropicの場合、安定したシステムプロンプトにcache_controlヘッダーを付与すると、キャッシュ済みトークンの価格は標準入力価格の約10%まで下がります。OpenAIの場合、リクエスト間でプロンプトのプレフィックスが同一であれば、特定のエンドポイントで自動的にキャッシュが適用されます。効果が最も大きいのは、長い安定コンテキストを伴う大量リクエストのワークロードです。詳細なペルソナを持つチャットボット、繰り返し同じ検索コンテキストを使うRAGシステム、長い指示セットを毎回再送するエージェントループなどが該当します。多くのチームがキャッシュの有効化を忘れ、5〜10倍もの過払いをしています。

リアルタイム性が不要なワークロードはすべてBatch APIに移行しましょう。AnthropicもOpenAIも、24時間の応答SLAと引き換えに標準価格のちょうど50%でバッチエンドポイントを提供しています。分類ジョブ、コンテンツモデレーション、Embedding生成、要約パイプライン、評価実行はすべてバッチ向きです。プロンプトもモデルも変わらないため、統合の手間はほぼありません。多くのチームがコンテンツタグ付けパイプライン全体を標準価格で実行していますが、バッチにすれば品質はそのままにコストを半分にできます。

リクエストを難易度でルーティングしましょう。シンプルなクエリ(挨拶、フォーマット、基本的な検索)はGPT-4o mini、Claude Haiku、Gemini Flashに振り分けます。入力トークン100万あたり$0.15〜$0.80で処理できます。高度な推論が必要なタスクはClaude Opus、GPT-4.5、Gemini Proに振り分けます。100万トークンあたり$1.25〜$75です。モデルルーターの前に小さな分類器を置くだけで、混在ワークロードのコストを60〜80%削減できるのが一般的です。すべてのリクエストをフロンティアモデルに送るのは、本番環境で最もよく見られるAIコストの失敗です。

max_tokensは積極的に制限しましょう。出力トークンは入力トークンの3〜5倍のコストがかかり、デフォルトの4K出力バッファはほとんどのレスポンスに対して大きすぎます。Yes/Noの回答は10トークン、短い要約は200トークン、構造化JSONはスキーマが必要とする分+小さなバッファに制限します。モデルは頼んでもいないのに詳細を語りたがることがあり、その追加分にも課金されます。max_tokensを絞るだけで、ほとんどの場合、出力コストを30〜50%削減できます。

取得したコンテキストは、クエリごとに本当に必要なものだけに絞り込みましょう。RAGシステムでは10〜20個のチャンクを取得し、安全のためにすべてをプロンプトに詰め込むことがよくあります。その結果、リクエストごとに数千もの無関係なトークンに課金されます。リランカーを追加して関連性の高い上位3〜5個のチャンクに絞り込めば、品質を落とさず入力トークン使用量を50〜70%削減できるのが一般的です。むしろ、無関係なコンテキストにモデルが気を取られなくなるため、品質が向上することすらあります。

すべてのリクエストをトークン数、モデル、キャッシュの有無とともにログに記録してください。見えないものは最適化できません。AIコストは、新機能のリリースやプロンプトの微調整で一夜にして様変わりします。日次の支出アラートを設定し、機能・モデル・エンドポイント別にコストを分解するダッシュボードを構築しましょう。本番環境でのコスト超過の大半は、請求書を見る2週間前に利用パターンが変化していた、というケースです。

100万トークンあたりのコスト(2026年価格)

モデル入力出力キャッシュ済み入力
GPT-4.5$75.00$150.00$37.50
GPT-4o$2.50$10.00$1.25
GPT-4o mini$0.15$0.60$0.075
Claude Opus 4$15.00$75.00$1.50
Claude Sonnet 4$3.00$15.00$0.30
Claude Haiku 4$0.80$4.00$0.08
Gemini 2.5 Pro$1.25$10.00N/A
Gemini 2.5 Flash$0.075$0.30N/A

よくあるご質問

毎週のように寄せられる質問

専門用語を使わずに、簡潔にお答えします。もし気になることがあれば、

GPT-4o:入力トークン100万あたり2.50ドル、出力10ドル。GPT-4o mini:入力100万あたり0.15ドル、出力0.60ドル。GPT-4.5:入力100万あたり75ドル、出力150ドル。月間1,000万トークンで入力/出力比が30/70の場合、モデルによって25ドル〜1万3,000ドルが見込まれます。

ほとんどのワークロードには、GPT-4o mini、Gemini 2.5 Flash、またはClaude Haiku 4が適しており、いずれも入力トークン100万あたり1ドル未満です。品質と価格のバランスを重視するなら、Claude Sonnet 4またはGemini 2.5 Proがおすすめです。

AnthropicとOpenAIは、リクエスト間で大量の入力プロンプトをキャッシュします。キャッシュされたトークンのコストは、キャッシュなしの場合より約90%安くなります。安定したシステムプロンプトを使用するチャットボットや、安定したコンテキストを使用するRAGに最適です。

入力トークンと出力トークンの両方で、ちょうど50%削減できます。24時間のSLAを受け入れる必要があります。分類、要約、埋め込み、評価に適しています。リアルタイムのチャットやインタラクティブなUXには不向きです。

同等の品質レベルであれば、コストも同程度です。Claude Sonnet 4とGPT-4oはほぼ互角です。プロンプトキャッシュを使用したClaude Opus 4は、安定したプロンプトのワークロードにおいてGPT-4oより約30%安くなります。

(1) プロンプトキャッシュを有効にする。(2) 可能な限りBatch APIを活用する。(3) 簡単なクエリはミニモデルに振り分ける。(4) max_tokensは厳しめに上限を設定する。(5) 検索コンテキストは必要最小限に絞る。

損益分岐点は月額約5,000ドルのAPI利用料が目安です。それを下回る場合はAPIの利用を継続するのが得策です。上回る場合は、インフラの専門知識があれば、Llama 3.1やMistralをセルフホスティングすることでコストを50〜70%削減できます。

代表性のある100リクエストのサンプルを抽出し、入力トークンと出力トークンの平均を測定します。それに月間のリクエスト数を掛け、さらに100万トークンあたりの単価を掛けます。最後に30%の安全マージンを加算します。

ミッドティアモデルでは対応できない高度な推論が必要な場合に限ります。本番ワークロードの80%は、Sonnet 4、GPT-4o、またはGemini 2.5 Proで十分対応でき、コストは10分の1に抑えられます。

一般的なワークロードであれば±15%以内の精度です。実際の変動要因としては、プロンプト長のばらつき、出力長のばらつき、エラーとリトライの繰り返し、ルーティングロジックなどが挙げられます。この計算機は最終的な請求額ではなく、計画立案のツールとしてご活用ください。

似たようなツール

このページを開いた後に多くの人が次に目にする計算ツールです。次の意思決定にぴったりのものをお選びください。

AI統合コスト計算機
AI統合コスト計算機

開発費と月次ランニングコスト。全体像を把握しましょう。

計算ツールを開く

チームが正確な見積もりをご提示します

計算ツールは概算の範囲を示しますが、30分のヒアリングでは、スコープ、スケジュール、予算を明確に固定できます。無料相談、お約束は一切ありません。

会話をはじめよう

注目のツール

リソース

すべて表示
  • The Software Procurement Playbook

    A repeatable framework for buying software without burning six months and a million dollars on the wrong platform.

  • The Architecture Decision Playbook

    A practical framework for picking your stack: when to build vs. buy, monolith vs. microservices, and how to avoid resume-driven design.

  • The Vendor Selection Playbook

    How to pick the right development partner (agency, freelancer, in-house) without overpaying or shipping a half-built product.

Claude Skills

すべて表示
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI自動化

すべて表示
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

注目のツール

リソース

すべて表示
  • The Software Procurement Playbook

    A repeatable framework for buying software without burning six months and a million dollars on the wrong platform.

  • The Architecture Decision Playbook

    A practical framework for picking your stack: when to build vs. buy, monolith vs. microservices, and how to avoid resume-driven design.

  • The Vendor Selection Playbook

    How to pick the right development partner (agency, freelancer, in-house) without overpaying or shipping a half-built product.

Claude Skills

すべて表示
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI自動化

すべて表示
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

サービス

  • エンタープライズソリューション
  • モバイルアプリ
  • Webアプリケーション

ソリューション

  • CRMシステム
  • AI統合
  • ERPソリューション
  • 音声エージェント
  • プロセス自動化
  • サイバーセキュリティ

ライブラリ

  • リソース
  • ブログ
  • ポートフォリオ

コミュニティ

  • AI自動化
  • Claude Skills

ツール

  • モバイルアプリ開発費用計算ツール
  • OpenAI / LLM API 利用料金計算ツール
  • MVP(Minimum Viable Product)開発費用計算ツール
  • 音声AIエージェント構築費用計算ツール

会社情報

  • 概要
  • パートナー
  • お問い合わせ

法的情報

  • プライバシーポリシー
  • 利用規約
  • クッキーポリシー

サービス

  • エンタープライズソリューション
  • モバイルアプリ
  • Webアプリケーション

ソリューション

  • CRMシステム
  • AI統合
  • ERPソリューション
  • 音声エージェント
  • プロセス自動化
  • サイバーセキュリティ

ライブラリ

  • リソース
  • ブログ
  • ポートフォリオ

コミュニティ

  • AI自動化
  • Claude Skills

ツール

  • モバイルアプリ開発費用計算ツール
  • OpenAI / LLM API 利用料金計算ツール
  • MVP(Minimum Viable Product)開発費用計算ツール
  • 音声AIエージェント構築費用計算ツール

会社情報

  • 概要
  • パートナー
  • お問い合わせ
法的情報プライバシーポリシー利用規約クッキーポリシー
TECHSY
© 2026 Techsy. 無断複写・転載を禁じます