
Claude Sonnet 5:新機能と実際の実行コスト
Claude Sonnet 5が本日2026年6月30日に登場し、Anthropicは導入価格として入力トークン100万あたり2ドルに設定した。多くの報道はここで終わっている。だが、実際に請求額を動かす数字は別にある。出力トークンと十数回のやり取りを加えると、エージェントの完全な実行1回あたりのコストはいくらになるのか?Anthropicによれば、Sonnet 5はOpus 4.8の約3分の1の価格で「Opus 4.8に近い」性能を発揮するという。つまり、本当の問いはスペックシートではない。あなたのエージェントの月額コストが実際に下がったのか、そしてどれくらい下がったのか、ということだ。
主なポイント:
- Claude Sonnet 5は2026年6月30日にリリースされ、Anthropicの中位エージェントモデルとしてSonnet 4.6に取って代わった。
- 導入価格は2026年8月31日まで入力100万トークンあたり2ドル・出力10ドルで、以降は3ドル/15ドルとなる。
- Anthropicは、Opusの約3分の1のコストで「Opus 4.8に近い」性能だと述べている。
- Claude FreeとProのデフォルトモデルとなり、APIおよびClaude Codeで
claude-sonnet-5として利用できる。
Claude Sonnet 5とは?(30秒でわかる概要)
Claude Sonnet 5はAnthropicの新しい中位モデルで、2026年6月30日にリリースされた。発表記事では、史上最もエージェント性の高いSonnetと説明されている。計画を立て、ブラウザやターミナルなどのツールを使い、自律的に実行できる。導入価格は入力100万トークンあたり2ドル・出力10ドルで、現在Claude FreeとProのデフォルトモデルとなっている。
「Claude Sonnet 5はもうリリースされたのか?」という混乱が飛び交っているが、そう、本日リリースされた。APIまたはClaude Codeでモデル文字列 claude-sonnet-5 を指定して選択する。AnthropicはこれをSonnet 4.6からの大きな前進と位置づけ、フラッグシップモデルであるOpus 4.8に近い品質を、フラッグシップの価格なしで実現したと述べている。
その根底にある賭けはこうだ。Claude Sonnet 5は、ほとんどのエージェント作業にもはやフロンティアモデルは不要だというAnthropicの賭けである。もしそれが正しければ、興味深いのは性能の飛躍ではない。経済性だ。
Sonnet 4.6およびOpus 4.8との比較:何が新しいか
AnthropicはSonnet 5を、推論・ツール使用・コーディング・ナレッジワークのあらゆる面で「前モデルSonnet 4.6からの大幅な改善」と呼び、「Opus 4.8に近い性能を、より低価格で」実現したと述べている。指示されなくても自身の出力をチェックし、継続的なコーディング、デバッグ、複数ステップのツール使用に強みを発揮する。これらはAnthropicの説明であり、我々の測定結果ではない。
エージェント機能の強化
最大の目玉は自律性だ。Sonnet 5は、タスクを計画し、ブラウザやターミナルなどのツールを手に取り、手取り足取りのサポートなしで長時間の実行をやり抜くために設計されている。TechCrunchの報道(Anthropicの話として)によれば、このモデルはエージェントをより安価に動かし続ける手段として打ち出されており、ZapierやLovableといったチームから初期の顧客シグナルが得られているという。それこそがAnthropicが追い求めるユースケースだ。数分から数時間にわたってループし、ターンごとにトークンが加算されていくエージェントである。
紙の上ではOpus 4.8とどう比較されるか
ここが予算編成において重要な部分だ。性能の差は縮まったが、価格の差は縮まっていない。
| モデル | 入力 $/100万トークン | 出力 $/100万トークン | 導入価格 vs 標準価格 | ポジショニング |
|---|---|---|---|---|
| Claude Sonnet 5 | 2ドル(導入)→ 3ドル | 10ドル(導入)→ 15ドル | 導入価格は2026年8月31日まで | 中位、最もエージェント性の高いSonnet。「Opus 4.8に近い」(Anthropic) |
| Claude Sonnet 4.6 | 3ドル | 15ドル | 標準価格 | 前中位モデル(2026年2月) |
| Claude Opus 4.8 | 5ドル(Fast Modeは10ドル) | 25ドル(Fast Modeは50ドル) | 標準価格 | フラッグシップ。最難関の長期推論 |
注目すべきは、Sonnet 5の標準価格(3ドル/15ドル)がSonnet 4.6と同一である点だ。同じ価格で、より高性能なモデルが手に入る。そしてOpus 4.8の5ドル/25ドルに対して、Sonnet 5の標準価格は入力・出力ともに約60%のレートで利用できる。導入期間中はさらに安くなる。AnthropicはSonnet 5がOpus 4.8を上回るという数値を公表していないので、そのように解釈すべきではない。公式の見解は「近い」であり、我々もその表現を厳守する。
Claude Sonnet 5の実際のコストはいくらか?(トークン経済学)
Claude Sonnet 5は2026年8月31日までの導入期間中、入力100万トークンあたり2ドル・出力10ドルで、その後入力3ドル・出力15ドルに引き上げられる。この標準価格は、より強力なモデルでありながらSonnet 4.6と同一で、Opus 4.8の標準レート(5ドル/25ドル)の約3分の1にあたる。大量のエージェント作業にとって、この比率こそがすべてを物語っている。
では、「100万トークンあたり」とは実際にはどういう意味か?トークンはおおよそ1単語の4分の3に相当する。100万トークンは大量のテキストで、おそらく75万語程度になるが、エージェントはターンごとにコンテキスト(システムプロンプト、過去のメッセージ、ファイルの内容、ツールの出力)を再送信するため、トークンを急速に消費する。1回の複数ファイルにわたるリファクタリングだけで、完了までに数十万の入力トークンを費やすこともある。
この導入期間は、まさに意思決定のポイントだ。8月31日までは2ドル/10ドルで利用できる。それ以降は3ドル/15ドルになる。どうせSonnet 5を試すなら、今やれば評価を割引価格で実行でき、計算が最も有利なうちに運用習慣を確立できる。逆に言えば、2か月で終わる導入価格を前提に予算を組んではいけない。
見出しのレート以上に実際の請求額を変えるプラットフォーム機能が2つある。プロンプトキャッシュは、キャッシュされたコンテキストを再利用することで、ターンごとに全額の入力料金を支払わずに済み、キャッシュ部分で最大約90%の削減が可能になる。バッチ処理は、非同期で実行できる緊急でないジョブのコストを約50%削減する。どちらもAnthropicのプラットフォーム料金に記載されている。エージェントが同じ巨大なシステムプロンプトやコードベースをターンごとに再送信しているなら、プロンプトキャッシュこそがコストに対する最大のレバーだ。さらなる戦術については、LLM APIコスト削減ガイドで詳しく解説している。

入力トークン100万あたり2ドルという価格で、Sonnet 5は大量のエージェントループを常時稼働させても十分なほど安価にした。それこそが変化の本質だ。問いはもはや「このエージェントを動かす余裕があるか?」ではなく「同時に何個のエージェントを動けるか?」である。
実際のSonnet 5エージェント実行コストはいくらか(再現可能な検証)
具体的な数字を出してみよう。我々はラボのベンチマークを実施したわけではなく、そうしたふりをするつもりもない。以下は、Anthropicが公表しているトークン単価を使い、あなた自身のトークン数で再現できる透明性のある計算だ。前提条件を明示し、計算すれば、請求額が導き出される。
計算の実例
現実的なエージェントタスクを考えてみよう。約12ターンにわたる複数ファイルのリファクタリングだ。各ターンで増大するコンテキストを再送信するため、1ターンあたり入力トークン約4万・出力トークン約8千と仮定する(キャッシュなし)。合計で入力トークン約48万・出力トークン約9万6千になる。では計算してみよう。
- Sonnet 5導入価格:(0.48M × 2ドル)+(0.096M × 10ドル)= 0.96ドル + 0.96ドル = 1.92ドル
- Sonnet 5標準価格:(0.48M × 3ドル)+(0.096M × 15ドル)= 1.44ドル + 1.44ドル = 2.88ドル
- Opus 4.8標準価格:(0.48M × 5ドル)+(0.096M × 25ドル)= 2.40ドル + 2.40ドル = 4.80ドル
次にプロンプトキャッシュをオンにしてみる。この48万の入力の大部分が再利用されるコンテキスト(システムプロンプト、ファイルツリー、過去のターン)で、キャッシュ部分について記載されている約90%の削減に近い効果が得られれば、入力側は約0.96ドルから約0.10ドルに下がり、出力は0.96ドルのまま変わらない。
| シナリオ(12ターン、入力約48万/出力約9万6千、注記なき場合はキャッシュなし) | 入力コスト | 出力コスト | 合計 |
|---|---|---|---|
| Sonnet 5導入価格(2ドル/10ドル) | 0.96ドル | 0.96ドル | 1.92ドル |
| Sonnet 5標準価格(3ドル/15ドル) | 1.44ドル | 1.44ドル | 2.88ドル |
| Opus 4.8標準価格(5ドル/25ドル) | 2.40ドル | 2.40ドル | 4.80ドル |
| Sonnet 5導入価格 + プロンプトキャッシュ(入力約90%削減) | 約0.10ドル | 0.96ドル | 約1.06ドル |
これらは、公表されているトークン単価と上記のトークン前提条件を用いたモデル推定値であり、我々が実行したベンチマークではなく、あなたが再現できる計算だ。自分自身のターン数とトークンサイズに置き換えても、構造は変わらない。自分で計算してみてほしい。同じエージェントタスクが、Sonnet 5導入価格では約1.92ドル、Opus 4.8標準価格では4.80ドルかかり、キャッシュを使えばSonnet 5の実行コストは約1.06ドル近くまで下げられる。月に1,000回の実行で換算すれば、約1,900ドルの請求と約4,800ドルの請求の差になる。
モデルの選択と自社コストの測定
我々の前提を信じる必要はない。モデルをあなた自身のワークロードに向けて、実際のトークン数を読み取ればいい。Claude Codeでは、フラグまたはプロジェクト設定でモデルを指定する。
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Anthropic APIでもモデル文字列は同じで、すべてのレスポンスに正確なトークン使用量が返される。
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)input_tokens に入力レートを、output_tokens に出力レートを掛け、ターンごとに合計すれば、そのタスクの真のコストが得られる。cache_read_input_tokens フィールドは、キャッシュによって実際にどれだけの削減があったかを示す。我々がクライアント向けにモデルをルーティングしてきた経験では、月額請求額を動かすのはトークン単価ではなくタスクあたりコストであり、それを誠実に知る唯一の方法は、自分自身のトラフィックで usage オブジェクトを読み取ることだ。
Sonnet 5が最適な場面(実際のユースケース)
Sonnet 5は、タスクあたりコストが請求額を左右する大量のエージェント・コーディング作業に適した選択であり、本番環境のエージェント作業の大部分がこれに該当する。Opus 4.8を選ぶべきは、1回の誤ったステップがプレミアム料金を正当化するほど高コストになる場合だけだ。ループし、リトライし、コンテキストを再送信するあらゆる作業において、中位モデルのレートは複利的にあなたに有利に働く。
具体的な選定:
- **コーディングエージェント。**複数ファイルのリファクタリング、テスト生成、デバッグ実行は多数のターンにわたってトークンを消費するため、ターンあたりの低いレートがここで最も重要になる。位置づけについてはAIコーディングエージェントのまとめを参照してほしい。
- **ブラウザおよびターミナルの自動化。**長時間の自律実行こそ、Anthropicがエージェント機能の強化を設計した対象そのものであり、まさにコストが積み上がる場面でもある。
- **ナレッジワークパイプライン。**大規模に実行される要約、抽出、調査ループは、キャッシュと中位モデルのレートの両方の恩恵を受ける。
- **顧客対応エージェント。**リクエスト量が多ければ、タスクあたりの小さな節約が月単位では大きな節約になる。
どこで実行できるのか?Claude Codeではデフォルトとなり、API経由で利用可能で、主要プラットフォームにも順次展開されている。ツールを選定中なら、CursorとCopilotをClaude Codeと比較した記事でトレードオフを網羅している。
Sonnet 5はOpus 4.8より優れているのか?Opusが依然として価値を持つのはいつか?
いいえ、Anthropic自身の表現においても「優れている」わけではない。AnthropicはSonnet 5を「Opus 4.8に近い」と述べており、上回っているとは言っていない。コスト重視の大量エージェント・コーディング作業にはSonnet 5を選ぼう。最難関の長期推論で、1回の誤りが大きなコストにつながり、追加の精度がプレミアムに見合う場合にはOpus 4.8を選ぶべきだ。
簡単な判断基準:
- 大量のエージェントループでコスト重視?Sonnet 5。
- 最難関の推論で、一発の精度が最重要?Opus 4.8。
- Sonnet 4.6から移行中で予算を気にしている?Sonnet 5(標準価格は同じで、より高性能)。
- 混在するワークロード?容易な90%はSonnet 5に振り分け、難しいケースだけをOpusにエスカレートする。
最後のパターンこそ、モデルをルーティングしてコストを管理するLLMゲートウェイが効果を発揮する場面だ。競合との関係では、一部のメディアはSonnet 5がエージェントコーディングの価格面でGPT-5.5を下回ると報じており、Gemini 3.1 Proも同じ階層で競合している。タスクあたり価格とタスクへの適合性は、リーダーボードが示唆するようには一致しないことがほとんどなので、導入前に自分自身のワークロードでベンチマークを取ってほしい。
Sonnet 5はOpus 4.8の代替ではない。「あらゆることにOpus 4.8を使う」ことの代替である。
Claude Sonnet 5が不得意なこと(正直な限界)
Sonnet 5は中位モデルであるため、フロンティア級の推論、最長期の自律実行、最高精度が求められる一発勝負のタスクには向いていない。そうした用途には、依然としてOpus 4.8の方が安全な選択だ。その価値提案のすべては「フラッグシップに近い性能を、より安く」という一文に集約されており、この文において「近い」という言葉が実質的な意味を担っている。
知っておくべき具体的な限界が1つある。Anthropicは、Sonnet 5は「現在のOpusモデルと比べてサイバーセキュリティタスクの実行能力が大幅に低い」と述べており、Firefoxの脆弱性テスト中に動作するエクスプロイトを生成することは一度もなかったと明記している。セキュリティツールがユースケースの場合、これは意図的な設計上の選択であり、バグではないが、それを踏まえて計画を立てる必要がある。
また、コンテキストウィンドウのサイズを勝手に想定しないこと。Anthropicの発表記事には記載がなく、ここから噂の話に移る。
「Fennec」の噂:実際に確認されていること(噂と事実の整理)
Sonnet 5について出回っている数値の多くは、Anthropic由来ではない。以下では、確認済みの発表内容とリーク情報の境界線を示す。各噂は、公式の発表記事ではなく、アグリゲーターやリークページに由来するものとして扱う。
- **「Fennec」というコードネーム。**未確認。この識別子は数か月前にVertex AIのログから漏洩したもので、歴史的にはSonnet 5ではなくSonnet 4.6に対応していた。Anthropicはコードネームを発表していない。
- **「100万トークンのコンテキストウィンドウ。」**公式の発表記事のどこにも記載がない。Anthropicが公表するまで、具体的なコンテキストウィンドウの数値はすべて未検証として扱うべきだ。
- **「SWE-bench 82.1% / 92.4%。」**アグリゲーターによる捏造である。引用するのは公式記事またはシステムカードの数値のみにし、それ以外は無視すること。
- **「4月1日リリース」「Google TPUで学習」「Dev Team Mode。」**誤りまたは未確認。リリースは2026年6月30日であり、これらの機能や主張はいずれもAnthropicの資料には登場しない。
AnthropicはSonnet 5の「Fennec」というコードネームを発表したことはない。この識別子は数か月前にVertex AIのログから漏洩したもので、別のモデルを指していた。システムカードへのリンクなしに正確なベンチマーク数値を引用しているページがあれば、ノイズとして扱うべきだ。
Sonnet 4.6から乗り換えるべきか?(移行の結論)
現在Sonnet 4.6を使っているなら、Sonnet 5への移行はローリスクだ。同じ標準価格(3ドル/15ドル)でより高性能なモデルが手に入り、導入期間(8月31日まで2ドル/10ドル)のおかげで、今ならテストも安価に済む。The New Stackは、8月までは安価なままOpus 4.8との差を詰めたと評しており、移行を検討する開発者にとって妥当な見方だ。
本番トラフィックを切り替える前に、いくつか注意点がある。
- モデル文字列を
claude-sonnet-5に変更する。ほとんどの構成では、必要なコード変更はこれだけだ。 - プロンプトや出力に関する前提を再確認する。より高性能なモデルは、トーン、冗長度、フォーマットを変えることがあり、下流に影響する可能性がある。
- まず評価セットで検証する。感覚だけで本番トラフィックを切り替えてはいけない。
- 夏以降の予算を組んでいるなら、8月31日の価格引き上げに注意すること。
結論:Sonnet 4.6と同じ標準価格でエージェント性能が向上している以上、4.6に留まることの方が正当化しにくい。導入価格の恩恵を受けるなら今すぐ移行し、評価サイクルが凍結されている場合のみ待つのがよい。そしてOpus 4.8は最難関のタスク専用に残しておくこと。チームでモデルをルーティングし、本番環境のLLMコストに悩んでいるなら、無料相談で整理をお手伝いする。
著者について
Mert Batur GurbuzはTechsy.ioの共同創業者で、同社チームはB2Bクライアント向けにAIエージェント、自動化システム、音声/SDRパイプラインを提供している。バーミンガム大学に在籍し、Techsyチームが実際に本番環境で使用しているLLMツールスタックについて執筆している。LinkedInでつながろう。
経歴:Techsy.io共同創業者、バーミンガム大学。料金は2026年6月30日時点のAnthropic発表記事と照合して確認済み。
よくある質問
Claude Sonnet 5はリリースされたのか?
はい。Anthropicは2026年6月30日にClaude Sonnet 5をリリースし、Claude FreeとProのデフォルトモデルとした。Max、Team、Enterpriseユーザーも利用できる。Anthropic APIおよびClaude Codeでも、モデル文字列 claude-sonnet-5 を指定して利用できる。
Claude Sonnet 5の料金はいくらか?
導入価格は2026年8月31日まで、入力トークン100万あたり2ドル、出力トークン100万あたり10ドル。以降は標準価格として入力100万あたり3ドル、出力100万あたり15ドルに移行する。より高性能なモデルでありながら、Sonnet 4.6と同じ標準レートだ。
Claude Sonnet 5は本当にOpus 4.8より優れているのか?
Anthropic自身の説明では、そうではない。AnthropicはSonnet 5の性能を「Opus 4.8に近い」と述べており、上回っているとは言っていない。1回の誤ったステップが高コストになる最難関の長期推論には、依然としてOpus 4.8の方が強力な選択だ。Sonnet 5が勝るのはタスクあたりコストで、Opusの標準価格の約3分の1で実行できる。
Claude Sonnet 5のコンテキストウィンドウは?
Anthropicの発表記事にはコンテキストウィンドウのサイズの記載がない。アグリゲーターページで出回っている「100万トークン」という主張は未確認で、Anthropic由来のものではない。Anthropicが公式な数値を公表するまで、具体的なコンテキストウィンドウの数値はすべて未検証として扱うべきだ。
Claude Sonnet 5の使い方は?
Anthropic APIではモデル文字列を claude-sonnet-5 に設定するか、Claude Codeで claude --model claude-sonnet-5 またはプロジェクト設定から選択する。Claude FreeとProではデフォルトモデルとなっているため、設定は不要だ。レスポンスの usage オブジェクトを読み取れば、実際のトークンコストを追跡できる。
Claude Sonnet 5のコードネームは「Fennec」か?
確認されていない。「Fennec」は歴史的にSonnet 4.6に対応していた漏洩した識別子であり、AnthropicはSonnet 5のコードネームを発表していない。この識別子は今回のリリースの数か月前にVertex AIのログに浮上したものであり、「FennecはSonnet 5である」という主張はすべて未検証の噂として扱うべきだ。
Sonnet 4.6からSonnet 5に乗り換えるべきか?
おそらくイエスだ。Sonnet 5はSonnet 4.6と同じ標準価格(3ドル/15ドル)で、より優れたエージェント性能を発揮し、導入期間中は8月31日までテストが安価に済む。モデル文字列を変更し、評価セットで検証し、本番トラフィックを切り替える前に動作を確認すること。
コーディングにおいてSonnet 5はGPT-5.5とどう比較されるか?
Sonnet 5はAnthropicのコスト競争力のあるエージェントコーディング向けオプションで、一部のメディアは価格面でGPT-5.5を下回ると報じている。性能比較はワークロードに依存するため、導入前に自分自身のコードベースとタスクの組み合わせで両方をベンチマークすること。タスクあたり価格とタスク適合性は、単一のリーダーボードが示唆するようには一致しない。
Claude Sonnet 5はAWS Bedrockで実行できるか?
Anthropicは主要クラウドプラットフォーム全体でSonnetモデルを提供しているため、ロールアウトの完了に伴い、BedrockとVertexでも claude-sonnet-5 が利用可能になる見込みだ。同日リリースはまずファーストパーティのAPIとClaude Codeに届き、サードパーティプラットフォームには後から届くことが多いため、お住まいのリージョンの現在のプラットフォーム状況を確認してほしい。
Claude Sonnet 5のコストを下げるには?
プロンプトキャッシュを使えば、再利用されるコンテキストで最大約90%の削減が可能で、バッチ処理を使えば緊急でないジョブで約50%の削減ができる。最難関のタスクだけをOpus 4.8に振り分け、大量の作業はSonnet 5で処理すること。usage オブジェクトを読み取れば、トークンがどこに消費されているか正確に把握できる。