
Claude Sonnet 5:有什麼新功能,實際運行成本到底多少
Claude Sonnet 5 在今天(2026 年 6 月 30 日)正式登場,Anthropic 將入門定價設為每百萬輸入 token $2 美元。多數報導就停在這裡。但真正影響你帳單的數字其實不同:當你把輸出 token 和十幾個來回對話都算進去,一次完整的 agent 運行究竟要花多少?Anthropic 表示 Sonnet 5 的效能「接近 Opus 4.8」,價格卻只要大約三分之一。所以真正的問題不在規格表,而是你的 agent 每月成本是否就此下降,以及降了多少。
重點整理:
- Claude Sonnet 5 於 2026 年 6 月 30 日推出,取代 Sonnet 4.6 成為 Anthropic 的中階 agentic 模型。
- 入門定價為輸入每百萬 $2 美元、輸出每百萬 $10 美元,優惠至 2026 年 8 月 31 日,之後為 $3/$15。
- Anthropic 表示其效能「接近 Opus 4.8」,成本卻只要 Opus 的大約三分之一。
- 它是 Claude Free 與 Pro 的預設模型,也可透過 API 與 Claude Code 使用,模型名稱為
claude-sonnet-5。
Claude Sonnet 5 是什麼?(30 秒快速解答)
Claude Sonnet 5 是 Anthropic 全新的中階模型,於 2026 年 6 月 30 日推出,其發布文章將它描述為迄今最具 agentic 能力的 Sonnet。它能制定計畫、使用瀏覽器與終端機等工具,並自主運行。入門定價為輸入每百萬 $2 美元、輸出每百萬 $10 美元,現在已是 Claude Free 與 Pro 的預設模型。
沒錯,它今天正式發布了——如果你看到網路上流傳「Claude Sonnet 5 發布了嗎?」的疑惑,這裡給你答案。你可以在 API 或 Claude Code 中用模型字串 claude-sonnet-5 來選用它。Anthropic 將它定位為相對 Sonnet 4.6 的顯著升級,並表示其品質接近旗艦款 Opus 4.8,卻沒有旗艦級的價格。
背後的盤算是這樣:Claude Sonnet 5 是 Anthropic 的一場賭注,押的是多數 agent 工作已不再需要前沿模型。如果這成立,那麼真正有意思的就不是效能的躍進,而是背後的經濟帳。
相比 Sonnet 4.6 與 Opus 4.8,有什麼新功能
Anthropic 稱 Sonnet 5 在推理、工具使用、程式撰寫與知識工作上「相較於前代 Sonnet 4.6 有大幅提升」,效能「接近 Opus 4.8,但價格更低」。它會在未被要求時自行檢查輸出,並在持續性的程式撰寫、除錯與多步驟工具使用上更強。這些都是 Anthropic 的說法,並非我們自己的測量結果。
Agentic 能力升級
最矚目的變化是自主性。Sonnet 5 的設計目標是規劃任務、拿起瀏覽器與終端機等工具,並在無需手把手引導的情況下完成長時間的運行。根據 TechCrunch 報導(引述 Anthropic),這個模型被定位為讓 agent 持續運行更便宜的方式,並獲得 Zapier、Lovable 等團隊的早期客戶回饋。那正是 Anthropic 鎖定的應用場景:循環運行數分鐘甚至數小時的 agent,而每一輪對話都會增加 token 消耗。
紙面數據上與 Opus 4.8 的比較
這才是攸關預算編列的重點。效能差距縮小了,價格差距卻沒有。
| 模型 | 輸入 $/百萬 | 輸出 $/百萬 | 入門 vs 標準 | 定位 |
|---|---|---|---|---|
| Claude Sonnet 5 | $2(入門)→ $3 | $10(入門)→ $15 | 入門優惠至 2026 年 8 月 31 日 | 中階,最具 agentic 能力的 Sonnet;「接近 Opus 4.8」(Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | 標準 | 前一代中階(2026 年 2 月) |
| Claude Opus 4.8 | $5(Fast Mode $10) | $25(Fast Mode $50) | 標準 | 旗艦款;最困難的長程推理 |
注意 Sonnet 5 的標準價格($3/$15)與 Sonnet 4.6 完全相同。你用同樣的標價就能拿到更強的模型。而對照 Opus 4.8 的 $5/$25,Sonnet 5 標準價的輸入與輸出費率都大約是其 60%。在入門優惠期間則更便宜。Anthropic 並沒有公布任何數據說 Sonnet 5 勝過 Opus 4.8,所以別這樣解讀:官方說法是「接近」,我們也據實以報。
Claude Sonnet 5 實際成本到底多少?(token 經濟學)
在 2026 年 8 月 31 日前的入門優惠期間,Claude Sonnet 5 輸入每百萬 $2 美元、輸出每百萬 $10 美元,之後調升為輸入每百萬 $3 美元、輸出每百萬 $15 美元。這個標準價格與 Sonnet 4.6 相同,卻能換到更強的模型,而且大約只有 Opus 4.8 標準費率($5/$25)的三分之一。對高用量的 agent 工作而言,這個比例就是一切的關鍵。
那麼「每百萬 token」對你來說到底代表什麼?一個 token 大約是四分之三個英文字。一百萬 token 是很大的文字量,大約 75 萬字,但 agent 消耗得很快,因為每一輪都會重新傳送上下文:系統提示、先前訊息、檔案內容、工具輸出。光是單一的多檔案重構,在完成前就可能吃掉數十萬個輸入 token。
這個入門優惠期是一個真正的決策點。8 月 31 日之前,你付的是 $2/$10;之後則是 $3/$15。反正你遲早要測試 Sonnet 5,現在做就代表你的評估能在折扣價下運行,並趁帳面最划算時養成使用習慣。反過來說:別把預算建立在兩個月後就會消失的入門定價上。
有兩項平台功能對實際帳單的影響,遠大於表面費率。**Prompt 快取(prompt caching)**讓你重複使用已快取的上下文,而不必每一輪都支付全額輸入費用,快取部分最高可省下約 90%。**批次處理(batch processing)**則為可非同步運行的非急迫工作削減約 50% 成本。兩者都記載於 Anthropic 的平台定價。如果你的 agent 每一輪都重新傳送同一個大型系統提示或程式碼庫,prompt 快取就是你在成本上最大的施力點。我們在降低 LLM API 成本指南中還有更多策略。

在輸入每百萬 $2 美元的價位下,Sonnet 5 讓高用量的 agent 循環便宜到可以一直掛著跑。這就是轉變所在。問題不再是「我負不負得起運行這個 agent?」,而是「我一次能同時運行幾個?」
一次真實的 Sonnet 5 agent 運行實際要花多少(可重現)
我們來算出實際數字。我們沒有跑實驗室基準測試,也不會假裝有。以下是一個透明的計算,你可以用自己的 token 數量、搭配 Anthropic 公布的每 token 費率來重現。講明假設、做完算術,帳單就出來了。
實際試算
舉一個實際的 agent 任務:一個運行約 12 輪的多檔案重構。假設每輪約 40K 輸入 token 與 8K 輸出 token(關閉快取),因為每一輪都會重新傳送不斷增長的上下文。總計約 480K 輸入 token 與 96K 輸出 token。接著來算:
- Sonnet 5 入門價:(0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 標準價:(0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 標準價:(0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80
現在開啟 prompt 快取。如果這 480K 輸入中大部分是可重複使用的上下文(系統提示、檔案樹、先前對話輪次),而你在快取部分能接近官方記載約 90% 的節省幅度,輸入端就會從約 $0.96 降到約 $0.10,輸出則維持在 $0.96。
| 情境(12 輪,約 480K 輸入 / 約 96K 輸出,除非註明否則關閉快取) | 輸入成本 | 輸出成本 | 總計 |
|---|---|---|---|
| Sonnet 5 入門價($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 標準價($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 標準價($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 入門價 + prompt 快取(輸入省約 90%) | ~$0.10 | $0.96 | ~$1.06 |
這些是用公開的每 token 定價與前述 token 假設所做的估算,是一個你可以重現的計算,而非我們實際跑出的基準測試。換成你自己的輪數與 token 規模,整個結構依然成立。自己算算看:同樣的 agent 任務在 Sonnet 5 入門價下約 $1.92,對照 Opus 4.8 標準價的 $4.80,而快取能把 Sonnet 5 的運行成本壓到接近 $1.06。一個月跑個一千次,那就是約 $1,900 美元帳單與約 $4,800 美元帳單之間的差距。
選定模型並測量你自己的成本
你不必相信我們的假設。把模型對準你自己的工作負載,讀回實際的 token 數量即可。在 Claude Code 中,用旗標或在專案設定中指定模型:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}在 Anthropic API 上,模型字串相同,而每個回應都會給你確切的 token 用量:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)將 input_tokens 乘以你的輸入費率、output_tokens 乘以輸出費率,再把各輪加總,就能得到該任務的真實成本。cache_read_input_tokens 欄位會顯示快取實際為你省下多少。根據我們為客戶路由模型的經驗,左右每月帳單的是每任務成本,而非每 token 的標價,而唯一誠實得知它的方式,就是讀取你自己流量上的 usage 物件。
Sonnet 5 適合用在哪些地方(實際應用場景)
對那些由每任務成本決定帳單的高用量 agentic 與程式撰寫工作而言,Sonnet 5 是正確選擇——而這涵蓋了大多數的生產環境 agent 工作。唯有當單一錯誤步驟的代價高到足以支撐溢價時,才該選用 Opus 4.8。對一切會循環、重試並重新傳送上下文的工作而言,中階費率會持續對你有利。
具體的選擇:
- **程式撰寫 agent。**多檔案重構、測試生成與除錯運行會在多輪中消耗大量 token,因此較低的每輪費率在這裡最為關鍵。看看我們的 AI 程式撰寫 agent 精選,了解它的定位。
- **瀏覽器與終端機自動化。**長時間的自主運行正是 Anthropic 打造這些 agentic 升級的目標,也恰恰是成本不斷累積的地方。
- **知識工作管線。**大規模運行的摘要、擷取與研究循環,能受惠於快取加上中階費率。
- **面向客戶的 agent。**高請求量會把微小的每任務節省,放大成可觀的每月節省。
你能在哪裡運行它?它是 Claude Code 的預設模型,可透過 API 使用,並正在各大平台上線。如果你正在挑選工具,我們針對 Claude Code 與 Cursor 和 Copilot 的比較涵蓋了各項取捨。
Sonnet 5 比 Opus 4.8 更強嗎?Opus 何時仍值得選用?
不,以 Anthropic 自己的說法來看並非「更強」。Anthropic 表示 Sonnet 5「接近 Opus 4.8」,而非領先它。對成本敏感的高用量 agentic 與程式撰寫工作,選 Sonnet 5。對最困難的長程推理——一個錯誤步驟代價高昂、額外準確度足以支撐溢價的場景——則選 Opus 4.8。
一個快速判斷標準:
- 高用量 agent 循環、成本敏感?Sonnet 5。
- 最困難的推理、單次準確度至關重要?Opus 4.8。
- 正從 Sonnet 4.6 遷移並關注預算?Sonnet 5(標準價相同,能力更強)。
- 混合型工作負載?把簡單的 90% 路由給 Sonnet 5,只把困難的案例升級給 Opus。
最後那種模式,正是用 LLM 閘道器路由模型並控制成本能發揮價值之處。就競爭格局而言,一些媒體指出 Sonnet 5 在 agentic 程式撰寫上的價格低於 GPT-5.5,而 Gemini 3.1 Pro 也屬於同一級距。在投入之前,先在你自己的工作負載上做基準測試,因為每任務價格與任務契合度,很少會像排行榜所暗示的那樣一致。
Sonnet 5 並非取代 Opus 4.8,而是取代「什麼都用 Opus 4.8」的做法。
Claude Sonnet 5 不擅長什麼?(誠實的局限)
Sonnet 5 是中階模型,所以它不是前沿級推理、最長程自主性,或最高準確度單次任務的選擇。對這些場景,Opus 4.8 仍是更穩妥的選項。它全部的價值主張就是「用更少的錢接近旗艦款」,而「接近」二字在這句話中實實在在地發揮作用。
有一個值得了解的具體局限:Anthropic 表示 Sonnet 5「執行網路安全任務的能力遠低於我們目前的 Opus 模型」,並指出它在 Firefox 漏洞測試期間從未發展出可運作的漏洞利用。如果安全工具是你的應用場景,那是刻意的設計選擇,而非 bug,但你要據此規劃。
也不要假設某個上下文視窗大小。Anthropic 的發布文章並未說明,這就帶我們進入傳言的部分。
「Fennec」傳言:哪些是真正獲得證實的(破解迷思)
流傳關於 Sonnet 5 的許多數字並非來自 Anthropic。以下是正式發布與外洩說法之間的分界,每則傳言都歸因於彙整頁面與外洩頁面,而非官方文章。
- **「Fennec」代號。**未經證實。該識別碼數月前從一則 Vertex AI 日誌外洩,歷來對應的是 Sonnet 4.6,而非 Sonnet 5。Anthropic 並未公布任何代號。
- **「100 萬 token 上下文視窗」。**官方發布文章中任何地方都沒有提到。在 Anthropic 公布之前,任何具體的上下文視窗數字都應視為未經證實。
- **「82.1% / 92.4% SWE-bench」。**彙整頁面的捏造。只引用官方文章或系統卡中的數字,其餘一概忽略。
- **「4 月 1 日發布」、「在 Google TPU 上訓練」、「Dev Team Mode」。**不實或未經證實。發布日期為 2026 年 6 月 30 日,這些功能或說法都沒出現在 Anthropic 的資料中。
Anthropic 從未為 Sonnet 5 公布「Fennec」代號。該識別碼數月前從一則 Vertex AI 日誌外洩,指向的是另一個模型。如果某個頁面引用精確的基準測試數字卻沒有連結到系統卡,就把它當成雜訊。
你該從 Sonnet 4.6 轉換嗎?(遷移結論)
如果你正在使用 Sonnet 4.6,轉換到 Sonnet 5 的風險很低:你用相同的標準價($3/$15)就能拿到更強的模型,而入門優惠期($2/$10,至 8 月 31 日)讓現在的測試很便宜。The New Stack 將它描述為在 8 月前維持低價的同時縮小與 Opus 4.8 的差距,對正在權衡是否轉換的開發者而言,這是合理的解讀。
在你切換生產環境流量之前,有幾個眉角:
- 將模型字串改為
claude-sonnet-5。對多數設定而言,這是唯一需要的程式碼變動。 - 重新檢查任何 prompt 或輸出假設。更強的模型可能改變語氣、冗長度或格式,而這些變化在下游可能舉足輕重。
- 先在你的評估集上驗證。別憑感覺就切換生產環境流量。
- 如果你的預算編列跨越夏季之後,留意 8 月 31 日的價格調升。
結論是:在與 Sonnet 4.6 相同的標準價下擁有更佳的 agentic 效能,繼續留在 4.6 反而更難說服人。現在就轉換以搭上入門優惠,唯有當你有凍結的評估週期時才觀望,並把 Opus 4.8 保留給最困難的任務。如果你的團隊正在路由模型、並為生產環境的 LLM 成本傷腦筋,我們提供免費諮詢替你規劃。
關於作者
Mert Batur Gurbuz 是 Techsy.io 的共同創辦人,團隊為 B2B 客戶打造 AI agent、自動化系統與語音/SDR 管線。他就讀於伯明罕大學,並撰寫 Techsy 團隊在生產環境中實際使用的 LLM 工具堆疊相關文章。歡迎在 LinkedIn 上連結。
資歷:Techsy.io 共同創辦人、伯明罕大學。定價已於 2026 年 6 月 30 日對照 Anthropic 發布文章核實。
常見問題
Claude Sonnet 5 發布了嗎?
是的。Anthropic 於 2026 年 6 月 30 日推出 Claude Sonnet 5,作為 Claude Free 與 Pro 的預設模型,並開放給 Max、Team 與 Enterprise 使用者。你也可以透過 Anthropic API 與 Claude Code 使用模型字串 claude-sonnet-5 來存取它。
Claude Sonnet 5 多少錢?
入門定價為輸入每百萬 token $2 美元、輸出每百萬 token $10 美元,優惠至 2026 年 8 月 31 日。之後轉為標準定價,輸入每百萬 $3 美元、輸出每百萬 $15 美元,與 Sonnet 4.6 的標準費率相同,卻能換到更強的模型。
Claude Sonnet 5 真的比 Opus 4.8 更強嗎?
以 Anthropic 自己的描述來看並非如此。Anthropic 表示 Sonnet 5 的效能「接近 Opus 4.8」,而非更強。對最困難、單一錯誤步驟代價高昂的長程推理而言,Opus 4.8 仍是更強的選擇。Sonnet 5 勝在每任務成本,運行價格大約只有 Opus 標準價的三分之一。
Claude Sonnet 5 的上下文視窗是多少?
Anthropic 的發布文章並未說明上下文視窗大小。彙整頁面上流傳的「100 萬 token」說法未經證實,也不是來自 Anthropic。在 Anthropic 公布官方數字之前,任何具體的上下文視窗數字都應視為未經證實。
我該怎麼使用 Claude Sonnet 5?
在 Anthropic API 中將模型字串設為 claude-sonnet-5,或在 Claude Code 中用 claude --model claude-sonnet-5 或專案設定來選用。它也是 Claude Free 與 Pro 的預設模型,因此那裡無須設定。讀取回應中的 usage 物件來追蹤實際 token 成本。
Claude Sonnet 5 的代號是「Fennec」嗎?
沒有任何證實。「Fennec」是一個外洩的識別碼,歷來對應的是 Sonnet 4.6,而 Anthropic 並未為 Sonnet 5 公布任何代號。該識別碼在這次發布數月前出現在一則 Vertex AI 日誌中,所以任何「Fennec 等於 Sonnet 5」的說法都應視為未經證實的傳言。
我該從 Sonnet 4.6 轉換到 Sonnet 5 嗎?
很可能該換。Sonnet 5 以與 Sonnet 4.6 相同的標準價($3/$15)運行,卻有更佳的 agentic 效能,而入門優惠期讓 8 月 31 日前的測試很便宜。更改模型字串、在你的評估集上驗證,並在切換生產環境流量前檢查行為。
Sonnet 5 與 GPT-5.5 在程式撰寫上如何比較?
Sonnet 5 是 Anthropic 具成本競爭力的 agentic 程式撰寫選項,一些媒體報導它的價格低於 GPT-5.5。效能比較取決於工作負載,所以在投入之前,先在你自己的程式碼庫與任務組合上對兩者做基準測試。每任務價格與任務契合度,很少會像單一排行榜所暗示的那樣一致。
我能在 AWS Bedrock 上運行 Claude Sonnet 5 嗎?
Anthropic 讓 Sonnet 模型在各大雲平台上線,因此隨著部署完成,claude-sonnet-5 在 Bedrock 與 Vertex 上的可用性應該會跟進。請查看你所在區域目前的平台狀態,因為當日發布往往先抵達第一方 API 與 Claude Code,之後才遍及每個第三方平台。
我該如何降低 Claude Sonnet 5 的成本?
使用 prompt 快取,在重複使用的上下文上最高可省下約 90%,並用批次處理在非急迫工作上省下約 50%。只把最困難的任務路由給 Opus 4.8,讓高用量工作留在 Sonnet 5。讀取 usage 物件,確切了解你的 token 花在哪裡。