
Claude Sonnet 5: Có gì mới và chi phí vận hành thực tế ra sao
Claude Sonnet 5 đã ra mắt hôm nay, ngày 30 tháng 6 năm 2026, và Anthropic định giá gói giới thiệu ở mức $2 cho mỗi triệu token đầu vào. Đó là nơi hầu hết các bài đưa tin dừng lại. Con số thực sự làm thay đổi hóa đơn của bạn lại khác: một lượt chạy agent trọn vẹn tốn bao nhiêu khi bạn cộng thêm token đầu ra và cả chục lượt hội thoại qua lại? Anthropic cho biết Sonnet 5 đạt mức "tiệm cận Opus 4.8" với giá chỉ bằng khoảng một phần ba. Vì vậy, câu hỏi thực sự không nằm ở bảng thông số. Mà là liệu chi phí hàng tháng cho agent của bạn có vừa giảm xuống hay không, và giảm bao nhiêu.
Điểm chính cần nhớ:
- Claude Sonnet 5 ra mắt ngày 30 tháng 6 năm 2026, thay thế Sonnet 4.6 làm mô hình agentic tầm trung của Anthropic.
- Giá giới thiệu là $2/triệu token đầu vào và $10/triệu token đầu ra đến hết ngày 31 tháng 8 năm 2026, sau đó là $3/$15.
- Anthropic cho biết hiệu năng "tiệm cận Opus 4.8" với chi phí chỉ bằng khoảng một phần ba so với Opus.
- Đây là mô hình mặc định cho Claude Free và Pro, đồng thời khả dụng qua API và Claude Code với tên
claude-sonnet-5.
Claude Sonnet 5 là gì? (câu trả lời trong 30 giây)
Claude Sonnet 5 là mô hình tầm trung mới của Anthropic, ra mắt ngày 30 tháng 6 năm 2026, và được mô tả trong bài đăng ra mắt là phiên bản Sonnet agentic nhất từ trước đến nay. Nó có thể lập kế hoạch, sử dụng các công cụ như trình duyệt và terminal, rồi chạy tự chủ. Giá giới thiệu là $2/triệu token đầu vào và $10/triệu token đầu ra, và hiện nó là mô hình mặc định cho Claude Free và Pro.
Đúng vậy, nó đã được phát hành hôm nay, phòng khi bạn thấy sự nhầm lẫn kiểu "Claude Sonnet 5 đã ra mắt chưa?" đang lan truyền. Bạn chọn nó bằng chuỗi mô hình claude-sonnet-5 trong API hoặc trong Claude Code. Anthropic định vị nó là một bước tiến đáng kể so với Sonnet 4.6 và cho biết chất lượng nằm ở mức tiệm cận mô hình chủ lực của hãng, Opus 4.8, mà không mang mức giá của mô hình chủ lực.
Đây là canh bạc ẩn sau nó: Claude Sonnet 5 là lời khẳng định của Anthropic rằng phần lớn công việc agent không còn cần đến một mô hình tiên phong. Nếu điều đó đúng, câu chuyện thú vị không nằm ở bước nhảy vọt về năng lực. Mà là ở bài toán kinh tế.
Có gì mới so với Sonnet 4.6 và Opus 4.8
Anthropic gọi Sonnet 5 là "bước cải tiến đáng kể so với phiên bản tiền nhiệm, Sonnet 4.6" trên các mặt suy luận, sử dụng công cụ, lập trình và công việc tri thức, với hiệu năng "tiệm cận Opus 4.8, nhưng ở mức giá thấp hơn." Nó tự kiểm tra đầu ra của chính mình mà không cần được yêu cầu, và mạnh hơn ở khả năng lập trình kéo dài, gỡ lỗi và sử dụng công cụ đa bước. Đó là những cách diễn đạt của Anthropic, không phải số đo của chúng tôi.
Nâng cấp agentic
Thay đổi đáng chú ý nhất là tính tự chủ. Sonnet 5 được xây dựng để lập kế hoạch cho một tác vụ, cầm lên các công cụ như trình duyệt và terminal, rồi cày ải qua những lượt chạy dài mà không cần ai cầm tay chỉ việc. Như TechCrunch đưa tin (dẫn lời Anthropic), mô hình này được chào mời như một cách rẻ hơn để duy trì agent chạy liên tục, với những tín hiệu ban đầu từ các khách hàng như Zapier và Lovable. Đó chính là trường hợp sử dụng mà Anthropic đang theo đuổi: những agent lặp vòng trong nhiều phút hoặc nhiều giờ, nơi mỗi lượt đều tốn thêm token.
So sánh trên giấy tờ với Opus 4.8
Đây là phần quan trọng cho việc lập ngân sách. Khoảng cách về năng lực đã thu hẹp; còn khoảng cách về giá thì không.
| Mô hình | Đầu vào $/triệu | Đầu ra $/triệu | Giới thiệu so với chuẩn | Định vị |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (giới thiệu) → $3 | $10 (giới thiệu) → $15 | Giá giới thiệu đến hết 31/8/2026 | Tầm trung, Sonnet agentic nhất; "tiệm cận Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Chuẩn | Tầm trung trước đó (tháng 2/2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Chuẩn | Chủ lực; suy luận dài hạn khó nhất |
Hãy chú ý rằng mức giá chuẩn của Sonnet 5 ($3/$15) giống hệt Sonnet 4.6. Bạn có được một mô hình mạnh hơn với cùng mức giá niêm yết. Và so với $5/$25 của Opus 4.8, Sonnet 5 chuẩn chạy ở mức xấp xỉ 60% giá đầu vào và giá đầu ra. Trong giai đoạn giới thiệu, nó còn rẻ hơn nữa. Anthropic chưa công bố con số nào nói rằng Sonnet 5 vượt Opus 4.8, nên đừng hiểu theo cách đó: tuyên bố chính thức là "tiệm cận", và chúng tôi giữ đúng cách hiểu đó.
Claude Sonnet 5 thực sự tốn bao nhiêu? (kinh tế học token)
Claude Sonnet 5 có giá $2/triệu token đầu vào và $10/triệu token đầu ra trong giai đoạn giới thiệu đến hết ngày 31 tháng 8 năm 2026, sau đó tăng lên $3/triệu đầu vào và $15/triệu đầu ra. Mức giá chuẩn đó ngang bằng Sonnet 4.6 cho một mô hình mạnh hơn, và chỉ bằng khoảng một phần ba mức giá chuẩn của Opus 4.8 ($5/$25). Với khối lượng công việc agent lớn, tỷ lệ đó chính là toàn bộ câu chuyện.
Vậy "mỗi triệu token" thực sự có ý nghĩa gì với bạn? Một token xấp xỉ ba phần tư của một từ. Một triệu token là rất nhiều văn bản, có thể khoảng 750.000 từ, nhưng các agent đốt chúng rất nhanh vì mỗi lượt đều gửi lại ngữ cảnh: system prompt, các tin nhắn trước đó, nội dung tệp, đầu ra của công cụ. Chỉ một lần refactor đa tệp cũng có thể ngốn hàng trăm nghìn token đầu vào trước khi hoàn tất.
Giai đoạn giới thiệu đó là một điểm quyết định thực sự. Cho đến ngày 31 tháng 8, bạn trả $2/$10. Sau đó là $3/$15. Dù sao thì nếu bạn định thử Sonnet 5, làm điều đó ngay bây giờ đồng nghĩa các bài eval của bạn chạy ở mức giá ưu đãi, và bạn tạo được thói quen khi bài toán kinh tế đang có lợi nhất. Mặt trái: đừng xây dựng ngân sách trên mức giá giới thiệu mà bạn sẽ mất sau hai tháng nữa.
Có hai tính năng nền tảng làm thay đổi hóa đơn thực tế nhiều hơn cả mức giá tiêu đề. Bộ nhớ đệm prompt (prompt caching) cho phép bạn tái sử dụng ngữ cảnh đã đệm thay vì trả đủ giá đầu vào ở mỗi lượt, giúp tiết kiệm tới xấp xỉ 90% cho phần được đệm. Xử lý theo lô (batch processing) cắt giảm khoảng 50% chi phí cho các tác vụ không khẩn cấp mà bạn có thể chạy bất đồng bộ. Cả hai đều được ghi trong bảng giá nền tảng của Anthropic. Nếu agent của bạn gửi lại cùng một system prompt lớn hoặc cả codebase ở mỗi lượt, prompt caching là đòn bẩy lớn nhất bạn có để giảm chi phí. Chúng tôi đi sâu vào nhiều chiến thuật hơn trong bài hướng dẫn về cách cắt giảm chi phí API LLM.

Với $2 cho mỗi triệu token đầu vào, Sonnet 5 khiến các vòng lặp agent khối lượng lớn đủ rẻ để cứ để chạy liên tục. Đó chính là sự chuyển dịch. Câu hỏi không còn là "tôi có đủ khả năng chạy agent này không?" mà là "tôi có thể chạy bao nhiêu agent cùng lúc?"
Một lượt chạy agent Sonnet 5 thực tế tốn bao nhiêu (có thể tái tạo)
Hãy đặt một con số cụ thể. Chúng tôi không chạy một bài benchmark trong phòng thí nghiệm, và cũng không giả vờ là mình đã làm. Những gì sau đây là một phép tính minh bạch mà bạn có thể tái tạo với số token của chính mình, sử dụng mức giá mỗi token đã công bố của Anthropic. Nêu rõ các giả định, làm phép toán, và hóa đơn sẽ hiện ra.
Phép tính cụ thể
Lấy một tác vụ agent thực tế: một lần refactor đa tệp chạy khoảng 12 lượt. Giả sử mỗi lượt có khoảng 40K token đầu vào và 8K token đầu ra (tắt bộ nhớ đệm), vì mỗi lượt đều gửi lại ngữ cảnh ngày càng lớn. Tổng cộng là khoảng 480K token đầu vào và 96K token đầu ra. Giờ đến phép toán:
- Sonnet 5 giới thiệu: (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 chuẩn: (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 chuẩn: (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80
Giờ bật prompt caching lên. Nếu phần lớn trong 480K đầu vào đó là ngữ cảnh được tái sử dụng (system prompt, cây thư mục tệp, các lượt trước) và bạn đạt gần mức tiết kiệm ~90% như tài liệu ghi nhận cho phần được đệm, thì phần đầu vào giảm từ khoảng $0.96 xuống xấp xỉ $0.10, trong khi đầu ra vẫn giữ ở $0.96.
| Kịch bản (12 lượt, ~480K vào / ~96K ra, tắt bộ nhớ đệm trừ khi ghi chú) | Chi phí đầu vào | Chi phí đầu ra | Tổng |
|---|---|---|---|
| Sonnet 5 giới thiệu ($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 chuẩn ($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 chuẩn ($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 giới thiệu + prompt caching (tiết kiệm ~90% đầu vào) | ~$0.10 | $0.96 | ~$1.06 |
Đây là những ước tính mô hình hóa sử dụng mức giá mỗi token công khai và các giả định token đã nêu, một phép tính bạn có thể tái tạo, chứ không phải bài benchmark chúng tôi đã chạy. Thay số lượt và kích thước token của riêng bạn vào, cấu trúc vẫn đúng. Hãy tự tính: cùng một tác vụ agent đó tốn khoảng $1.92 trên Sonnet 5 giới thiệu so với $4.80 trên Opus 4.8 chuẩn, và bộ nhớ đệm có thể kéo lượt chạy Sonnet 5 xuống gần $1.06. Với một nghìn lượt chạy như vậy mỗi tháng, đó là chênh lệch giữa hóa đơn ~$1,900 và ~$4,800.
Chọn mô hình và tự đo chi phí của bạn
Bạn không cần phải tin các giả định của chúng tôi. Hãy hướng mô hình vào chính khối lượng công việc của bạn và đọc số token thực tế trả về. Trong Claude Code, hãy đặt mô hình bằng một cờ (flag) hoặc trong phần cài đặt dự án của bạn:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Trên Anthropic API, chuỗi mô hình cũng giống vậy, và mỗi phản hồi đều trả về cho bạn mức sử dụng token chính xác:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Nhân input_tokens với giá đầu vào của bạn, output_tokens với giá đầu ra, cộng dồn qua các lượt, và bạn có chi phí thực của tác vụ đó. Trường cache_read_input_tokens cho thấy bộ nhớ đệm thực sự đã tiết kiệm cho bạn bao nhiêu. Theo kinh nghiệm định tuyến mô hình cho khách hàng của chúng tôi, chi phí mỗi tác vụ mới là thứ làm thay đổi hóa đơn hàng tháng, chứ không phải mức giá mỗi token niêm yết, và cách trung thực duy nhất để biết nó là đọc đối tượng usage trên chính lưu lượng của bạn.
Khi nào Sonnet 5 là lựa chọn đúng (các trường hợp sử dụng thực tế)
Sonnet 5 là lựa chọn đúng cho công việc agentic và lập trình khối lượng lớn, nơi chi phí mỗi tác vụ quyết định hóa đơn, và đó chính là phần lớn công việc agent trong production. Chỉ tìm đến Opus 4.8 khi một bước sai duy nhất đủ đắt đỏ để biện minh cho mức giá cao cấp. Với mọi thứ lặp vòng, thử lại và gửi lại ngữ cảnh, mức giá tầm trung sẽ tích lũy lợi thế về phía bạn.
Những lựa chọn cụ thể:
- Agent lập trình. Các lần refactor đa tệp, tạo test và chạy gỡ lỗi ngốn token qua nhiều lượt, nên mức giá mỗi lượt thấp hơn quan trọng nhất ở đây. Xem bài tổng hợp của chúng tôi về các agent lập trình AI để biết nó phù hợp ở đâu.
- Tự động hóa trình duyệt và terminal. Những lượt chạy tự chủ kéo dài chính xác là thứ mà Anthropic xây dựng các nâng cấp agentic để phục vụ, và cũng chính là nơi chi phí cộng dồn.
- Các pipeline công việc tri thức. Các vòng lặp tóm tắt, trích xuất và nghiên cứu chạy ở quy mô lớn được hưởng lợi từ bộ nhớ đệm cộng với mức giá tầm trung.
- Agent phục vụ khách hàng. Khối lượng yêu cầu cao biến một khoản tiết kiệm nhỏ mỗi tác vụ thành một khoản tiết kiệm lớn hàng tháng.
Bạn có thể chạy nó ở đâu? Nó là mặc định trong Claude Code, khả dụng qua API và đang được triển khai trên các nền tảng lớn. Nếu bạn đang chọn công cụ, bài so sánh của chúng tôi về Cursor và Copilot với Claude Code sẽ bao quát những đánh đổi.
Sonnet 5 có tốt hơn Opus 4.8 không, và khi nào Opus vẫn đáng tiền?
Không, không "tốt hơn" theo chính cách diễn đạt của Anthropic. Anthropic nói Sonnet 5 "tiệm cận Opus 4.8," chứ không phải vượt qua nó. Chọn Sonnet 5 cho công việc agentic và lập trình khối lượng lớn, nhạy cảm về chi phí. Tìm đến Opus 4.8 cho những bài suy luận dài hạn khó nhất, nơi một bước sai là đắt đỏ và độ chính xác tăng thêm xứng đáng với mức giá cao cấp.
Một bảng tiêu chí nhanh:
- Vòng lặp agent khối lượng lớn, nhạy cảm chi phí? Sonnet 5.
- Suy luận khó nhất, độ chính xác một lần là tối quan trọng? Opus 4.8.
- Đang di chuyển từ Sonnet 4.6 và canh chừng ngân sách? Sonnet 5 (cùng mức giá chuẩn, mạnh hơn).
- Khối lượng công việc hỗn hợp? Định tuyến 90% phần dễ sang Sonnet 5 và chỉ đẩy những ca khó lên Opus.
Mô hình cuối đó chính là lúc một LLM gateway để định tuyến mô hình và kiểm soát chi phí phát huy giá trị. Về mặt cạnh tranh, một số trang tin nhận thấy Sonnet 5 có giá thấp hơn GPT-5.5 cho lập trình agentic, và Gemini 3.1 Pro cũng chơi ở cùng phân khúc. Hãy benchmark trên chính khối lượng công việc của bạn trước khi cam kết, vì chi phí mỗi tác vụ và độ phù hợp tác vụ hiếm khi khớp với những gì một bảng xếp hạng gợi ý.
Sonnet 5 không thay thế Opus 4.8. Nó thay thế việc dùng Opus 4.8 cho mọi thứ.
Claude Sonnet 5 KHÔNG giỏi việc gì? (những giới hạn thành thật)
Sonnet 5 là tầm trung, nên nó không phải lựa chọn cho suy luận cấp tiên phong, tự chủ dài hạn nhất, hay các tác vụ một lần đòi độ chính xác tối đa. Với những việc đó, Opus 4.8 vẫn là lựa chọn an toàn hơn. Toàn bộ đề xuất giá trị là "tiệm cận mô hình chủ lực với giá rẻ hơn," và từ "tiệm cận" đang gánh vác rất nhiều trong câu nói đó.
Một giới hạn cụ thể đáng biết: Anthropic cho biết Sonnet 5 có "khả năng thực hiện các tác vụ an ninh mạng thấp hơn nhiều so với các mô hình Opus hiện tại của chúng tôi," và lưu ý rằng nó chưa bao giờ tạo ra được một exploit hoạt động được trong quá trình kiểm thử lỗ hổng trên Firefox. Nếu công cụ bảo mật là trường hợp sử dụng của bạn, thì đó là một lựa chọn thiết kế có chủ đích, không phải lỗi, nhưng hãy lên kế hoạch xoay quanh nó.
Và đừng mặc định kích thước cửa sổ ngữ cảnh. Bài đăng ra mắt của Anthropic không nêu con số này, điều đó đưa chúng ta đến với các tin đồn.
Tin đồn "Fennec": Những gì thực sự được xác nhận (giải mã lời đồn)
Rất nhiều con số lan truyền về Sonnet 5 không đến từ Anthropic. Đây là ranh giới giữa thông tin ra mắt đã xác nhận và câu chuyện từ các bản rò rỉ, trong đó mỗi tin đồn đều được quy cho các trang tổng hợp và trang rò rỉ, chứ không phải bài đăng chính thức.
- Tên mã "Fennec". Chưa được xác nhận. Định danh đó rò rỉ từ một bản ghi (log) của Vertex AI nhiều tháng trước và trước đây tương ứng với Sonnet 4.6, không phải Sonnet 5. Anthropic không công bố tên mã nào.
- "Cửa sổ ngữ cảnh 1M token." Không được nêu ở bất kỳ đâu trong bài đăng ra mắt chính thức. Hãy coi mọi con số cụ thể về cửa sổ ngữ cảnh là chưa được xác minh cho đến khi Anthropic công bố.
- "82.1% / 92.4% SWE-bench." Những con số do các trang tổng hợp bịa ra. Chỉ trích dẫn số liệu từ bài đăng chính thức hoặc system card; bỏ qua phần còn lại.
- "Phát hành ngày 1 tháng 4," "huấn luyện trên TPU của Google," "Dev Team Mode." Sai hoặc chưa được xác nhận. Ngày ra mắt là 30 tháng 6 năm 2026, và không có tính năng hay tuyên bố nào trong số đó xuất hiện trong các tài liệu của Anthropic.
Anthropic chưa bao giờ công bố tên mã "Fennec" cho Sonnet 5. Định danh đó rò rỉ từ một bản ghi của Vertex AI nhiều tháng trước và chỉ đến một mô hình khác. Nếu một trang nào đó trích dẫn một benchmark chính xác mà không có liên kết đến system card, hãy coi đó là nhiễu.
Bạn có nên chuyển từ Sonnet 4.6 không? (phán quyết di chuyển)
Nếu bạn đang dùng Sonnet 4.6, việc chuyển sang Sonnet 5 có rủi ro thấp: bạn có được một mô hình mạnh hơn với cùng mức giá chuẩn ($3/$15), và giai đoạn giới thiệu ($2/$10 đến hết ngày 31 tháng 8) khiến việc thử nghiệm trở nên rẻ ngay lúc này. The New Stack nhận định rằng nó đang thu hẹp khoảng cách với Opus 4.8 trong khi vẫn giữ giá rẻ đến tháng 8, và đó là một cách đọc hợp lý cho các nhà phát triển đang cân nhắc di chuyển.
Một vài điểm cần lưu ý trước khi bạn chuyển lưu lượng production:
- Đổi chuỗi mô hình thành
claude-sonnet-5. Đó là thay đổi code duy nhất cần thiết cho hầu hết các thiết lập. - Kiểm tra lại mọi giả định về prompt hoặc đầu ra. Một mô hình mạnh hơn có thể thay đổi giọng điệu, độ dài dòng hay định dạng theo những cách ảnh hưởng đến các bước sau đó.
- Xác minh trên bộ eval của bạn trước. Đừng hoán đổi lưu lượng production chỉ bằng cảm tính.
- Chú ý đợt tăng giá ngày 31 tháng 8 nếu bạn lập ngân sách qua mùa hè.
Phán quyết: với cùng mức giá chuẩn như Sonnet 4.6 nhưng hiệu năng agentic tốt hơn, việc ở lại 4.6 mới là lựa chọn khó biện minh hơn. Hãy chuyển ngay để kịp mức giá giới thiệu, chỉ chờ nếu bạn có một chu kỳ eval đang đóng băng, và giữ Opus 4.8 dành riêng cho những tác vụ khó nhất. Nếu đội của bạn đang định tuyến mô hình và vật lộn với chi phí LLM trong production, chúng tôi cung cấp một buổi tư vấn miễn phí để vạch ra lộ trình.
Về tác giả
Mert Batur Gurbuz là Nhà đồng sáng lập của Techsy.io, nơi đội ngũ triển khai các agent AI, hệ thống tự động hóa và pipeline giọng nói/SDR cho khách hàng B2B. Anh theo học tại Đại học Birmingham và viết về bộ công cụ LLM mà đội Techsy thực sự sử dụng trong production. Kết nối trên LinkedIn.
Thông tin: Nhà đồng sáng lập, Techsy.io, Đại học Birmingham. Mức giá đã được xác minh đối chiếu với bài đăng ra mắt của Anthropic vào ngày 30-06-2026.
Câu hỏi thường gặp
Claude Sonnet 5 đã được phát hành chưa?
Rồi. Anthropic đã ra mắt Claude Sonnet 5 vào ngày 30 tháng 6 năm 2026, làm mô hình mặc định cho Claude Free và Pro, đồng thời cung cấp cho người dùng Max, Team và Enterprise. Bạn cũng có thể truy cập nó qua Anthropic API và Claude Code bằng chuỗi mô hình claude-sonnet-5.
Claude Sonnet 5 giá bao nhiêu?
Giá giới thiệu là $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra đến hết ngày 31 tháng 8 năm 2026. Sau đó, nó chuyển sang mức giá chuẩn $3 mỗi triệu đầu vào và $15 mỗi triệu đầu ra, cùng mức giá chuẩn như Sonnet 4.6 cho một mô hình mạnh hơn.
Claude Sonnet 5 có thực sự tốt hơn Opus 4.8 không?
Không, theo chính mô tả của Anthropic. Anthropic nói hiệu năng của Sonnet 5 "tiệm cận Opus 4.8," chứ không tốt hơn. Với những bài suy luận dài hạn khó nhất mà một bước sai duy nhất là tốn kém, Opus 4.8 vẫn là lựa chọn mạnh hơn. Sonnet 5 thắng ở chi phí mỗi tác vụ, chạy ở mức xấp xỉ một phần ba giá chuẩn của Opus.
Cửa sổ ngữ cảnh của Claude Sonnet 5 là bao nhiêu?
Bài đăng ra mắt của Anthropic không nêu kích thước cửa sổ ngữ cảnh. Những tuyên bố "1M token" lan truyền trên các trang tổng hợp là chưa được xác nhận và không đến từ Anthropic. Cho đến khi Anthropic công bố một con số chính thức, hãy coi mọi số liệu cụ thể về cửa sổ ngữ cảnh là chưa được xác minh.
Tôi sử dụng Claude Sonnet 5 như thế nào?
Đặt chuỗi mô hình thành claude-sonnet-5 trong Anthropic API, hoặc chọn nó trong Claude Code bằng claude --model claude-sonnet-5 hoặc trong phần cài đặt dự án của bạn. Nó cũng là mô hình mặc định cho Claude Free và Pro, nên không cần thiết lập gì ở đó. Hãy đọc đối tượng usage trong phản hồi để theo dõi chi phí token thực tế.
Claude Sonnet 5 có tên mã là "Fennec" không?
Không có xác nhận nào. "Fennec" là một định danh rò rỉ mà trước đây tương ứng với Sonnet 4.6, và Anthropic không công bố tên mã nào cho Sonnet 5. Định danh này xuất hiện trong một bản ghi của Vertex AI nhiều tháng trước lần ra mắt này, vì vậy hãy coi mọi tuyên bố "Fennec chính là Sonnet 5" là một tin đồn chưa được xác minh.
Tôi có nên chuyển từ Sonnet 4.6 sang Sonnet 5 không?
Có lẽ là có. Sonnet 5 chạy ở cùng mức giá chuẩn như Sonnet 4.6 ($3/$15) với hiệu năng agentic tốt hơn, và giai đoạn giới thiệu giúp việc thử nghiệm trở nên rẻ đến hết ngày 31 tháng 8. Hãy đổi chuỗi mô hình, xác minh trên bộ eval của bạn và kiểm tra hành vi trước khi hoán đổi lưu lượng production.
Sonnet 5 so với GPT-5.5 cho lập trình thì thế nào?
Sonnet 5 là lựa chọn lập trình agentic cạnh tranh về chi phí của Anthropic, và một số trang tin cho biết nó có giá thấp hơn GPT-5.5. Các so sánh về năng lực phụ thuộc vào khối lượng công việc, nên hãy benchmark cả hai trên chính codebase và tổ hợp tác vụ của bạn trước khi cam kết. Chi phí mỗi tác vụ và độ phù hợp tác vụ hiếm khi khớp với những gì một bảng xếp hạng đơn lẻ ngụ ý.
Tôi có thể chạy Claude Sonnet 5 trên AWS Bedrock không?
Anthropic cung cấp các mô hình Sonnet trên khắp các nền tảng đám mây lớn, nên khả năng khả dụng của claude-sonnet-5 trên Bedrock và Vertex sẽ theo sau khi quá trình triển khai hoàn tất. Hãy kiểm tra trạng thái nền tảng hiện tại cho khu vực của bạn, vì các lần ra mắt trong ngày thường đến với API của chính hãng và Claude Code trước mọi nền tảng bên thứ ba.
Làm thế nào để giảm chi phí Claude Sonnet 5?
Sử dụng prompt caching để tiết kiệm tới xấp xỉ 90% cho ngữ cảnh được tái sử dụng, và xử lý theo lô để tiết kiệm khoảng 50% cho các tác vụ không khẩn cấp. Chỉ định tuyến những tác vụ khó nhất sang Opus 4.8 và giữ công việc khối lượng lớn trên Sonnet 5. Đọc đối tượng usage để biết chính xác token của bạn đi đâu.