Techsy
Liên hệ
Bắt đầu
Quay lại Blog
ai-machine-learning

Claude Sonnet 5: Có gì mới và chi phí vận hành thực tế ra sao

Viết bởi Mert Batur Gürbüz
Cập nhật lần cuối Jun 30, 2026
22 phút đọc
Mục lục
Claude Sonnet 5: Có gì mới và chi phí vận hành thực tế ra sao

Claude Sonnet 5: Có gì mới và chi phí vận hành thực tế ra sao

Claude Sonnet 5 đã ra mắt hôm nay, ngày 30 tháng 6 năm 2026, và Anthropic định giá gói giới thiệu ở mức $2 cho mỗi triệu token đầu vào. Đó là nơi hầu hết các bài đưa tin dừng lại. Con số thực sự làm thay đổi hóa đơn của bạn lại khác: một lượt chạy agent trọn vẹn tốn bao nhiêu khi bạn cộng thêm token đầu ra và cả chục lượt hội thoại qua lại? Anthropic cho biết Sonnet 5 đạt mức "tiệm cận Opus 4.8" với giá chỉ bằng khoảng một phần ba. Vì vậy, câu hỏi thực sự không nằm ở bảng thông số. Mà là liệu chi phí hàng tháng cho agent của bạn có vừa giảm xuống hay không, và giảm bao nhiêu.

Điểm chính cần nhớ:

  • Claude Sonnet 5 ra mắt ngày 30 tháng 6 năm 2026, thay thế Sonnet 4.6 làm mô hình agentic tầm trung của Anthropic.
  • Giá giới thiệu là $2/triệu token đầu vào và $10/triệu token đầu ra đến hết ngày 31 tháng 8 năm 2026, sau đó là $3/$15.
  • Anthropic cho biết hiệu năng "tiệm cận Opus 4.8" với chi phí chỉ bằng khoảng một phần ba so với Opus.
  • Đây là mô hình mặc định cho Claude Free và Pro, đồng thời khả dụng qua API và Claude Code với tên claude-sonnet-5.

Claude Sonnet 5 là gì? (câu trả lời trong 30 giây)

Claude Sonnet 5 là mô hình tầm trung mới của Anthropic, ra mắt ngày 30 tháng 6 năm 2026, và được mô tả trong bài đăng ra mắt là phiên bản Sonnet agentic nhất từ trước đến nay. Nó có thể lập kế hoạch, sử dụng các công cụ như trình duyệt và terminal, rồi chạy tự chủ. Giá giới thiệu là $2/triệu token đầu vào và $10/triệu token đầu ra, và hiện nó là mô hình mặc định cho Claude Free và Pro.

Đúng vậy, nó đã được phát hành hôm nay, phòng khi bạn thấy sự nhầm lẫn kiểu "Claude Sonnet 5 đã ra mắt chưa?" đang lan truyền. Bạn chọn nó bằng chuỗi mô hình claude-sonnet-5 trong API hoặc trong Claude Code. Anthropic định vị nó là một bước tiến đáng kể so với Sonnet 4.6 và cho biết chất lượng nằm ở mức tiệm cận mô hình chủ lực của hãng, Opus 4.8, mà không mang mức giá của mô hình chủ lực.

Đây là canh bạc ẩn sau nó: Claude Sonnet 5 là lời khẳng định của Anthropic rằng phần lớn công việc agent không còn cần đến một mô hình tiên phong. Nếu điều đó đúng, câu chuyện thú vị không nằm ở bước nhảy vọt về năng lực. Mà là ở bài toán kinh tế.

Có gì mới so với Sonnet 4.6 và Opus 4.8

Anthropic gọi Sonnet 5 là "bước cải tiến đáng kể so với phiên bản tiền nhiệm, Sonnet 4.6" trên các mặt suy luận, sử dụng công cụ, lập trình và công việc tri thức, với hiệu năng "tiệm cận Opus 4.8, nhưng ở mức giá thấp hơn." Nó tự kiểm tra đầu ra của chính mình mà không cần được yêu cầu, và mạnh hơn ở khả năng lập trình kéo dài, gỡ lỗi và sử dụng công cụ đa bước. Đó là những cách diễn đạt của Anthropic, không phải số đo của chúng tôi.

Nâng cấp agentic

Thay đổi đáng chú ý nhất là tính tự chủ. Sonnet 5 được xây dựng để lập kế hoạch cho một tác vụ, cầm lên các công cụ như trình duyệt và terminal, rồi cày ải qua những lượt chạy dài mà không cần ai cầm tay chỉ việc. Như TechCrunch đưa tin (dẫn lời Anthropic), mô hình này được chào mời như một cách rẻ hơn để duy trì agent chạy liên tục, với những tín hiệu ban đầu từ các khách hàng như Zapier và Lovable. Đó chính là trường hợp sử dụng mà Anthropic đang theo đuổi: những agent lặp vòng trong nhiều phút hoặc nhiều giờ, nơi mỗi lượt đều tốn thêm token.

So sánh trên giấy tờ với Opus 4.8

Đây là phần quan trọng cho việc lập ngân sách. Khoảng cách về năng lực đã thu hẹp; còn khoảng cách về giá thì không.

Mô hìnhĐầu vào $/triệuĐầu ra $/triệuGiới thiệu so với chuẩnĐịnh vị
Claude Sonnet 5$2 (giới thiệu) → $3$10 (giới thiệu) → $15Giá giới thiệu đến hết 31/8/2026Tầm trung, Sonnet agentic nhất; "tiệm cận Opus 4.8" (Anthropic)
Claude Sonnet 4.6$3$15ChuẩnTầm trung trước đó (tháng 2/2026)
Claude Opus 4.8$5 ($10 Fast Mode)$25 ($50 Fast Mode)ChuẩnChủ lực; suy luận dài hạn khó nhất

Hãy chú ý rằng mức giá chuẩn của Sonnet 5 ($3/$15) giống hệt Sonnet 4.6. Bạn có được một mô hình mạnh hơn với cùng mức giá niêm yết. Và so với $5/$25 của Opus 4.8, Sonnet 5 chuẩn chạy ở mức xấp xỉ 60% giá đầu vào và giá đầu ra. Trong giai đoạn giới thiệu, nó còn rẻ hơn nữa. Anthropic chưa công bố con số nào nói rằng Sonnet 5 vượt Opus 4.8, nên đừng hiểu theo cách đó: tuyên bố chính thức là "tiệm cận", và chúng tôi giữ đúng cách hiểu đó.

Claude Sonnet 5 thực sự tốn bao nhiêu? (kinh tế học token)

Claude Sonnet 5 có giá $2/triệu token đầu vào và $10/triệu token đầu ra trong giai đoạn giới thiệu đến hết ngày 31 tháng 8 năm 2026, sau đó tăng lên $3/triệu đầu vào và $15/triệu đầu ra. Mức giá chuẩn đó ngang bằng Sonnet 4.6 cho một mô hình mạnh hơn, và chỉ bằng khoảng một phần ba mức giá chuẩn của Opus 4.8 ($5/$25). Với khối lượng công việc agent lớn, tỷ lệ đó chính là toàn bộ câu chuyện.

Vậy "mỗi triệu token" thực sự có ý nghĩa gì với bạn? Một token xấp xỉ ba phần tư của một từ. Một triệu token là rất nhiều văn bản, có thể khoảng 750.000 từ, nhưng các agent đốt chúng rất nhanh vì mỗi lượt đều gửi lại ngữ cảnh: system prompt, các tin nhắn trước đó, nội dung tệp, đầu ra của công cụ. Chỉ một lần refactor đa tệp cũng có thể ngốn hàng trăm nghìn token đầu vào trước khi hoàn tất.

Giai đoạn giới thiệu đó là một điểm quyết định thực sự. Cho đến ngày 31 tháng 8, bạn trả $2/$10. Sau đó là $3/$15. Dù sao thì nếu bạn định thử Sonnet 5, làm điều đó ngay bây giờ đồng nghĩa các bài eval của bạn chạy ở mức giá ưu đãi, và bạn tạo được thói quen khi bài toán kinh tế đang có lợi nhất. Mặt trái: đừng xây dựng ngân sách trên mức giá giới thiệu mà bạn sẽ mất sau hai tháng nữa.

Có hai tính năng nền tảng làm thay đổi hóa đơn thực tế nhiều hơn cả mức giá tiêu đề. Bộ nhớ đệm prompt (prompt caching) cho phép bạn tái sử dụng ngữ cảnh đã đệm thay vì trả đủ giá đầu vào ở mỗi lượt, giúp tiết kiệm tới xấp xỉ 90% cho phần được đệm. Xử lý theo lô (batch processing) cắt giảm khoảng 50% chi phí cho các tác vụ không khẩn cấp mà bạn có thể chạy bất đồng bộ. Cả hai đều được ghi trong bảng giá nền tảng của Anthropic. Nếu agent của bạn gửi lại cùng một system prompt lớn hoặc cả codebase ở mỗi lượt, prompt caching là đòn bẩy lớn nhất bạn có để giảm chi phí. Chúng tôi đi sâu vào nhiều chiến thuật hơn trong bài hướng dẫn về cách cắt giảm chi phí API LLM.

Hiệu năng tìm kiếm agentic của Claude Sonnet 5 so với chi phí mỗi tác vụ trên BrowseComp, đối chiếu với Opus 4.8 và Sonnet 4.6
Hiệu năng tìm kiếm agentic so với chi phí mỗi tác vụ (BrowseComp): Sonnet 5 tiến gần đến độ chính xác của Opus 4.8 với chi phí chỉ bằng một phần nhỏ. Nguồn: Anthropic

Với $2 cho mỗi triệu token đầu vào, Sonnet 5 khiến các vòng lặp agent khối lượng lớn đủ rẻ để cứ để chạy liên tục. Đó chính là sự chuyển dịch. Câu hỏi không còn là "tôi có đủ khả năng chạy agent này không?" mà là "tôi có thể chạy bao nhiêu agent cùng lúc?"

Một lượt chạy agent Sonnet 5 thực tế tốn bao nhiêu (có thể tái tạo)

Hãy đặt một con số cụ thể. Chúng tôi không chạy một bài benchmark trong phòng thí nghiệm, và cũng không giả vờ là mình đã làm. Những gì sau đây là một phép tính minh bạch mà bạn có thể tái tạo với số token của chính mình, sử dụng mức giá mỗi token đã công bố của Anthropic. Nêu rõ các giả định, làm phép toán, và hóa đơn sẽ hiện ra.

Phép tính cụ thể

Lấy một tác vụ agent thực tế: một lần refactor đa tệp chạy khoảng 12 lượt. Giả sử mỗi lượt có khoảng 40K token đầu vào và 8K token đầu ra (tắt bộ nhớ đệm), vì mỗi lượt đều gửi lại ngữ cảnh ngày càng lớn. Tổng cộng là khoảng 480K token đầu vào và 96K token đầu ra. Giờ đến phép toán:

  • Sonnet 5 giới thiệu: (0.48M × $2) + (0.096M × $10) = $0.96 + $0.96 = $1.92
  • Sonnet 5 chuẩn: (0.48M × $3) + (0.096M × $15) = $1.44 + $1.44 = $2.88
  • Opus 4.8 chuẩn: (0.48M × $5) + (0.096M × $25) = $2.40 + $2.40 = $4.80

Giờ bật prompt caching lên. Nếu phần lớn trong 480K đầu vào đó là ngữ cảnh được tái sử dụng (system prompt, cây thư mục tệp, các lượt trước) và bạn đạt gần mức tiết kiệm ~90% như tài liệu ghi nhận cho phần được đệm, thì phần đầu vào giảm từ khoảng $0.96 xuống xấp xỉ $0.10, trong khi đầu ra vẫn giữ ở $0.96.

Kịch bản (12 lượt, ~480K vào / ~96K ra, tắt bộ nhớ đệm trừ khi ghi chú)Chi phí đầu vàoChi phí đầu raTổng
Sonnet 5 giới thiệu ($2/$10)$0.96$0.96$1.92
Sonnet 5 chuẩn ($3/$15)$1.44$1.44$2.88
Opus 4.8 chuẩn ($5/$25)$2.40$2.40$4.80
Sonnet 5 giới thiệu + prompt caching (tiết kiệm ~90% đầu vào)~$0.10$0.96~$1.06

Đây là những ước tính mô hình hóa sử dụng mức giá mỗi token công khai và các giả định token đã nêu, một phép tính bạn có thể tái tạo, chứ không phải bài benchmark chúng tôi đã chạy. Thay số lượt và kích thước token của riêng bạn vào, cấu trúc vẫn đúng. Hãy tự tính: cùng một tác vụ agent đó tốn khoảng $1.92 trên Sonnet 5 giới thiệu so với $4.80 trên Opus 4.8 chuẩn, và bộ nhớ đệm có thể kéo lượt chạy Sonnet 5 xuống gần $1.06. Với một nghìn lượt chạy như vậy mỗi tháng, đó là chênh lệch giữa hóa đơn ~$1,900 và ~$4,800.

Chọn mô hình và tự đo chi phí của bạn

Bạn không cần phải tin các giả định của chúng tôi. Hãy hướng mô hình vào chính khối lượng công việc của bạn và đọc số token thực tế trả về. Trong Claude Code, hãy đặt mô hình bằng một cờ (flag) hoặc trong phần cài đặt dự án của bạn:

bash
# One-off
claude --model claude-sonnet-5

# Or pin it in .claude/settings.json
{
  "model": "claude-sonnet-5"
}

Trên Anthropic API, chuỗi mô hình cũng giống vậy, và mỗi phản hồi đều trả về cho bạn mức sử dụng token chính xác:

python
import anthropic

client = anthropic.Anthropic()

resp = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)

# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)

Nhân input_tokens với giá đầu vào của bạn, output_tokens với giá đầu ra, cộng dồn qua các lượt, và bạn có chi phí thực của tác vụ đó. Trường cache_read_input_tokens cho thấy bộ nhớ đệm thực sự đã tiết kiệm cho bạn bao nhiêu. Theo kinh nghiệm định tuyến mô hình cho khách hàng của chúng tôi, chi phí mỗi tác vụ mới là thứ làm thay đổi hóa đơn hàng tháng, chứ không phải mức giá mỗi token niêm yết, và cách trung thực duy nhất để biết nó là đọc đối tượng usage trên chính lưu lượng của bạn.

Khi nào Sonnet 5 là lựa chọn đúng (các trường hợp sử dụng thực tế)

Sonnet 5 là lựa chọn đúng cho công việc agentic và lập trình khối lượng lớn, nơi chi phí mỗi tác vụ quyết định hóa đơn, và đó chính là phần lớn công việc agent trong production. Chỉ tìm đến Opus 4.8 khi một bước sai duy nhất đủ đắt đỏ để biện minh cho mức giá cao cấp. Với mọi thứ lặp vòng, thử lại và gửi lại ngữ cảnh, mức giá tầm trung sẽ tích lũy lợi thế về phía bạn.

Những lựa chọn cụ thể:

  • Agent lập trình. Các lần refactor đa tệp, tạo test và chạy gỡ lỗi ngốn token qua nhiều lượt, nên mức giá mỗi lượt thấp hơn quan trọng nhất ở đây. Xem bài tổng hợp của chúng tôi về các agent lập trình AI để biết nó phù hợp ở đâu.
  • Tự động hóa trình duyệt và terminal. Những lượt chạy tự chủ kéo dài chính xác là thứ mà Anthropic xây dựng các nâng cấp agentic để phục vụ, và cũng chính là nơi chi phí cộng dồn.
  • Các pipeline công việc tri thức. Các vòng lặp tóm tắt, trích xuất và nghiên cứu chạy ở quy mô lớn được hưởng lợi từ bộ nhớ đệm cộng với mức giá tầm trung.
  • Agent phục vụ khách hàng. Khối lượng yêu cầu cao biến một khoản tiết kiệm nhỏ mỗi tác vụ thành một khoản tiết kiệm lớn hàng tháng.

Bạn có thể chạy nó ở đâu? Nó là mặc định trong Claude Code, khả dụng qua API và đang được triển khai trên các nền tảng lớn. Nếu bạn đang chọn công cụ, bài so sánh của chúng tôi về Cursor và Copilot với Claude Code sẽ bao quát những đánh đổi.

Sonnet 5 có tốt hơn Opus 4.8 không, và khi nào Opus vẫn đáng tiền?

Không, không "tốt hơn" theo chính cách diễn đạt của Anthropic. Anthropic nói Sonnet 5 "tiệm cận Opus 4.8," chứ không phải vượt qua nó. Chọn Sonnet 5 cho công việc agentic và lập trình khối lượng lớn, nhạy cảm về chi phí. Tìm đến Opus 4.8 cho những bài suy luận dài hạn khó nhất, nơi một bước sai là đắt đỏ và độ chính xác tăng thêm xứng đáng với mức giá cao cấp.

Một bảng tiêu chí nhanh:

  • Vòng lặp agent khối lượng lớn, nhạy cảm chi phí? Sonnet 5.
  • Suy luận khó nhất, độ chính xác một lần là tối quan trọng? Opus 4.8.
  • Đang di chuyển từ Sonnet 4.6 và canh chừng ngân sách? Sonnet 5 (cùng mức giá chuẩn, mạnh hơn).
  • Khối lượng công việc hỗn hợp? Định tuyến 90% phần dễ sang Sonnet 5 và chỉ đẩy những ca khó lên Opus.

Mô hình cuối đó chính là lúc một LLM gateway để định tuyến mô hình và kiểm soát chi phí phát huy giá trị. Về mặt cạnh tranh, một số trang tin nhận thấy Sonnet 5 có giá thấp hơn GPT-5.5 cho lập trình agentic, và Gemini 3.1 Pro cũng chơi ở cùng phân khúc. Hãy benchmark trên chính khối lượng công việc của bạn trước khi cam kết, vì chi phí mỗi tác vụ và độ phù hợp tác vụ hiếm khi khớp với những gì một bảng xếp hạng gợi ý.

Sonnet 5 không thay thế Opus 4.8. Nó thay thế việc dùng Opus 4.8 cho mọi thứ.

Claude Sonnet 5 KHÔNG giỏi việc gì? (những giới hạn thành thật)

Sonnet 5 là tầm trung, nên nó không phải lựa chọn cho suy luận cấp tiên phong, tự chủ dài hạn nhất, hay các tác vụ một lần đòi độ chính xác tối đa. Với những việc đó, Opus 4.8 vẫn là lựa chọn an toàn hơn. Toàn bộ đề xuất giá trị là "tiệm cận mô hình chủ lực với giá rẻ hơn," và từ "tiệm cận" đang gánh vác rất nhiều trong câu nói đó.

Một giới hạn cụ thể đáng biết: Anthropic cho biết Sonnet 5 có "khả năng thực hiện các tác vụ an ninh mạng thấp hơn nhiều so với các mô hình Opus hiện tại của chúng tôi," và lưu ý rằng nó chưa bao giờ tạo ra được một exploit hoạt động được trong quá trình kiểm thử lỗ hổng trên Firefox. Nếu công cụ bảo mật là trường hợp sử dụng của bạn, thì đó là một lựa chọn thiết kế có chủ đích, không phải lỗi, nhưng hãy lên kế hoạch xoay quanh nó.

Và đừng mặc định kích thước cửa sổ ngữ cảnh. Bài đăng ra mắt của Anthropic không nêu con số này, điều đó đưa chúng ta đến với các tin đồn.

Tin đồn "Fennec": Những gì thực sự được xác nhận (giải mã lời đồn)

Rất nhiều con số lan truyền về Sonnet 5 không đến từ Anthropic. Đây là ranh giới giữa thông tin ra mắt đã xác nhận và câu chuyện từ các bản rò rỉ, trong đó mỗi tin đồn đều được quy cho các trang tổng hợp và trang rò rỉ, chứ không phải bài đăng chính thức.

  • Tên mã "Fennec". Chưa được xác nhận. Định danh đó rò rỉ từ một bản ghi (log) của Vertex AI nhiều tháng trước và trước đây tương ứng với Sonnet 4.6, không phải Sonnet 5. Anthropic không công bố tên mã nào.
  • "Cửa sổ ngữ cảnh 1M token." Không được nêu ở bất kỳ đâu trong bài đăng ra mắt chính thức. Hãy coi mọi con số cụ thể về cửa sổ ngữ cảnh là chưa được xác minh cho đến khi Anthropic công bố.
  • "82.1% / 92.4% SWE-bench." Những con số do các trang tổng hợp bịa ra. Chỉ trích dẫn số liệu từ bài đăng chính thức hoặc system card; bỏ qua phần còn lại.
  • "Phát hành ngày 1 tháng 4," "huấn luyện trên TPU của Google," "Dev Team Mode." Sai hoặc chưa được xác nhận. Ngày ra mắt là 30 tháng 6 năm 2026, và không có tính năng hay tuyên bố nào trong số đó xuất hiện trong các tài liệu của Anthropic.

Anthropic chưa bao giờ công bố tên mã "Fennec" cho Sonnet 5. Định danh đó rò rỉ từ một bản ghi của Vertex AI nhiều tháng trước và chỉ đến một mô hình khác. Nếu một trang nào đó trích dẫn một benchmark chính xác mà không có liên kết đến system card, hãy coi đó là nhiễu.

Bạn có nên chuyển từ Sonnet 4.6 không? (phán quyết di chuyển)

Nếu bạn đang dùng Sonnet 4.6, việc chuyển sang Sonnet 5 có rủi ro thấp: bạn có được một mô hình mạnh hơn với cùng mức giá chuẩn ($3/$15), và giai đoạn giới thiệu ($2/$10 đến hết ngày 31 tháng 8) khiến việc thử nghiệm trở nên rẻ ngay lúc này. The New Stack nhận định rằng nó đang thu hẹp khoảng cách với Opus 4.8 trong khi vẫn giữ giá rẻ đến tháng 8, và đó là một cách đọc hợp lý cho các nhà phát triển đang cân nhắc di chuyển.

Một vài điểm cần lưu ý trước khi bạn chuyển lưu lượng production:

  • Đổi chuỗi mô hình thành claude-sonnet-5. Đó là thay đổi code duy nhất cần thiết cho hầu hết các thiết lập.
  • Kiểm tra lại mọi giả định về prompt hoặc đầu ra. Một mô hình mạnh hơn có thể thay đổi giọng điệu, độ dài dòng hay định dạng theo những cách ảnh hưởng đến các bước sau đó.
  • Xác minh trên bộ eval của bạn trước. Đừng hoán đổi lưu lượng production chỉ bằng cảm tính.
  • Chú ý đợt tăng giá ngày 31 tháng 8 nếu bạn lập ngân sách qua mùa hè.

Phán quyết: với cùng mức giá chuẩn như Sonnet 4.6 nhưng hiệu năng agentic tốt hơn, việc ở lại 4.6 mới là lựa chọn khó biện minh hơn. Hãy chuyển ngay để kịp mức giá giới thiệu, chỉ chờ nếu bạn có một chu kỳ eval đang đóng băng, và giữ Opus 4.8 dành riêng cho những tác vụ khó nhất. Nếu đội của bạn đang định tuyến mô hình và vật lộn với chi phí LLM trong production, chúng tôi cung cấp một buổi tư vấn miễn phí để vạch ra lộ trình.

Về tác giả

Mert Batur Gurbuz là Nhà đồng sáng lập của Techsy.io, nơi đội ngũ triển khai các agent AI, hệ thống tự động hóa và pipeline giọng nói/SDR cho khách hàng B2B. Anh theo học tại Đại học Birmingham và viết về bộ công cụ LLM mà đội Techsy thực sự sử dụng trong production. Kết nối trên LinkedIn.

Thông tin: Nhà đồng sáng lập, Techsy.io, Đại học Birmingham. Mức giá đã được xác minh đối chiếu với bài đăng ra mắt của Anthropic vào ngày 30-06-2026.

Câu hỏi thường gặp

Claude Sonnet 5 đã được phát hành chưa?

Rồi. Anthropic đã ra mắt Claude Sonnet 5 vào ngày 30 tháng 6 năm 2026, làm mô hình mặc định cho Claude Free và Pro, đồng thời cung cấp cho người dùng Max, Team và Enterprise. Bạn cũng có thể truy cập nó qua Anthropic API và Claude Code bằng chuỗi mô hình claude-sonnet-5.

Claude Sonnet 5 giá bao nhiêu?

Giá giới thiệu là $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra đến hết ngày 31 tháng 8 năm 2026. Sau đó, nó chuyển sang mức giá chuẩn $3 mỗi triệu đầu vào và $15 mỗi triệu đầu ra, cùng mức giá chuẩn như Sonnet 4.6 cho một mô hình mạnh hơn.

Claude Sonnet 5 có thực sự tốt hơn Opus 4.8 không?

Không, theo chính mô tả của Anthropic. Anthropic nói hiệu năng của Sonnet 5 "tiệm cận Opus 4.8," chứ không tốt hơn. Với những bài suy luận dài hạn khó nhất mà một bước sai duy nhất là tốn kém, Opus 4.8 vẫn là lựa chọn mạnh hơn. Sonnet 5 thắng ở chi phí mỗi tác vụ, chạy ở mức xấp xỉ một phần ba giá chuẩn của Opus.

Cửa sổ ngữ cảnh của Claude Sonnet 5 là bao nhiêu?

Bài đăng ra mắt của Anthropic không nêu kích thước cửa sổ ngữ cảnh. Những tuyên bố "1M token" lan truyền trên các trang tổng hợp là chưa được xác nhận và không đến từ Anthropic. Cho đến khi Anthropic công bố một con số chính thức, hãy coi mọi số liệu cụ thể về cửa sổ ngữ cảnh là chưa được xác minh.

Tôi sử dụng Claude Sonnet 5 như thế nào?

Đặt chuỗi mô hình thành claude-sonnet-5 trong Anthropic API, hoặc chọn nó trong Claude Code bằng claude --model claude-sonnet-5 hoặc trong phần cài đặt dự án của bạn. Nó cũng là mô hình mặc định cho Claude Free và Pro, nên không cần thiết lập gì ở đó. Hãy đọc đối tượng usage trong phản hồi để theo dõi chi phí token thực tế.

Claude Sonnet 5 có tên mã là "Fennec" không?

Không có xác nhận nào. "Fennec" là một định danh rò rỉ mà trước đây tương ứng với Sonnet 4.6, và Anthropic không công bố tên mã nào cho Sonnet 5. Định danh này xuất hiện trong một bản ghi của Vertex AI nhiều tháng trước lần ra mắt này, vì vậy hãy coi mọi tuyên bố "Fennec chính là Sonnet 5" là một tin đồn chưa được xác minh.

Tôi có nên chuyển từ Sonnet 4.6 sang Sonnet 5 không?

Có lẽ là có. Sonnet 5 chạy ở cùng mức giá chuẩn như Sonnet 4.6 ($3/$15) với hiệu năng agentic tốt hơn, và giai đoạn giới thiệu giúp việc thử nghiệm trở nên rẻ đến hết ngày 31 tháng 8. Hãy đổi chuỗi mô hình, xác minh trên bộ eval của bạn và kiểm tra hành vi trước khi hoán đổi lưu lượng production.

Sonnet 5 so với GPT-5.5 cho lập trình thì thế nào?

Sonnet 5 là lựa chọn lập trình agentic cạnh tranh về chi phí của Anthropic, và một số trang tin cho biết nó có giá thấp hơn GPT-5.5. Các so sánh về năng lực phụ thuộc vào khối lượng công việc, nên hãy benchmark cả hai trên chính codebase và tổ hợp tác vụ của bạn trước khi cam kết. Chi phí mỗi tác vụ và độ phù hợp tác vụ hiếm khi khớp với những gì một bảng xếp hạng đơn lẻ ngụ ý.

Tôi có thể chạy Claude Sonnet 5 trên AWS Bedrock không?

Anthropic cung cấp các mô hình Sonnet trên khắp các nền tảng đám mây lớn, nên khả năng khả dụng của claude-sonnet-5 trên Bedrock và Vertex sẽ theo sau khi quá trình triển khai hoàn tất. Hãy kiểm tra trạng thái nền tảng hiện tại cho khu vực của bạn, vì các lần ra mắt trong ngày thường đến với API của chính hãng và Claude Code trước mọi nền tảng bên thứ ba.

Làm thế nào để giảm chi phí Claude Sonnet 5?

Sử dụng prompt caching để tiết kiệm tới xấp xỉ 90% cho ngữ cảnh được tái sử dụng, và xử lý theo lô để tiết kiệm khoảng 50% cho các tác vụ không khẩn cấp. Chỉ định tuyến những tác vụ khó nhất sang Opus 4.8 và giữ công việc khối lượng lớn trên Sonnet 5. Đọc đối tượng usage để biết chính xác token của bạn đi đâu.

Thẻ

claude sonnet 5giá claude sonnet 5claude sonnet 5 vs opus 4.8chi phí llmanthropic

Chia sẻ bài viết này

Bài viết liên quan

Thêm từ chuyên mục ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 Đã Ra Mắt: Trí Tuệ Gần Bằng Fable 5 Với Nửa Giá

Anthropic đã phát hành Claude Opus 5 vào ngày 24 tháng 7 năm 2026. Nó đạt điểm cao hơn gấp đôi Opus 4.8 trên Frontier-Bench và giữ nguyên mức giá của Opus, nhưng lại thua Fable 5 và Mythos 5 ở một vài bài kiểm tra. Dưới đây là bảng benchmark, mức giá và khuyến nghị nên chuyển đổi, chờ đợi hay giữ nguyên.

10 min read phút đọc
Đọc
ai-machine-learning
Jul 20, 2026

8 API Web Scraping AI Tốt Nhất Năm 2026 (Đã Kiểm Thử Trên Chính Agent Stack Của Chúng Tôi)

Chúng tôi đã kiểm thử 8 API web scraping AI với mức giá thực tế năm 2026 được kéo qua chính agent stack của mình. Firecrawl, Bright Data, ScrapingBee và 5 công cụ khác, xếp hạng theo đầu ra sẵn sàng cho LLM, khả năng vượt anti-bot và hỗ trợ MCP.

9 min read phút đọc
Đọc
ai-machine-learning
Jul 20, 2026

Kỹ thuật Prompt cho Lập trình: 7 Mẫu Chúng Tôi Dùng Hàng Ngày trong Claude Code và Cursor (2026)

Hầu hết các bài viết về 'prompt lập trình AI' chỉ đưa cho bạn 50 mẫu để sao chép. Bài này dạy 7 mẫu chúng tôi dùng mỗi ngày để vận hành quy trình Claude Code gồm 16 agent, với ví dụ thực tế trước-và-sau cho từng mẫu, cùng vị trí áp dụng từng mẫu trong Claude Code, Cursor và Copilot năm 2026.

11 min read phút đọc
Đọc
Xem tất cả bài viết
Khởi động dự án của bạn

Sẵn sàng tạo nên điều gì đó đột phá?

Hãy biến tầm nhìn của bạn thành hiện thực. Đội ngũ của chúng tôi sẵn sàng đồng hành cùng bạn tạo ra phần mềm tạo nên sự khác biệt.

Đặt lịch gọi ý tưởng 30 phútXem dự án của chúng tôi

Công cụ hot trong kho

Claude Skills

Xem tất cả
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tự động hoá AI

Xem tất cả
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Công cụ hot trong kho

Claude Skills

Xem tất cả
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tự động hoá AI

Xem tất cả
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Dịch vụ

  • Giải pháp doanh nghiệp
  • Ứng dụng di động
  • Ứng dụng web

Giải pháp

  • Hệ thống CRM
  • Tích hợp AI
  • Giải pháp ERP
  • Voice Agent
  • Tự động hóa quy trình
  • Bảo mật thông tin

Thư viện

  • Blog
  • Dự án

Cộng đồng

  • Tự động hoá AI
  • Claude Skills

Công cụ

  • Tính phí làm ứng dụng mobile
  • Tính phí dùng OpenAI / LLM API
  • Tính phí làm MVP
  • Tính phí làm Voice AI Agent

Công ty

  • Giới thiệu
  • Cộng sự
  • Liên hệ

Pháp lý

  • Chính sách quyền riêng tư
  • Điều khoản dịch vụ
  • Chính sách cookie

Dịch vụ

  • Giải pháp doanh nghiệp
  • Ứng dụng di động
  • Ứng dụng web

Giải pháp

  • Hệ thống CRM
  • Tích hợp AI
  • Giải pháp ERP
  • Voice Agent
  • Tự động hóa quy trình
  • Bảo mật thông tin

Thư viện

  • Blog
  • Dự án

Cộng đồng

  • Tự động hoá AI
  • Claude Skills

Công cụ

  • Tính phí làm ứng dụng mobile
  • Tính phí dùng OpenAI / LLM API
  • Tính phí làm MVP
  • Tính phí làm Voice AI Agent

Công ty

  • Giới thiệu
  • Cộng sự
  • Liên hệ
Pháp lýChính sách quyền riêng tưĐiều khoản dịch vụChính sách cookie
TECHSY
© 2026 Techsy. Bảo lưu mọi quyền.