
Claude Sonnet 5: Yang Baru, dan Berapa Biaya Menjalankannya
Claude Sonnet 5 hadir hari ini, 30 Juni 2026, dan Anthropic mematok harga tier intro di $2 per juta token input. Di situlah kebanyakan liputan berhenti. Angka yang benar-benar menggerakkan tagihan Anda berbeda: berapa biaya satu kali jalan agent penuh setelah Anda menambahkan token output dan selusin giliran bolak-balik? Anthropic mengatakan Sonnet 5 "mendekati Opus 4.8" dengan harga sekitar sepertiganya. Jadi pertanyaan sebenarnya bukanlah lembar spesifikasi. Pertanyaannya adalah apakah biaya bulanan agent Anda baru saja turun, dan seberapa besar.
Poin-poin penting:
- Claude Sonnet 5 diluncurkan 30 Juni 2026, menggantikan Sonnet 4.6 sebagai model agentik menengah Anthropic.
- Harga intro adalah $2/juta input dan $10/juta output hingga 31 Agustus 2026, lalu $3/$15.
- Anthropic menyebut performanya "mendekati Opus 4.8" dengan biaya sekitar sepertiga biaya Opus.
- Ini menjadi default untuk Claude Free dan Pro, dan tersedia melalui API serta Claude Code sebagai
claude-sonnet-5.
Apa Itu Claude Sonnet 5? (jawaban 30 detik)
Claude Sonnet 5 adalah model menengah baru Anthropic, diluncurkan 30 Juni 2026, dan digambarkan dalam posting peluncurannya sebagai Sonnet paling agentik sejauh ini. Ia bisa membuat rencana, menggunakan tool seperti browser dan terminal, dan berjalan secara otonom. Harga intro adalah $2/juta input dan $10/juta output, dan kini menjadi default untuk Claude Free dan Pro.
Ya, ini dirilis hari ini, kalau-kalau Anda pernah melihat kebingungan "apakah Claude Sonnet 5 sudah dirilis?" yang beredar. Anda memilihnya dengan string model claude-sonnet-5 di API atau di Claude Code. Anthropic memposisikannya sebagai langkah berarti di atas Sonnet 4.6 dan menyebut kualitasnya mendekati unggulan mereka, Opus 4.8, tanpa harga unggulan.
Inilah taruhan di baliknya: Claude Sonnet 5 adalah pertaruhan Anthropic bahwa sebagian besar pekerjaan agent tak lagi membutuhkan model frontier. Jika itu benar, cerita menariknya bukanlah lonjakan kemampuan. Melainkan ekonominya.
Yang Baru vs Sonnet 4.6 dan Opus 4.8
Anthropic menyebut Sonnet 5 sebagai "peningkatan substansial dibanding pendahulunya, Sonnet 4.6" di penalaran, penggunaan tool, pengkodean, dan pekerjaan pengetahuan, dengan performa "mendekati Opus 4.8, namun dengan harga lebih rendah." Ia memeriksa outputnya sendiri tanpa diminta, dan lebih kuat dalam pengkodean berkelanjutan, debugging, dan penggunaan tool multi-langkah. Itu semua framing Anthropic, bukan pengukuran kami.
Peningkatan agentik
Perubahan utamanya adalah otonomi. Sonnet 5 dibangun untuk merencanakan tugas, mengambil tool seperti browser dan terminal, dan menuntaskan proses panjang tanpa pendampingan. Seperti dilaporkan TechCrunch (mengutip Anthropic), model ini diposisikan sebagai cara lebih murah untuk menjaga agent tetap berjalan, dengan sinyal awal dari pelanggan seperti tim Zapier dan Lovable. Itulah kasus penggunaan yang dikejar Anthropic: agent yang berputar selama bermenit-menit atau berjam-jam, di mana setiap giliran menambah token.
Perbandingannya dengan Opus 4.8 di atas kertas
Inilah bagian yang penting untuk penganggaran. Kesenjangan kemampuan menyempit; kesenjangan harga tidak.
| Model | Input $/juta | Output $/juta | Intro vs standar | Posisi |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro hingga 31 Agu 2026 | Menengah, Sonnet paling agentik; "mendekati Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standar | Menengah sebelumnya (Feb 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standar | Unggulan; penalaran jangka panjang tersulit |
Perhatikan bahwa harga standar Sonnet 5 ($3/$15) identik dengan Sonnet 4.6. Anda mendapat model lebih mampu dengan harga label sama. Dan dibanding $5/$25 milik Opus 4.8, Sonnet 5 standar berjalan di sekitar 60% dari tarif input dan tarif output. Selama jendela intro, harganya bahkan lebih murah. Anthropic belum mempublikasikan angka yang menyebut Sonnet 5 mengalahkan Opus 4.8, jadi jangan membacanya begitu: pernyataan resminya adalah "mendekati," dan kami berpegang pada itu.
Berapa Biaya Claude Sonnet 5 Sebenarnya? (ekonomi token)
Claude Sonnet 5 berharga $2/juta input dan $10/juta output selama jendela intro hingga 31 Agustus 2026, lalu naik menjadi $3/juta input dan $15/juta output. Harga standar itu setara Sonnet 4.6 untuk model yang lebih kuat, dan berada di sekitar sepertiga tarif standar Opus 4.8 ($5/$25). Untuk pekerjaan agent bervolume tinggi, rasio itulah seluruh ceritanya.
Jadi apa arti "per juta token" sebenarnya bagi Anda? Satu token kira-kira tiga perempat kata. Satu juta token itu banyak teks, mungkin 750.000 kata, tetapi agent menghabisinya dengan cepat karena setiap giliran mengirim ulang konteks: prompt sistem, pesan sebelumnya, isi file, output tool. Satu refactor multi-file bisa mengunyah ratusan ribu token input sebelum selesai.
Jendela intro itu adalah titik keputusan nyata. Hingga 31 Agustus, Anda membayar $2/$10. Setelah itu, $3/$15. Jika Anda memang akan menguji Sonnet 5, melakukannya sekarang berarti eval Anda berjalan dengan diskon, dan Anda mengunci kebiasaan selagi perhitungannya paling menguntungkan. Sisi sebaliknya: jangan membangun anggaran di atas harga intro yang akan hilang dalam dua bulan.
Dua fitur platform mengubah tagihan nyata lebih dari tarif utama. Prompt caching memungkinkan Anda menggunakan ulang konteks yang di-cache alih-alih membayar harga input penuh di setiap giliran, dengan penghematan hingga sekitar 90% pada bagian yang di-cache. Pemrosesan batch memangkas biaya sekitar 50% untuk pekerjaan tidak mendesak yang bisa dijalankan secara asinkron. Keduanya didokumentasikan di harga platform Anthropic. Jika agent Anda mengirim ulang prompt sistem atau codebase besar yang sama di setiap giliran, prompt caching adalah tuas terbesar yang Anda miliki untuk biaya. Kami membahas lebih banyak taktik di panduan kami tentang memangkas biaya API LLM.

Di $2 per juta token input, Sonnet 5 membuat putaran agent bervolume tinggi cukup murah untuk dibiarkan berjalan. Itulah pergeserannya. Pertanyaannya bukan lagi "mampukah saya menjalankan agent ini?" tetapi "berapa banyak yang bisa saya jalankan sekaligus?"
Berapa Biaya Satu Kali Jalan Agent Sonnet 5 Sebenarnya (dapat direproduksi)
Mari kita beri angka. Kami tidak menjalankan benchmark lab, dan kami tidak akan berpura-pura melakukannya. Yang berikut adalah perhitungan transparan yang dapat Anda reproduksi dengan jumlah token Anda sendiri, menggunakan tarif per token yang dipublikasikan Anthropic. Nyatakan asumsi Anda, lakukan aritmetika, dan tagihannya keluar.
Perhitungan terperinci
Ambil tugas agent yang realistis: refactor multi-file yang berjalan sekitar 12 giliran. Asumsikan sekitar 40K token input dan 8K token output per giliran (caching mati), karena setiap giliran mengirim ulang konteks yang tumbuh. Itu sekitar 480K token input dan 96K token output total. Sekarang perhitungannya:
- Sonnet 5 intro: (0.48 juta × $2) + (0.096 juta × $10) = $0.96 + $0.96 = $1.92
- Sonnet 5 standar: (0.48 juta × $3) + (0.096 juta × $15) = $1.44 + $1.44 = $2.88
- Opus 4.8 standar: (0.48 juta × $5) + (0.096 juta × $25) = $2.40 + $2.40 = $4.80
Sekarang nyalakan prompt caching. Jika sebagian besar dari 480K input itu adalah konteks yang digunakan ulang (prompt sistem, tree file, giliran sebelumnya) dan Anda mendapat penghematan mendekati ~90% yang didokumentasikan pada bagian yang di-cache, sisi input turun dari sekitar $0.96 menjadi sekitar $0.10, sementara output tetap di $0.96.
| Skenario (12 giliran, ~480K masuk / ~96K keluar, caching mati kecuali disebutkan) | Biaya input | Biaya output | Total |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0.96 | $0.96 | $1.92 |
| Sonnet 5 standar ($3/$15) | $1.44 | $1.44 | $2.88 |
| Opus 4.8 standar ($5/$25) | $2.40 | $2.40 | $4.80 |
| Sonnet 5 intro + prompt caching (penghematan input ~90%) | ~$0.10 | $0.96 | ~$1.06 |
Ini adalah estimasi termodel menggunakan harga per token publik dan asumsi token yang dinyatakan, perhitungan yang dapat Anda reproduksi, bukan benchmark yang kami jalankan. Ganti dengan jumlah giliran dan ukuran token Anda sendiri dan strukturnya tetap. Hitung sendiri angkanya: tugas agent yang sama berbiaya sekitar $1.92 di Sonnet 5 intro versus $4.80 di Opus 4.8 standar, dan caching bisa menarik jalan Sonnet 5 turun mendekati $1.06. Di seribu jalan seperti itu sebulan, itu selisih antara tagihan ~$1,900 dan ~$4,800.
Memilih model dan mengukur biaya Anda sendiri
Anda tidak harus memercayai asumsi kami. Arahkan model ke beban kerja Anda sendiri dan baca jumlah token nyata kembali. Di Claude Code, atur model dengan flag atau di pengaturan proyek Anda:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Di Anthropic API, string modelnya sama, dan setiap respons memberi Anda penggunaan token yang tepat:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Kalikan input_tokens dengan tarif input Anda, output_tokens dengan tarif output Anda, jumlahkan lintas giliran, dan Anda mendapat biaya sebenarnya dari tugas itu. Field cache_read_input_tokens menunjukkan seberapa besar caching benar-benar menghemat untuk Anda. Dalam pengalaman kami merutekan model untuk klien, biaya per tugaslah yang menggerakkan tagihan bulanan, bukan label per token, dan satu-satunya cara jujur untuk mengetahuinya adalah membaca objek usage pada trafik Anda sendiri.
Di Mana Sonnet 5 Adalah Pilihan Tepat (kasus penggunaan nyata)
Sonnet 5 adalah pilihan tepat untuk pekerjaan agentik dan pengkodean bervolume tinggi di mana biaya per tugas menentukan tagihan, yang merupakan sebagian besar pekerjaan agent produksi. Raih Opus 4.8 hanya ketika satu langkah salah cukup mahal untuk membenarkan premi. Untuk segala yang berputar, mencoba ulang, dan mengirim ulang konteks, tarif menengah berbunga menguntungkan Anda.
Pilihan konkret:
- Agent pengkodean. Refactor multi-file, pembuatan tes, dan jalan debugging memakan token lintas banyak giliran, jadi tarif per giliran lebih rendah paling penting di sini. Lihat rangkuman kami tentang agent pengkodean AI untuk di mana ia cocok.
- Otomasi browser dan terminal. Jalan otonom panjang adalah persis untuk apa Anthropic membangun peningkatan agentik, dan persis di mana biaya bertambah.
- Pipeline pekerjaan pengetahuan. Peringkasan, ekstraksi, dan putaran riset yang berjalan dalam skala mendapat manfaat dari caching plus tarif menengah.
- Agent yang menghadap pelanggan. Volume permintaan tinggi mengubah penghematan kecil per tugas menjadi penghematan bulanan besar.
Di mana Anda bisa menjalankannya? Ini default di Claude Code, tersedia melalui API, dan diluncurkan lintas platform besar. Jika Anda memilih perkakas, perbandingan kami tentang Cursor dan Copilot terhadap Claude Code mencakup pertukarannya.
Apakah Sonnet 5 Lebih Baik dari Opus 4.8, dan Kapan Opus Masih Layak?
Tidak, tidak "lebih baik" menurut framing Anthropic sendiri. Anthropic mengatakan Sonnet 5 "mendekati Opus 4.8," bukan di depannya. Pilih Sonnet 5 untuk pekerjaan agentik dan pengkodean yang sensitif biaya dan bervolume tinggi. Raih Opus 4.8 untuk penalaran jangka panjang tersulit, di mana satu langkah salah mahal dan akurasi ekstra layak mendapat preminya.
Rubrik cepat:
- Putaran agent bervolume tinggi, sensitif biaya? Sonnet 5.
- Penalaran tersulit, akurasi satu kali jalan kritis? Opus 4.8.
- Bermigrasi dari Sonnet 4.6 dan mengawasi anggaran? Sonnet 5 (harga standar sama, lebih mampu).
- Beban kerja campuran? Rutekan 90% yang mudah ke Sonnet 5 dan eskalasi hanya kasus sulit ke Opus.
Pola terakhir itulah di mana gateway LLM untuk merutekan model dan mengontrol biaya terbayar. Dalam kerangka kompetitif, beberapa media mencatat Sonnet 5 memotong harga GPT-5.5 untuk pengkodean agentik, dan Gemini 3.1 Pro bermain di tier yang sama. Benchmark pada beban kerja Anda sendiri sebelum berkomitmen, karena harga per tugas dan kecocokan tugas jarang sejalan seperti yang disarankan leaderboard.
Sonnet 5 tidak menggantikan Opus 4.8. Ia menggantikan penggunaan Opus 4.8 untuk segalanya.
Untuk Apa Claude Sonnet 5 TIDAK Cocok? (batasan jujur)
Sonnet 5 itu menengah, jadi bukan pilihan untuk penalaran kelas frontier, otonomi jangka panjang terlama, atau tugas satu kali jalan berakurasi maksimal. Untuk itu, Opus 4.8 masih taruhan lebih aman. Seluruh proposisi nilainya adalah "mendekati unggulan dengan harga lebih murah," dan "mendekati" melakukan kerja nyata dalam kalimat itu.
Satu batasan spesifik yang layak diketahui: Anthropic mengatakan Sonnet 5 memiliki "kemampuan jauh lebih rendah untuk melakukan tugas keamanan siber dibanding model Opus kami saat ini," dan mencatat ia tidak pernah mengembangkan exploit yang berfungsi selama pengujian kerentanan Firefox. Jika perkakas keamanan adalah kasus penggunaan Anda, itu pilihan desain yang disengaja, bukan bug, tetapi rencanakan mengitarinya.
Dan jangan asumsikan ukuran jendela konteks. Posting peluncuran Anthropic tidak menyebutkan satu pun, yang membawa kita ke rumor.
Rumor "Fennec": Apa yang Benar-benar Dikonfirmasi (membongkar mitos)
Banyak angka yang beredar tentang Sonnet 5 tidak berasal dari Anthropic. Inilah garis antara peluncuran yang dikonfirmasi dan narasi bocoran, dengan setiap rumor diatribusikan ke halaman agregator dan bocoran, bukan posting resmi.
- Nama kode "Fennec." Tidak dikonfirmasi. Identifier itu bocor dari log Vertex AI berbulan-bulan sebelumnya dan secara historis merujuk ke Sonnet 4.6, bukan Sonnet 5. Anthropic tidak mengumumkan nama kode.
- "Jendela konteks 1 juta token." Tidak disebutkan di mana pun dalam posting peluncuran resmi. Perlakukan angka jendela konteks spesifik apa pun sebagai belum diverifikasi sampai Anthropic mempublikasikannya.
- "82.1% / 92.4% SWE-bench." Fabrikasi agregator. Kutip hanya angka dari posting resmi atau kartu sistem; abaikan sisanya.
- "Rilis 1 April," "dilatih di Google TPU," "Dev Team Mode." Salah atau tidak dikonfirmasi. Peluncurannya 30 Juni 2026, dan tak satu pun dari fitur atau klaim itu muncul di materi Anthropic.
Anthropic tidak pernah mengumumkan nama kode "Fennec" untuk Sonnet 5. Identifier itu bocor dari log Vertex AI berbulan-bulan sebelumnya dan menunjuk ke model berbeda. Jika sebuah halaman mengutip benchmark presisi tanpa tautan ke kartu sistem, perlakukan sebagai noise.
Haruskah Anda Beralih dari Sonnet 4.6? (vonis migrasi)
Jika Anda di Sonnet 4.6, beralih ke Sonnet 5 berisiko rendah: Anda mendapat model lebih mampu dengan harga standar sama ($3/$15), dan jendela intro ($2/$10 hingga 31 Agustus) membuat pengujian murah sekarang. The New Stack membingkainya sebagai menutup kesenjangan dengan Opus 4.8 sambil tetap murah hingga Agustus, yang merupakan bacaan adil untuk developer yang menimbang langkah.
Beberapa jebakan sebelum Anda membalik trafik produksi:
- Ubah string model menjadi
claude-sonnet-5. Itu satu-satunya perubahan kode yang diperlukan untuk kebanyakan setup. - Periksa ulang asumsi prompt atau output apa pun. Model lebih mampu bisa mengubah nada, verbositas, atau pemformatan dengan cara yang penting di hilir.
- Validasi di set eval Anda dulu. Jangan menukar trafik produksi berdasarkan firasat.
- Awasi kenaikan harga 31 Agustus jika Anda menganggarkan melewati musim panas.
Vonisnya: dengan harga standar sama seperti Sonnet 4.6 dengan performa agentik lebih baik, bertahan di 4.6 adalah pilihan yang lebih sulit dibenarkan. Beralih sekarang untuk menangkap harga intro, tunggu hanya jika Anda punya siklus eval yang dibekukan, dan simpan Opus 4.8 untuk tugas tersulit. Jika tim Anda merutekan model dan bergulat dengan biaya LLM di produksi, kami menawarkan konsultasi gratis untuk memetakannya.
Tentang Penulis
Mert Batur Gurbuz adalah Co-Founder Techsy.io, di mana timnya mengirimkan agent AI, sistem otomasi, dan pipeline suara/SDR untuk klien B2B. Ia belajar di University of Birmingham dan menulis tentang tumpukan perkakas LLM yang benar-benar digunakan tim Techsy di produksi. Terhubung di LinkedIn.
Kredensial: Co-Founder, Techsy.io, University of Birmingham. Harga diverifikasi terhadap posting peluncuran Anthropic pada 30-06-2026.
Pertanyaan yang Sering Diajukan
Apakah Claude Sonnet 5 sudah dirilis?
Ya. Anthropic meluncurkan Claude Sonnet 5 pada 30 Juni 2026, sebagai model default untuk Claude Free dan Pro, dan membuatnya tersedia untuk pengguna Max, Team, dan Enterprise. Anda juga bisa mencapainya melalui Anthropic API dan Claude Code menggunakan string model claude-sonnet-5.
Berapa biaya Claude Sonnet 5?
Harga intro adalah $2 per juta token input dan $10 per juta token output hingga 31 Agustus 2026. Setelah itu, ia beralih ke harga standar $3 per juta input dan $15 per juta output, tarif standar sama seperti Sonnet 4.6 untuk model yang lebih mampu.
Apakah Claude Sonnet 5 benar-benar lebih baik dari Opus 4.8?
Tidak menurut deskripsi Anthropic sendiri. Anthropic mengatakan performa Sonnet 5 "mendekati Opus 4.8," bukan lebih baik. Untuk penalaran jangka panjang tersulit di mana satu langkah salah mahal, Opus 4.8 masih pilihan lebih kuat. Sonnet 5 menang di biaya per tugas, berjalan di sekitar sepertiga harga standar Opus.
Berapa jendela konteks Claude Sonnet 5?
Posting peluncuran Anthropic tidak menyebutkan ukuran jendela konteks. Klaim "1 juta token" yang beredar di halaman agregator tidak dikonfirmasi dan tidak berasal dari Anthropic. Sampai Anthropic mempublikasikan angka resmi, perlakukan angka jendela konteks spesifik apa pun sebagai belum diverifikasi.
Bagaimana cara menggunakan Claude Sonnet 5?
Atur string model ke claude-sonnet-5 di Anthropic API, atau pilih di Claude Code dengan claude --model claude-sonnet-5 atau pengaturan proyek Anda. Ini juga model default untuk Claude Free dan Pro, jadi tidak perlu setup di sana. Baca objek usage pada respons untuk melacak biaya token nyata.
Apakah Claude Sonnet 5 bernama kode "Fennec"?
Tidak ada konfirmasi. "Fennec" adalah identifier bocoran yang secara historis merujuk ke Sonnet 4.6, dan Anthropic tidak mengumumkan nama kode untuk Sonnet 5. Identifier itu muncul di log Vertex AI berbulan-bulan sebelum peluncuran ini, jadi perlakukan klaim "Fennec sama dengan Sonnet 5" sebagai rumor belum diverifikasi.
Haruskah saya beralih dari Sonnet 4.6 ke Sonnet 5?
Kemungkinan ya. Sonnet 5 berjalan dengan harga standar sama seperti Sonnet 4.6 ($3/$15) dengan performa agentik lebih baik, dan jendela intro membuat pengujian murah hingga 31 Agustus. Ubah string model, validasi di set eval Anda, dan periksa perilaku sebelum menukar trafik produksi.
Bagaimana Sonnet 5 dibanding GPT-5.5 untuk pengkodean?
Sonnet 5 adalah opsi pengkodean-agentik yang kompetitif secara biaya dari Anthropic, dan beberapa media melaporkan ia memotong harga GPT-5.5. Perbandingan kemampuan bergantung pada beban kerja, jadi benchmark keduanya di codebase dan campuran tugas Anda sendiri sebelum berkomitmen. Harga per tugas dan kecocokan tugas jarang sejalan seperti yang disiratkan satu leaderboard.
Bisakah saya menjalankan Claude Sonnet 5 di AWS Bedrock?
Anthropic membuat model Sonnet tersedia lintas platform cloud besar, jadi ketersediaan Bedrock dan Vertex untuk claude-sonnet-5 seharusnya mengikuti saat peluncuran selesai. Periksa status platform saat ini untuk region Anda, karena peluncuran hari yang sama sering mencapai API pihak pertama dan Claude Code sebelum setiap platform pihak ketiga.
Bagaimana cara mengurangi biaya Claude Sonnet 5?
Gunakan prompt caching untuk penghematan hingga sekitar 90% pada konteks yang digunakan ulang, dan pemrosesan batch untuk penghematan sekitar 50% pada pekerjaan tidak mendesak. Rutekan hanya tugas tersulit ke Opus 4.8 dan simpan pekerjaan bervolume tinggi di Sonnet 5. Baca objek usage untuk melihat persis ke mana token Anda pergi.