
Claude Sonnet 5: co nowego i ile naprawdę kosztuje jego uruchomienie
Claude Sonnet 5 pojawił się dzisiaj, 30 czerwca 2026 r., a Anthropic ustalił cenę warstwy wprowadzającej na 2 USD za milion tokenów wejściowych. I na tym większość relacji się kończy. Liczba, która faktycznie wpływa na Twój rachunek, jest inna: ile kosztuje pełne uruchomienie agenta, gdy doliczyć tokeny wyjściowe i kilkanaście rund wymiany? Anthropic twierdzi, że Sonnet 5 osiąga wynik „bliski Opus 4.8" za mniej więcej jedną trzecią ceny. Prawdziwe pytanie nie dotyczy więc karty specyfikacji. Chodzi o to, czy miesięczny koszt Twojego agenta właśnie spadł — i o ile.
Najważniejsze wnioski:
- Claude Sonnet 5 zadebiutował 30 czerwca 2026 r., zastępując Sonnet 4.6 jako średniopółkowy model agentowy Anthropic.
- Cena wprowadzająca to 2 USD/M za wejście i 10 USD/M za wyjście do 31 sierpnia 2026 r., potem 3 USD/15 USD.
- Anthropic twierdzi, że wydajność jest „bliska Opus 4.8" przy mniej więcej jednej trzeciej kosztu Opus.
- Jest domyślny dla Claude Free i Pro oraz dostępny przez API i Claude Code jako
claude-sonnet-5.
Czym jest Claude Sonnet 5? (odpowiedź w 30 sekund)
Claude Sonnet 5 to nowy średniopółkowy model Anthropic, wprowadzony 30 czerwca 2026 r. i opisany w poście premierowym jako najbardziej agentowy Sonnet w historii. Potrafi tworzyć plany, korzystać z narzędzi takich jak przeglądarki i terminale oraz działać autonomicznie. Cena wprowadzająca to 2 USD/M za wejście i 10 USD/M za wyjście, a model jest teraz domyślny dla Claude Free i Pro.
Tak, został wydany właśnie dziś — na wypadek, gdybyś natknął się na krążące w sieci zamieszanie w stylu „czy Claude Sonnet 5 został już wydany?". Wybierasz go za pomocą ciągu modelu claude-sonnet-5 w API lub w Claude Code. Anthropic pozycjonuje go jako znaczący krok względem Sonnet 4.6 i twierdzi, że jakość plasuje się blisko jego flagowca, Opus 4.8, ale bez flagowej ceny.
Oto zakład, który się za tym kryje: Claude Sonnet 5 to przekonanie Anthropic, że większość pracy agentów nie wymaga już modelu frontowego. Jeśli to się potwierdzi, ciekawą historią nie będzie skok możliwości. Będzie nią ekonomia.
Co nowego w porównaniu z Sonnet 4.6 i Opus 4.8
Anthropic nazywa Sonnet 5 „znaczącym ulepszeniem względem poprzednika, Sonnet 4.6" w zakresie rozumowania, korzystania z narzędzi, programowania i pracy z wiedzą, z wydajnością „bliską Opus 4.8, ale w niższych cenach". Model sprawdza własne wyniki bez proszenia i jest silniejszy w długotrwałym programowaniu, debugowaniu i wieloetapowym korzystaniu z narzędzi. To sformułowania Anthropic, nie nasze pomiary.
Ulepszenia agentowe
Główna zmiana to autonomia. Sonnet 5 został zbudowany tak, by planować zadanie, sięgać po narzędzia takie jak przeglądarki i terminale oraz przebrnąć przez długie uruchomienia bez prowadzenia za rękę. Jak donosi TechCrunch (powołując się na Anthropic), model jest przedstawiany jako tańszy sposób na utrzymywanie agentów w ruchu, a wczesne sygnały od klientów napływają od zespołów takich jak Zapier i Lovable. To właśnie przypadek użycia, za którym goni Anthropic: agenci, którzy zapętlają się przez minuty lub godziny, gdzie każda runda dokłada tokeny.
Jak wypada na papierze w porównaniu z Opus 4.8
Oto część, która ma znaczenie dla budżetowania. Luka w możliwościach się zawęziła; luka w cenie — nie.
| Model | Wejście $/M | Wyjście $/M | Intro vs standard | Pozycjonowanie |
|---|---|---|---|---|
| Claude Sonnet 5 | 2 USD (intro) → 3 USD | 10 USD (intro) → 15 USD | Intro do 31 sierpnia 2026 r. | Średnia półka, najbardziej agentowy Sonnet; „bliski Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | 3 USD | 15 USD | Standard | Poprzednia średnia półka (luty 2026) |
| Claude Opus 4.8 | 5 USD (10 USD Fast Mode) | 25 USD (50 USD Fast Mode) | Standard | Flagowiec; najtrudniejsze rozumowanie długoterminowe |
Zauważ, że standardowa cena Sonnet 5 (3 USD/15 USD) jest identyczna jak Sonnet 4.6. Dostajesz bardziej wydajny model w tej samej cenie katalogowej. A wobec 5 USD/25 USD Opus 4.8, standardowy Sonnet 5 działa przy mniej więcej 60% stawki wejściowej i stawki wyjściowej. W oknie wprowadzającym jest jeszcze tańszy. Anthropic nie opublikował liczby, która mówiłaby, że Sonnet 5 pokonuje Opus 4.8, więc nie interpretuj tego w ten sposób: oficjalne stanowisko brzmi „bliski" i tego się trzymamy.
Ile naprawdę kosztuje Claude Sonnet 5? (ekonomia tokenów)
Claude Sonnet 5 kosztuje 2 USD/M za wejście i 10 USD/M za wyjście w oknie wprowadzającym do 31 sierpnia 2026 r., a następnie rośnie do 3 USD/M za wejście i 15 USD/M za wyjście. Ta standardowa cena dorównuje Sonnet 4.6 za silniejszy model i wypada na mniej więcej jedną trzecią standardowej stawki Opus 4.8 (5 USD/25 USD). Dla wysokowolumenowej pracy agentów ten współczynnik to cała historia.
Co więc w praktyce oznacza dla Ciebie „za milion tokenów"? Token to mniej więcej trzy czwarte słowa. Milion tokenów to mnóstwo tekstu, może 750 000 słów, ale agenci zużywają je szybko, ponieważ każda runda ponownie wysyła kontekst: prompt systemowy, wcześniejsze wiadomości, zawartość plików, wyniki narzędzi. Pojedynczy refaktor wielu plików może pochłonąć setki tysięcy tokenów wejściowych, zanim dobiegnie końca.
To okno wprowadzające to realny punkt decyzyjny. Do 31 sierpnia płacisz 2 USD/10 USD. Po tym terminie — 3 USD/15 USD. Jeśli i tak zamierzasz przetestować Sonnet 5, zrobienie tego teraz oznacza, że Twoje ewaluacje działają po rabacie, a Ty utrwalasz nawyki, gdy matematyka jest najkorzystniejsza. Druga strona medalu: nie buduj budżetu na cenie wprowadzającej, którą stracisz za dwa miesiące.
Dwie funkcje platformy zmieniają realny rachunek bardziej niż stawka katalogowa. Buforowanie promptów pozwala ponownie wykorzystać zbuforowany kontekst zamiast płacić pełną cenę wejściową w każdej rundzie, dając oszczędność nawet około 90% na zbuforowanej części. Przetwarzanie wsadowe obniża koszty o około 50% w przypadku niepilnych zadań, które można uruchomić asynchronicznie. Obie są opisane w cenniku platformy Anthropic. Jeśli Twój agent w każdej rundzie ponownie wysyła ten sam duży prompt systemowy lub bazę kodu, buforowanie promptów to pojedynczo największa dźwignia kosztowa, jaką masz. Więcej taktyk omawiamy w naszym przewodniku po obniżaniu kosztów API LLM.

Przy 2 USD za milion tokenów wejściowych Sonnet 5 sprawia, że wysokowolumenowe pętle agentów są na tyle tanie, by zostawić je włączone. To właśnie ta zmiana. Pytanie nie brzmi już „czy stać mnie na uruchomienie tego agenta?", lecz „ile z nich mogę uruchomić jednocześnie?".
Ile naprawdę kosztuje realne uruchomienie agenta na Sonnet 5 (odtwarzalnie)
Podajmy konkretną liczbę. Nie przeprowadziliśmy laboratoryjnego benchmarku i nie zamierzamy udawać, że było inaczej. To, co następuje, to przejrzyste obliczenie, które możesz odtworzyć na własnych liczbach tokenów, korzystając z opublikowanych przez Anthropic stawek za token. Podaj założenia, wykonaj arytmetykę, a rachunek wyjdzie sam.
Obliczenie krok po kroku
Weźmy realistyczne zadanie agenta: refaktor wielu plików, który wykonuje około 12 rund. Załóżmy mniej więcej 40 tys. tokenów wejściowych i 8 tys. tokenów wyjściowych na rundę (buforowanie wyłączone), ponieważ każda runda ponownie wysyła rosnący kontekst. To łącznie około 480 tys. tokenów wejściowych i 96 tys. tokenów wyjściowych. Teraz matematyka:
- Sonnet 5 intro: (0,48M × 2 USD) + (0,096M × 10 USD) = 0,96 USD + 0,96 USD = 1,92 USD
- Sonnet 5 standard: (0,48M × 3 USD) + (0,096M × 15 USD) = 1,44 USD + 1,44 USD = 2,88 USD
- Opus 4.8 standard: (0,48M × 5 USD) + (0,096M × 25 USD) = 2,40 USD + 2,40 USD = 4,80 USD
A teraz włącz buforowanie promptów. Jeśli większość z tych 480 tys. tokenów wejściowych to ponownie używany kontekst (prompt systemowy, drzewo plików, wcześniejsze rundy) i uzyskasz wynik bliski dokumentowanej oszczędności ~90% na zbuforowanej części, strona wejściowa spada z około 0,96 USD do mniej więcej 0,10 USD, podczas gdy wyjście pozostaje na poziomie 0,96 USD.
| Scenariusz (12 rund, ~480 tys. wej. / ~96 tys. wyj., buforowanie wyłączone, jeśli nie zaznaczono) | Koszt wejścia | Koszt wyjścia | Razem |
|---|---|---|---|
| Sonnet 5 intro (2 USD/10 USD) | 0,96 USD | 0,96 USD | 1,92 USD |
| Sonnet 5 standard (3 USD/15 USD) | 1,44 USD | 1,44 USD | 2,88 USD |
| Opus 4.8 standard (5 USD/25 USD) | 2,40 USD | 2,40 USD | 4,80 USD |
| Sonnet 5 intro + buforowanie promptów (~90% oszczędności na wejściu) | ~0,10 USD | 0,96 USD | ~1,06 USD |
To modelowane szacunki oparte na publicznych stawkach za token i podanych założeniach dotyczących tokenów — obliczenie, które możesz odtworzyć, a nie benchmark, który przeprowadziliśmy. Podstaw własną liczbę rund i rozmiary tokenów, a struktura się utrzyma. Policz sam: to samo zadanie agenta kosztuje mniej więcej 1,92 USD na Sonnet 5 intro wobec 4,80 USD na Opus 4.8 standard, a buforowanie może sprowadzić uruchomienie Sonnet 5 w okolice 1,06 USD. W skali tysiąca takich uruchomień miesięcznie to różnica między rachunkiem ~1900 USD a ~4800 USD.
Wybór modelu i pomiar własnego kosztu
Nie musisz ufać naszym założeniom. Skieruj model na własne obciążenie i odczytaj realne liczby tokenów. W Claude Code ustaw model flagą lub w ustawieniach projektu:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}W API Anthropic ciąg modelu jest ten sam, a każda odpowiedź podaje dokładne użycie tokenów:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Pomnóż input_tokens przez stawkę wejściową, output_tokens przez stawkę wyjściową, zsumuj w obrębie rund, a otrzymasz prawdziwy koszt tego zadania. Pole cache_read_input_tokens pokazuje, ile faktycznie zaoszczędziło buforowanie. Z naszego doświadczenia w kierowaniu modelami dla klientów wynika, że miesięczny rachunek kształtuje koszt na zadanie, a nie stawka za token, a jedynym uczciwym sposobem, by go poznać, jest odczytanie obiektu usage na własnym ruchu.
Gdzie Sonnet 5 jest właściwym wyborem (realne przypadki użycia)
Sonnet 5 to właściwy wybór dla wysokowolumenowej pracy agentowej i programistycznej, gdzie o rachunku decyduje koszt na zadanie — a to większość produkcyjnej pracy agentów. Sięgaj po Opus 4.8 tylko wtedy, gdy pojedynczy błędny krok jest na tyle kosztowny, by uzasadnić dopłatę. Dla wszystkiego, co się zapętla, ponawia i ponownie wysyła kontekst, stawka średniej półki procentuje na Twoją korzyść.
Konkretne wybory:
- Agenci programistyczni. Refaktory wielu plików, generowanie testów i uruchomienia debugowania pochłaniają tokeny w wielu rundach, więc niższa stawka za rundę ma tu największe znaczenie. Zobacz nasz przegląd agentów programistycznych AI, aby sprawdzić, gdzie pasuje.
- Automatyzacja przeglądarki i terminala. Długie autonomiczne uruchomienia to dokładnie to, do czego Anthropic zbudował ulepszenia agentowe — i dokładnie tam, gdzie koszt się kumuluje.
- Potoki pracy z wiedzą. Sumaryzacja, ekstrakcja i pętle badawcze działające w skali korzystają z buforowania oraz stawki średniej półki.
- Agenci obsługujący klientów. Wysoki wolumen żądań zamienia niewielką oszczędność na zadaniu w dużą oszczędność miesięczną.
Gdzie możesz go uruchomić? Jest domyślny w Claude Code, dostępny przez API i wdrażany na głównych platformach. Jeśli wybierasz narzędzia, nasze porównanie Cursor i Copilot z Claude Code omawia kompromisy.
Czy Sonnet 5 jest lepszy od Opus 4.8 i kiedy Opus wciąż się opłaca?
Nie, nie jest „lepszy" według własnego ujęcia Anthropic. Anthropic twierdzi, że Sonnet 5 jest „bliski Opus 4.8", a nie przed nim. Wybierz Sonnet 5 do wrażliwej kosztowo, wysokowolumenowej pracy agentowej i programistycznej. Sięgnij po Opus 4.8 przy najtrudniejszym rozumowaniu długoterminowym, gdzie jeden błędny krok jest kosztowny, a dodatkowa dokładność zasługuje na swoją dopłatę.
Szybka rubryka:
- Wysokowolumenowe pętle agentów, wrażliwość na koszt? Sonnet 5.
- Najtrudniejsze rozumowanie, kluczowa dokładność pojedynczego strzału? Opus 4.8.
- Migracja z Sonnet 4.6 i pilnowanie budżetu? Sonnet 5 (ta sama standardowa cena, większe możliwości).
- Mieszane obciążenie? Kieruj łatwe 90% do Sonnet 5, a tylko trudne przypadki eskaluj do Opus.
Ten ostatni wzorzec to miejsce, gdzie brama LLM do kierowania modelami i kontroli kosztów się opłaca. W ujęciu konkurencyjnym niektóre media odnotowują, że Sonnet 5 podcina cenowo GPT-5.5 w programowaniu agentowym, a Gemini 3.1 Pro gra w tej samej lidze. Zrób benchmark na własnym obciążeniu, zanim się zdecydujesz, bo cena na zadanie i dopasowanie do zadania rzadko układają się tak, jak sugeruje ranking.
Sonnet 5 nie zastępuje Opus 4.8. Zastępuje używanie Opus 4.8 do wszystkiego.
Do czego Claude Sonnet 5 się NIE nadaje? (uczciwe ograniczenia)
Sonnet 5 jest średniopółkowy, więc nie jest wyborem do rozumowania klasy frontowej, najdłuższej autonomii czy maksymalnie dokładnych zadań pojedynczego strzału. Do nich Opus 4.8 wciąż jest bezpieczniejszym zakładem. Cała propozycja wartości brzmi „blisko flagowca za mniej", a słowo „blisko" wykonuje w tym zdaniu realną robotę.
Jedno konkretne ograniczenie, które warto znać: Anthropic twierdzi, że Sonnet 5 ma „znacznie mniejszą zdolność wykonywania zadań z zakresu cyberbezpieczeństwa niż nasze obecne modele Opus" i zauważa, że podczas testowania podatności Firefoksa nigdy nie opracował działającego exploita. Jeśli narzędzia bezpieczeństwa to Twój przypadek użycia, to świadomy wybór projektowy, nie błąd — ale planuj z jego uwzględnieniem.
I nie zakładaj rozmiaru okna kontekstu. Post premierowy Anthropic go nie podaje, co prowadzi nas do plotek.
Plotki o „Fennec": co jest faktycznie potwierdzone (obalanie mitów)
Wiele liczb krążących o Sonnet 5 nie pochodzi od Anthropic. Oto granica między potwierdzoną premierą a narracją z przecieków, przy czym każda plotka jest przypisana do agregatorów i stron z przeciekami, a nie do oficjalnego postu.
- Kryptonim „Fennec". Niepotwierdzone. Ten identyfikator wyciekł z logu Vertex AI wiele miesięcy wcześniej i historycznie odpowiadał Sonnet 4.6, nie Sonnet 5. Anthropic nie ogłosił żadnego kryptonimu.
- „Okno kontekstu 1M tokenów". Nigdzie w oficjalnym poście premierowym nie podano. Traktuj każdą konkretną liczbę okna kontekstu jako niezweryfikowaną, dopóki Anthropic takiej nie opublikuje.
- „82,1% / 92,4% SWE-bench". Fabrykacje agregatorów. Cytuj wyłącznie dane z oficjalnego postu lub karty systemu; resztę ignoruj.
- „Premiera 1 kwietnia", „trenowany na TPU Google", „Dev Team Mode". Fałsz lub niepotwierdzone. Premiera ma miejsce 30 czerwca 2026 r. i żadna z tych funkcji ani twierdzeń nie pojawia się w materiałach Anthropic.
Anthropic nigdy nie ogłosił kryptonimu „Fennec" dla Sonnet 5. Ten identyfikator wyciekł z logu Vertex AI wiele miesięcy wcześniej i wskazywał na inny model. Jeśli strona cytuje dokładny benchmark bez linku do karty systemu, traktuj to jako szum.
Czy przesiąść się z Sonnet 4.6? (werdykt migracyjny)
Jeśli korzystasz z Sonnet 4.6, przejście na Sonnet 5 jest niskiego ryzyka: dostajesz bardziej wydajny model w tej samej standardowej cenie (3 USD/15 USD), a okno wprowadzające (2 USD/10 USD do 31 sierpnia) sprawia, że testowanie jest teraz tanie. The New Stack ujmuje to jako zamykanie luki wobec Opus 4.8 przy zachowaniu niskiej ceny do sierpnia, co jest trafną oceną dla deweloperów rozważających ruch.
Kilka pułapek przed przełączeniem ruchu produkcyjnego:
- Zmień ciąg modelu na
claude-sonnet-5. To jedyna wymagana zmiana kodu w większości konfiguracji. - Sprawdź ponownie wszelkie założenia dotyczące promptów lub wyników. Bardziej wydajny model może zmienić ton, rozwlekłość lub formatowanie w sposób istotny dalej w potoku.
- Najpierw zwaliduj na swoim zestawie ewaluacyjnym. Nie przełączaj ruchu produkcyjnego na wyczucie.
- Pilnuj sierpniowej podwyżki ceny 31 sierpnia, jeśli budżetujesz poza lato.
Werdykt: przy tej samej standardowej cenie co Sonnet 4.6 i lepszej wydajności agentowej, pozostanie przy 4.6 jest trudniejsze do uzasadnienia. Przesiądź się teraz, by złapać cenę wprowadzającą, poczekaj tylko wtedy, gdy masz zamrożony cykl ewaluacyjny, i trzymaj Opus 4.8 w rezerwie na najtrudniejsze zadania. Jeśli Twój zespół kieruje modelami i zmaga się z kosztem LLM w produkcji, oferujemy bezpłatną konsultację, by to rozplanować.
O autorze
Mert Batur Gurbuz jest współzałożycielem Techsy.io, gdzie zespół dostarcza agentów AI, systemy automatyzacji oraz potoki głosowe/SDR dla klientów B2B. Studiuje na University of Birmingham i pisze o stosie narzędzi LLM, którego zespół Techsy faktycznie używa w produkcji. Połącz się na LinkedIn.
Uprawnienia: współzałożyciel Techsy.io, University of Birmingham. Ceny zweryfikowane względem postu premierowego Anthropic w dniu 30.06.2026.
Często zadawane pytania
Czy Claude Sonnet 5 został wydany?
Tak. Anthropic wprowadził Claude Sonnet 5 30 czerwca 2026 r. jako domyślny model dla Claude Free i Pro oraz udostępnił go użytkownikom Max, Team i Enterprise. Możesz też skorzystać z niego przez API Anthropic i Claude Code, używając ciągu modelu claude-sonnet-5.
Ile kosztuje Claude Sonnet 5?
Cena wprowadzająca to 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych do 31 sierpnia 2026 r. Po tym terminie przechodzi na standardową cenę 3 USD za milion wejściowych i 15 USD za milion wyjściowych — tę samą standardową stawkę co Sonnet 4.6 za bardziej wydajny model.
Czy Claude Sonnet 5 jest faktycznie lepszy od Opus 4.8?
Nie według własnego opisu Anthropic. Anthropic twierdzi, że wydajność Sonnet 5 jest „bliska Opus 4.8", a nie lepsza. Do najtrudniejszego rozumowania długoterminowego, gdzie pojedynczy błędny krok jest kosztowny, Opus 4.8 wciąż jest mocniejszym wyborem. Sonnet 5 wygrywa kosztem na zadanie, działając przy mniej więcej jednej trzeciej standardowej ceny Opus.
Jakie jest okno kontekstu Claude Sonnet 5?
Post premierowy Anthropic nie podaje rozmiaru okna kontekstu. Twierdzenia o „1M tokenów" krążące na stronach agregatorów są niepotwierdzone i nie pochodzą od Anthropic. Dopóki Anthropic nie opublikuje oficjalnej liczby, traktuj każdą konkretną wartość okna kontekstu jako niezweryfikowaną.
Jak korzystać z Claude Sonnet 5?
Ustaw ciąg modelu na claude-sonnet-5 w API Anthropic lub wybierz go w Claude Code za pomocą claude --model claude-sonnet-5 albo w ustawieniach projektu. Jest też domyślnym modelem dla Claude Free i Pro, więc tam nie jest potrzebna żadna konfiguracja. Odczytuj obiekt usage odpowiedzi, aby śledzić realne koszty tokenów.
Czy Claude Sonnet 5 nosi kryptonim „Fennec"?
Brak potwierdzenia. „Fennec" to wyciekły identyfikator, który historycznie odpowiadał Sonnet 4.6, a Anthropic nie ogłosił żadnego kryptonimu dla Sonnet 5. Identyfikator pojawił się w logu Vertex AI wiele miesięcy przed tą premierą, więc traktuj każde twierdzenie „Fennec to Sonnet 5" jako niezweryfikowaną plotkę.
Czy przesiąść się z Sonnet 4.6 na Sonnet 5?
Prawdopodobnie tak. Sonnet 5 działa w tej samej standardowej cenie co Sonnet 4.6 (3 USD/15 USD) przy lepszej wydajności agentowej, a okno wprowadzające sprawia, że testowanie jest tanie do 31 sierpnia. Zmień ciąg modelu, zwaliduj na swoim zestawie ewaluacyjnym i sprawdź zachowanie przed przełączeniem ruchu produkcyjnego.
Jak Sonnet 5 wypada w porównaniu z GPT-5.5 w programowaniu?
Sonnet 5 to kosztowo konkurencyjna opcja Anthropic do programowania agentowego, a niektóre media donoszą, że podcina cenowo GPT-5.5. Porównania możliwości zależą od obciążenia, więc zrób benchmark obu na własnej bazie kodu i miksie zadań przed podjęciem decyzji. Cena na zadanie i dopasowanie do zadania rzadko układają się tak, jak sugeruje pojedynczy ranking.
Czy mogę uruchomić Claude Sonnet 5 na AWS Bedrock?
Anthropic udostępnia modele Sonnet na głównych platformach chmurowych, więc dostępność claude-sonnet-5 na Bedrock i Vertex powinna nastąpić w miarę ukończenia wdrażania. Sprawdź bieżący status platformy dla swojego regionu, ponieważ premiery w tym samym dniu często docierają najpierw do API pierwszej strony i Claude Code, zanim trafią na każdą platformę trzecią.
Jak mogę obniżyć koszty Claude Sonnet 5?
Stosuj buforowanie promptów, by oszczędzić nawet około 90% na ponownie używanym kontekście, oraz przetwarzanie wsadowe, by oszczędzić około 50% na niepilnych zadaniach. Kieruj tylko najtrudniejsze zadania do Opus 4.8, a wysokowolumenową pracę trzymaj na Sonnet 5. Odczytuj obiekt usage, aby zobaczyć dokładnie, gdzie trafiają Twoje tokeny.