
Claude Sonnet 5: O Que Há de Novo e Quanto Custa Realmente
O Claude Sonnet 5 chegou hoje, 30 de junho de 2026, e a Anthropic fixou o preço de introdução em $2 por milhão de tokens de input. É aqui que a maioria das análises fica. O número que realmente mexe na sua fatura é outro: quanto custa uma execução completa de agente depois de somar os tokens de output e uma dúzia de voltas de conversa? A Anthropic diz que o Sonnet 5 fica "próximo do Opus 4.8" por cerca de um terço do preço. Portanto, a questão real não é a ficha técnica. É se o custo mensal do seu agente acabou de baixar, e em quanto.
Pontos-chave:
- O Claude Sonnet 5 foi lançado a 30 de junho de 2026, substituindo o Sonnet 4.6 como modelo agêntico de gama média da Anthropic.
- O preço de introdução é $2/M input e $10/M output até 31 de agosto de 2026, depois $3/$15.
- A Anthropic afirma que o desempenho é "próximo do Opus 4.8" a cerca de um terço do custo do Opus.
- É o modelo predefinido no Claude Free e Pro, e está disponível via API e Claude Code como
claude-sonnet-5.
O Que É o Claude Sonnet 5? (a resposta em 30 segundos)
O Claude Sonnet 5 é o novo modelo de gama média da Anthropic, lançado a 30 de junho de 2026, e descrito no artigo de lançamento como o Sonnet mais agêntico até agora. Consegue fazer planos, usar ferramentas como browsers e terminais, e executar de forma autónoma. O preço de introdução é $2/M input e $10/M output, e é agora o predefinido no Claude Free e Pro.
Sim, foi lançado hoje, caso tenha visto a confusão "o Claude Sonnet 5 já saiu?" a circular. Seleciona-o com a string de modelo claude-sonnet-5 na API ou no Claude Code. A Anthropic posiciona-o como um salto significativo face ao Sonnet 4.6 e diz que a qualidade está próxima do seu topo de gama, o Opus 4.8, sem o preço de topo de gama.
A aposta por detrás disto é a seguinte: o Claude Sonnet 5 é a aposta da Anthropic de que a maioria do trabalho de agente já não precisa de um modelo de fronteira. Se isso se confirmar, a história interessante não é o salto de capacidade. É a economia.
O Que Há de Novo vs Sonnet 4.6 e Opus 4.8
A Anthropic chama ao Sonnet 5 uma "melhoria substancial face ao seu predecessor, o Sonnet 4.6" em raciocínio, uso de ferramentas, programação e trabalho de conhecimento, com desempenho "próximo do Opus 4.8, mas a preços mais baixos." Verifica o seu próprio output sem que lhe peçam, e é mais forte em programação sustentada, depuração e uso de ferramentas em múltiplas etapas. Estes são os enquadramentos da Anthropic, não as nossas medições.
Melhorias agênticas
A mudança de destaque é a autonomia. O Sonnet 5 foi construído para planear uma tarefa, pegar em ferramentas como browsers e terminais, e avançar em execuções longas sem necessidade de acompanhamento. Como o TechCrunch reporta (citando a Anthropic), o modelo é apresentado como uma forma mais barata de manter agentes em execução, com sinais iniciais de clientes como as equipas da Zapier e da Lovable. É esse o caso de uso que a Anthropic persegue: agentes que fazem ciclos durante minutos ou horas, onde cada volta acrescenta tokens.
Como se compara ao Opus 4.8 no papel
Aqui está a parte que importa para o orçamento. A diferença de capacidade estreitou-se; a diferença de preço não.
| Modelo | Input $/M | Output $/M | Intro vs standard | Posicionamento |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 (intro) → $3 | $10 (intro) → $15 | Intro até 31 ago 2026 | Gama média, Sonnet mais agêntico; "próximo do Opus 4.8" (Anthropic) |
| Claude Sonnet 4.6 | $3 | $15 | Standard | Gama média anterior (fev 2026) |
| Claude Opus 4.8 | $5 ($10 Fast Mode) | $25 ($50 Fast Mode) | Standard | Topo de gama; raciocínio de longo horizonte mais difícil |
Repare que o preço standard do Sonnet 5 ($3/$15) é idêntico ao do Sonnet 4.6. Fica com um modelo mais capaz pelo mesmo preço de tabela. E face aos $5/$25 do Opus 4.8, o Sonnet 5 standard fica a cerca de 60% da taxa de input e da taxa de output. Durante a janela de introdução é ainda mais barato. A Anthropic não publicou nenhum número que diga que o Sonnet 5 supera o Opus 4.8, por isso não leia dessa forma: a linha oficial é "próximo de," e nós mantemo-nos fiéis a ela.
Quanto Custa Realmente o Claude Sonnet 5? (economia de tokens)
O Claude Sonnet 5 custa $2/M input e $10/M output durante a janela de introdução até 31 de agosto de 2026, depois sobe para $3/M input e $15/M output. Esse preço standard iguala o do Sonnet 4.6 para um modelo mais forte, e fica a cerca de um terço da taxa standard do Opus 4.8 ($5/$25). Para trabalho de agente em alto volume, esse rácio é a história toda.
Então o que significa "por milhão de tokens" na prática? Um token é aproximadamente três quartos de uma palavra. Um milhão de tokens é muito texto, talvez 750.000 palavras, mas os agentes consomem-nos rapidamente porque cada volta reenvia contexto: o prompt de sistema, mensagens anteriores, conteúdos de ficheiros, outputs de ferramentas. Um único refactoring multi-ficheiro pode consumir centenas de milhares de tokens de input antes de terminar.
Essa janela de introdução é um verdadeiro ponto de decisão. Até 31 de agosto, está a pagar $2/$10. Depois disso, $3/$15. Se vai testar o Sonnet 5 de qualquer forma, fazê-lo agora significa que as suas avaliações correm com desconto, e consolida hábitos enquanto a matemática é mais favorável. O outro lado: não construa um orçamento com base em preços de introdução que perde em dois meses.
Duas funcionalidades da plataforma mudam a fatura real mais do que a taxa de tabela. O prompt caching permite reutilizar um contexto em cache em vez de pagar o preço total de input em cada volta, com poupanças de até cerca de 90% na porção em cache. O processamento em batch reduz custos em cerca de 50% para trabalhos não urgentes que pode executar de forma assíncrona. Ambos estão documentados nos preços da plataforma da Anthropic. Se o seu agente reenvia o mesmo prompt de sistema ou base de código grande em cada volta, o prompt caching é a maior alavanca que tem sobre o custo. Aprofundamos mais táticas no nosso guia sobre reduzir custos de API LLM.

A $2 por milhão de tokens de input, o Sonnet 5 torna os ciclos de agente em alto volume baratos o suficiente para os deixar a correr. Essa é a mudança. A pergunta já não é "posso dar-me ao luxo de correr este agente?" mas sim "quantos deles posso correr em simultâneo?"
Quanto Custa Realmente uma Execução de Agente com Sonnet 5 (reproduzível)
Vamos pôr um número nisto. Não fizemos um benchmark de laboratório, e não vamos fingir que fizemos. O que se segue é um cálculo transparente que pode reproduzir com as suas próprias contagens de tokens, usando as taxas por token publicadas pela Anthropic. Declare os seus pressupostos, faça a aritmética, e a fatura aparece.
O cálculo detalhado
Pegue numa tarefa de agente realista: um refactoring multi-ficheiro que corre cerca de 12 voltas. Assuma aproximadamente 40K tokens de input e 8K tokens de output por volta (caching desligado), porque cada volta reenvia contexto crescente. Isso dá cerca de 480K tokens de input e 96K tokens de output no total. Agora a matemática:
- Sonnet 5 intro: (0,48M × $2) + (0,096M × $10) = $0,96 + $0,96 = $1,92
- Sonnet 5 standard: (0,48M × $3) + (0,096M × $15) = $1,44 + $1,44 = $2,88
- Opus 4.8 standard: (0,48M × $5) + (0,096M × $25) = $2,40 + $2,40 = $4,80
Agora ligue o prompt caching. Se a maior parte desses 480K de input for contexto reutilizado (prompt de sistema, árvore de ficheiros, voltas anteriores) e obtiver perto dos ~90% de poupança documentados na porção em cache, o lado do input baixa de cerca de $0,96 para aproximadamente $0,10, enquanto o output se mantém em $0,96.
| Cenário (12 voltas, ~480K in / ~96K out, caching desligado salvo indicação) | Custo input | Custo output | Total |
|---|---|---|---|
| Sonnet 5 intro ($2/$10) | $0,96 | $0,96 | $1,92 |
| Sonnet 5 standard ($3/$15) | $1,44 | $1,44 | $2,88 |
| Opus 4.8 standard ($5/$25) | $2,40 | $2,40 | $4,80 |
| Sonnet 5 intro + prompt caching (~90% poupança input) | ~$0,10 | $0,96 | ~$1,06 |
Estas são estimativas modeladas com preços públicos por token e os pressupostos de tokens declarados, um cálculo que pode reproduzir, não um benchmark que executámos. Substitua a sua própria contagem de voltas e tamanhos de token e a estrutura mantém-se. Faça as contas você mesmo: a mesma tarefa de agente custa aproximadamente $1,92 no Sonnet 5 intro versus $4,80 no Opus 4.8 standard, e o caching pode baixar a execução do Sonnet 5 para perto de $1,06. Ao longo de mil dessas execuções por mês, é a diferença entre uma fatura de ~$1.900 e uma de ~$4.800.
Selecionar o modelo e medir o seu próprio custo
Não tem de confiar nos nossos pressupostos. Aponte o modelo ao seu próprio workload e leia as contagens reais de tokens. No Claude Code, defina o modelo com uma flag ou nas definições do projeto:
# One-off
claude --model claude-sonnet-5
# Or pin it in .claude/settings.json
{
"model": "claude-sonnet-5"
}Na API da Anthropic, a string de modelo é a mesma, e cada resposta dá-lhe a utilização exata de tokens:
import anthropic
client = anthropic.Anthropic()
resp = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor utils/parser.py for readability."}],
)
# Read the real numbers for your own cost math
print(resp.usage)
# Usage(input_tokens=..., output_tokens=..., cache_read_input_tokens=...)Multiplique input_tokens pela sua taxa de input, output_tokens pela sua taxa de output, some ao longo das voltas, e tem o custo real dessa tarefa. O campo cache_read_input_tokens mostra quanto o caching realmente lhe poupou. Na nossa experiência a encaminhar modelos para clientes, o custo por tarefa é o que move a fatura mensal, não o preço por token de tabela, e a única forma honesta de o conhecer é ler o objeto usage no seu próprio tráfego.
Onde o Sonnet 5 É a Escolha Certa (casos de uso reais)
O Sonnet 5 é a escolha certa para trabalho agêntico e de programação em alto volume onde o custo por tarefa decide a fatura, o que é a maioria do trabalho de agente em produção. Recorra ao Opus 4.8 apenas quando um único passo errado é caro o suficiente para justificar o prémio. Para tudo o que faz ciclos, tenta de novo e reenvia contexto, a taxa de gama média acumula-se a seu favor.
Escolhas concretas:
- Agentes de programação. Refactorings multi-ficheiro, geração de testes e execuções de depuração consomem tokens ao longo de muitas voltas, por isso uma taxa por volta mais baixa importa mais aqui. Veja o nosso resumo de agentes de programação IA para saber onde se encaixa.
- Automação de browser e terminal. Execuções autónomas longas são exatamente para o que a Anthropic construiu as melhorias agênticas, e exatamente onde o custo se acumula.
- Pipelines de trabalho de conhecimento. Resumos, extração e ciclos de investigação à escala beneficiam do caching mais a taxa de gama média.
- Agentes voltados para o cliente. Alto volume de pedidos transforma uma pequena poupança por tarefa numa poupança mensal grande.
Onde o pode correr? É o predefinido no Claude Code, está disponível através da API, e está a ser implementado nas principais plataformas. Se está a escolher ferramentas, a nossa comparação de Cursor e Copilot com o Claude Code cobre os compromissos.
O Sonnet 5 É Melhor Que o Opus 4.8, e Quando É Que o Opus Ainda Vale a Pena?
Não, não "melhor" pelo próprio enquadramento da Anthropic. A Anthropic diz que o Sonnet 5 é "próximo do Opus 4.8," não à frente dele. Escolha o Sonnet 5 para trabalho agêntico e de programação em alto volume, sensível ao custo. Recorra ao Opus 4.8 para o raciocínio de longo horizonte mais difícil, onde um passo errado é caro e a precisão extra justifica o prémio.
Um critério rápido:
- Ciclos de agente em alto volume, sensível ao custo? Sonnet 5.
- Raciocínio mais difícil, precisão num único passo crítica? Opus 4.8.
- A migrar do Sonnet 4.6 e a vigiar o orçamento? Sonnet 5 (mesmo preço standard, mais capaz).
- Workload misto? Encaminhe os 90% fáceis para o Sonnet 5 e escale apenas os casos difíceis para o Opus.
Esse último padrão é onde um gateway LLM para encaminhar modelos e controlar custos compensa. No enquadramento competitivo, alguns meios notam que o Sonnet 5 fica abaixo do GPT-5.5 em preço para programação agêntica, e o Gemini 3.1 Pro joga na mesma gama. Faça benchmarks no seu próprio workload antes de se comprometer, porque o preço por tarefa e a adequação à tarefa raramente alinham da forma que uma tabela de classificação sugere.
O Sonnet 5 não substitui o Opus 4.8. Substitui o uso do Opus 4.8 para tudo.
Para Que É Que o Claude Sonnet 5 NÃO É Bom? (limites honestos)
O Sonnet 5 é gama média, por isso não é a escolha para raciocínio de nível de fronteira, a autonomia de mais longo horizonte, ou tarefas de precisão máxima num único passo. Para isso, o Opus 4.8 continua a ser a aposta mais segura. A proposta de valor toda é "próximo do topo de gama por menos," e "próximo" está a fazer trabalho real nessa frase.
Um limite específico que vale a pena conhecer: a Anthropic diz que o Sonnet 5 tem uma "capacidade muito inferior para executar tarefas de cibersegurança em comparação com os nossos modelos Opus atuais," e nota que nunca desenvolveu um exploit funcional durante testes de vulnerabilidade no Firefox. Se ferramentas de segurança são o seu caso de uso, isso é uma escolha de design deliberada, não um bug, mas planeie em conformidade.
E não assuma um tamanho de janela de contexto. O artigo de lançamento da Anthropic não declara um, o que nos traz aos rumores.
Os Rumores "Fennec": O Que Está Realmente Confirmado (desmistificação)
Muitos dos números a circular sobre o Sonnet 5 não vieram da Anthropic. Aqui está a linha entre o lançamento confirmado e a narrativa de fugas, com cada rumor atribuído a páginas de agregadores e fugas, não ao artigo oficial.
- Nome de código "Fennec". Não confirmado. Esse identificador vazou de um log do Vertex AI meses antes e historicamente correspondia ao Sonnet 4.6, não ao Sonnet 5. A Anthropic não anunciou nenhum nome de código.
- "Janela de contexto de 1M tokens". Não declarada em lado nenhum no artigo de lançamento oficial. Trate qualquer número específico de janela de contexto como não verificado até a Anthropic publicar um.
- "82,1% / 92,4% SWE-bench". Fabricações de agregadores. Cite apenas figuras do artigo oficial ou do system card; ignore o resto.
- "Lançamento a 1 de abril," "treinado em TPUs da Google," "Dev Team Mode." Falso ou não confirmado. O lançamento é a 30 de junho de 2026, e nenhuma dessas funcionalidades ou alegações aparece nos materiais da Anthropic.
A Anthropic nunca anunciou um nome de código "Fennec" para o Sonnet 5. Esse identificador vazou de um log do Vertex AI meses antes e apontava para um modelo diferente. Se uma página está a citar um benchmark preciso sem link para o system card, trate-o como ruído.
Deve Mudar do Sonnet 4.6? (veredito de migração)
Se está no Sonnet 4.6, mudar para o Sonnet 5 é de baixo risco: fica com um modelo mais capaz pelo mesmo preço standard ($3/$15), e a janela de introdução ($2/$10 até 31 de agosto) torna os testes baratos agora. The New Stack enquadra-o como fechar a distância para o Opus 4.8 mantendo-se barato até agosto, o que é uma leitura justa para developers a ponderar a mudança.
Alguns cuidados antes de virar o tráfego de produção:
- Mude a string de modelo para
claude-sonnet-5. É a única alteração de código necessária para a maioria das configurações. - Reavalie quaisquer pressupostos de prompt ou output. Um modelo mais capaz pode mudar o tom, a verbosidade ou a formatação de formas que importam a jusante.
- Valide no seu conjunto de avaliações primeiro. Não troque tráfego de produção por palpites.
- Atenção ao aumento de preço a 31 de agosto se está a orçamentar para além do verão.
O veredito: ao mesmo preço standard do Sonnet 4.6 com melhor desempenho agêntico, ficar no 4.6 é a escolha mais difícil de justificar. Mude agora para apanhar o preço de introdução, espere apenas se tem um ciclo de avaliações congelado, e mantenha o Opus 4.8 reservado para as tarefas mais difíceis. Se a sua equipa está a encaminhar modelos e a debater-se com custos de LLM em produção, oferecemos uma consulta gratuita para mapear isso.
Sobre o Autor
Mert Batur Gurbuz é Co-Fundador da Techsy.io, onde a equipa constrói agentes de IA, sistemas de automação e pipelines de voz/SDR para clientes B2B. Estuda na University of Birmingham e escreve sobre a stack de ferramentas LLM que a equipa da Techsy realmente usa em produção. Ligue-se no LinkedIn.
Credenciais: Co-Fundador, Techsy.io, University of Birmingham. Preços verificados contra o artigo de lançamento da Anthropic a 30-06-2026.
Perguntas Frequentes
O Claude Sonnet 5 já foi lançado?
Sim. A Anthropic lançou o Claude Sonnet 5 a 30 de junho de 2026, como modelo predefinido para o Claude Free e Pro, e disponibilizou-o para utilizadores Max, Team e Enterprise. Também pode aceder através da API da Anthropic e do Claude Code usando a string de modelo claude-sonnet-5.
Quanto custa o Claude Sonnet 5?
O preço de introdução é $2 por milhão de tokens de input e $10 por milhão de tokens de output até 31 de agosto de 2026. Depois disso, passa para o preço standard de $3 por milhão de input e $15 por milhão de output, a mesma taxa standard do Sonnet 4.6 para um modelo mais capaz.
O Claude Sonnet 5 é realmente melhor que o Opus 4.8?
Não pela própria descrição da Anthropic. A Anthropic diz que o desempenho do Sonnet 5 é "próximo do Opus 4.8," não melhor. Para o raciocínio de longo horizonte mais difícil, onde um único passo errado é caro, o Opus 4.8 continua a ser a escolha mais forte. O Sonnet 5 ganha no custo por tarefa, correndo a cerca de um terço do preço standard do Opus.
Qual é a janela de contexto do Claude Sonnet 5?
O artigo de lançamento da Anthropic não declara um tamanho de janela de contexto. Alegações de "1M tokens" a circular em páginas de agregadores não estão confirmadas e não vieram da Anthropic. Até a Anthropic publicar um número oficial, trate qualquer figura específica de janela de contexto como não verificada.
Como uso o Claude Sonnet 5?
Defina a string de modelo para claude-sonnet-5 na API da Anthropic, ou selecione-o no Claude Code com claude --model claude-sonnet-5 ou nas definições do projeto. É também o modelo predefinido para o Claude Free e Pro, por isso não é necessária configuração aí. Leia o objeto usage da resposta para acompanhar os custos reais de tokens.
O Claude Sonnet 5 tem o nome de código "Fennec"?
Não há confirmação. "Fennec" é um identificador vazado que historicamente correspondia ao Sonnet 4.6, e a Anthropic não anunciou nenhum nome de código para o Sonnet 5. O identificador surgiu num log do Vertex AI meses antes deste lançamento, por isso trate qualquer alegação "Fennec igual a Sonnet 5" como um rumor não verificado.
Devo mudar do Sonnet 4.6 para o Sonnet 5?
Provavelmente sim. O Sonnet 5 corre ao mesmo preço standard do Sonnet 4.6 ($3/$15) com melhor desempenho agêntico, e a janela de introdução torna os testes baratos até 31 de agosto. Mude a string de modelo, valide no seu conjunto de avaliações e verifique o comportamento antes de trocar tráfego de produção.
Como se compara o Sonnet 5 ao GPT-5.5 para programação?
O Sonnet 5 é a opção de programação agêntica competitiva em custo da Anthropic, e alguns meios reportam que fica abaixo do GPT-5.5 em preço. Comparações de capacidade dependem do workload, por isso faça benchmarks de ambos na sua própria base de código e mix de tarefas antes de se comprometer. O preço por tarefa e a adequação à tarefa raramente alinham da forma que uma única tabela de classificação implica.
Posso correr o Claude Sonnet 5 no AWS Bedrock?
A Anthropic disponibiliza os modelos Sonnet nas principais plataformas cloud, por isso a disponibilidade no Bedrock e Vertex para claude-sonnet-5 deve seguir à medida que o rollout se completa. Verifique o estado atual da plataforma para a sua região, uma vez que lançamentos no mesmo dia costumam chegar primeiro à API de primeira parte e ao Claude Code antes de todas as plataformas de terceiros.
Como posso reduzir os custos do Claude Sonnet 5?
Use prompt caching para poupanças de até cerca de 90% em contexto reutilizado, e processamento em batch para cerca de 50% de poupança em trabalhos não urgentes. Encaminhe apenas as tarefas mais difíceis para o Opus 4.8 e mantenha o trabalho em alto volume no Sonnet 5. Leia o objeto usage para ver exatamente para onde vão os seus tokens.