Techsy
Contacto
Começar
Voltar ao blog
ai-machine-learning

Claude Opus 4.8 Chegou: O Que Mudou, Onde Ganha (e o Único Onde Perde)

Escrito por Mert Batur Gürbüz
May 28, 2026
15 min de leitura
Índice
Claude Opus 4.8 Chegou: O Que Mudou, Onde Ganha (e o Único Onde Perde)

Claude Opus 4.8 Chegou: O Que Mudou, Onde Ganha (e o Único Onde Perde)

A Anthropic lançou o Claude Opus 4.8 a 28 de maio de 2026, apenas 41 dias após o 4.7. É a cadência Opus mais rápida que já vimos. O número de destaque, 69,2% no SWE-Bench Pro, é real, e a ressalva também: perde um benchmark por completo. Eis o que mudou, e se deve redirecionar já o seu modelo predefinido ou esperar.

Pontos essenciais:

  • O Claude Opus 4.8 foi lançado a 28 de maio de 2026, 41 dias após o 4.7, no Claude.ai, no Claude Code e na API.
  • Lidera 6 de 7 benchmarks da Anthropic, mas perde o Terminal-Bench 2.1 para o GPT-5.5 (74,6% vs 78,2%).
  • Os preços mantêm-se em $5/$25 por milhão de tokens; o novo Fast Mode é ~2,5x mais rápido a $10/$50.

O Que Foi Lançado Hoje: Claude Opus 4.8 em Um Minuto

O Claude Opus 4.8 é o modelo de fronteira da Anthropic, lançado a 28 de maio de 2026, e disponível hoje no Claude.ai, no Claude Code e na API. O ID do modelo é claude-opus-4-8, com uma variante de contexto de 1M tokens, claude-opus-4-8[1m]. O preço standard mantém-se inalterado face ao 4.7, em $5/$25 por milhão de tokens. O veredicto curto: uma atualização real para programação e trabalho de conhecimento, com uma exceção honesta.

Trata-se de um lançamento incremental, não de uma reconstrução de raiz. Se vem do Claude Opus 4.7, a maior parte do que já sabe mantém-se: o formato da API, o conceito de controlo de esforço, a integração com o Claude Code. O que é diferente é o teto dos benchmarks, um Fast Mode mais barato e uma nova funcionalidade em pré-visualização de investigação para trabalho à escala de codebase.

O Opus 4.8 chegou apenas 41 dias após o 4.7, a cadência Opus mais rápida que a Anthropic já lançou. A variante de contexto de 1M tokens existe como claude-opus-4-8[1m], embora a página pública de documentação de Modelos possa ainda estar a atualizar-se. Segundo o anúncio da Anthropic, é o seu modelo "mais honesto" até à data, uma afirmação a que voltaremos.

O Que É Realmente Novo no Opus 4.8 vs 4.7?

As maiores mudanças do 4.7 para o 4.8 são o alinhamento, a eficiência na chamada de ferramentas e uma nova funcionalidade de orquestração. A Anthropic afirma que o Opus 4.8 é aproximadamente 4x menos provável do que o 4.7 de deixar passar sem sinalização uma falha no seu próprio código, conclui tarefas agênticas em menos passos e introduz os Dynamic Workflows para migrações de grande escala. Os preços e a API principal mantiveram-se.

Honestidade e alinhamento

Segundo o anúncio, o Opus 4.8 tem maior probabilidade de sinalizar incerteza, evitar afirmações sem suporte e apontar problemas no código que acabou de escrever. A Anthropic diz que as taxas de comportamento desalinhado são "substancialmente inferiores às do Opus 4.7" e cita um testemunho da Bridgewater sobre o modelo a levantar questões proativamente. Para quem depende de IA para detetar falhas no código, esse número de "4x menos provável de deixar falhas passar" é a linha a acompanhar. Trate-o como uma afirmação do fornecedor até o testar nos seus próprios pull requests.

Controlo de esforço e a alteração na Messages API

Os níveis de esforço são agora selecionáveis pelo utilizador diretamente no Claude.ai, pelo que pode trocar gasto de tokens por profundidade sem descer para um modelo mais pequeno. Há também uma alteração pequena mas real na experiência de desenvolvimento: a Messages API agora aceita entradas de sistema dentro do array messages, e não apenas como parâmetro system de nível superior. Se constrói agentes, isto torna as instruções de sistema a meio da conversa mais fáceis de gerir.

Chamada de ferramentas mais eficiente

A Anthropic descreve a chamada de ferramentas como "significativamente mais eficiente, menos passos para a mesma inteligência", medida no CursorBench em vários níveis de esforço. No seu benchmark interno Super-Agent, afirma que o Opus 4.8 foi o único modelo a completar todos os casos de ponta a ponta com paridade de custos face ao GPT-5.5. Menos chamadas de ferramentas por tarefa é uma alavanca de custo direta para quem constrói agentes, pelo que isto importa mais do que parece.

Benchmarks do Opus 4.8: Onde Ganha (e o Único Onde Perde)

O Opus 4.8 lidera 6 de 7 benchmarks da Anthropic, incluindo o SWE-Bench Pro (69,2%) e o GDPval-AA (1890 Elo). A exceção, e aquela sobre a qual é preciso ser honesto: o GPT-5.5 ainda ganha em programação agêntica de terminal no Terminal-Bench 2.1, com 78,2% contra os 74,6% do Opus 4.8. Por isso, se o seu trabalho vive no terminal, o melhor modelo no geral não é o melhor modelo para si.

BenchmarkOpus 4.8Opus 4.7GPT-5.5Gemini 3.1 Pro
Programação agêntica, SWE-Bench Pro69,2%64,3%58,6%54,2%
Programação agêntica de terminal, Terminal-Bench 2.174,6%66,1%78,2%70,3%
Raciocínio multidisciplinar, Humanity's Last Exam (sem ferramentas)49,8%46,9%41,4%44,4%
Raciocínio multidisciplinar, Humanity's Last Exam (com ferramentas)57,9%54,7%52,2%51,4%
Utilização agêntica de computador, OSWorld-Verified83,4%82,8%78,7%76,2%
Trabalho de conhecimento, GDPval-AA (Elo)1890175317691314
Análise financeira agêntica, Finance Agent v253,9%51,5%51,8%43,0%

Comparação de benchmarks do Claude Opus 4.8 vs Opus 4.7, GPT-5.5 e Gemini 3.1 Pro em SWE-Bench Pro, Terminal-Bench 2.1, Humanity's Last Exam, OSWorld-Verified, GDPval-AA e Finance Agent v2
Fonte: Anthropic

Leia os deltas, não apenas as pontuações absolutas. O SWE-Bench Pro subiu +4,9 pontos (64,3 para 69,2), o ganho de programação em destaque. O Terminal-Bench 2.1 subiu +8,5 pontos (66,1 para 74,6), o maior salto do 4.7 para o 4.8, e ainda assim fica atrás do GPT-5.5. O GDPval-AA ganhou +137 Elo (1753 para 1890), um grande salto em trabalho de conhecimento que também ultrapassa o GPT-5.5 (1769) por larga margem. O OSWorld-Verified moveu-se apenas +0,6 (82,8 para 83,4); a utilização de computador já estava perto do teto no 4.7, pelo que não espere uma diferença percetível aí. O Finance Agent v2 somou +2,4 pontos.

A conclusão é clara: o Opus 4.8 ganha seis de sete benchmarks, e aquele que perde, programação agêntica de terminal, continua a ir para o GPT-5.5. Números corroborados pelo anúncio da Anthropic e pela ronda de benchmarks do OfficeChai.

O Que É o Fast Mode, e É Mais Barato?

O Fast Mode executa o Opus 4.8 cerca de 2,5x mais rápido a $10 de input / $50 de output por milhão de tokens, ativado com /fast no Claude Code. A Anthropic diz que é "três vezes mais barato do que era nos modelos anteriores." O preço standard mantém-se em $5/$25 por Mtok, inalterado face ao 4.7. O ponto-chave: o Fast Mode mantém-no no modelo Opus completo, não o rebaixa para um modelo mais pequeno.

Então o que significa isto por tarefa? Paga um prémio de preço de 2x por aproximadamente 2,5x a velocidade, com a mesma inteligência do modelo. Para sessões interativas de Claude Code em que está à espera de output, essa troca muitas vezes compensa. Para trabalhos longos em lote onde o tempo real não importa, o preço standard é a opção mais barata.

bash
# In a Claude Code session, switch the current task to Fast Mode:
/fast

# Output streams ~2.5x faster on the same claude-opus-4-8 model.
# Standard pricing ($5/$25) resumes on your next normal task.

O acesso mais alargado à API para o Fast Mode é disponibilizado através do seu gestor de conta ou de uma lista de espera. Se já está a esbarrar nos limites de taxa, o nosso guia sobre limites de utilização do Claude explica como os escalões interagem com o custo. Uma ressalva honesta: "3x mais barato do que antes" significa que o próprio Fast Mode ficou mais barato face ao antigo escalão Fast, não que é mais barato do que o preço standard do Opus. Não é.

Dynamic Workflows: Migrações à Escala de Codebase com Subagentes Paralelos

Os Dynamic Workflows são uma funcionalidade em pré-visualização de investigação nos planos Enterprise, Team e Max que coordena "enxames de subagentes", centenas de subagentes paralelos numa única sessão. Combinado com o Claude Code e o Opus 4.8, a Anthropic afirma que consegue executar migrações à escala de codebase em centenas de milhares de linhas, desde o arranque até ao merge, com intervenção mínima.

Os Dynamic Workflows permitem que uma sessão do Claude Code se ramifique em centenas de subagentes paralelos para migrar um codebase inteiro. Pense em atualizações de framework, renovações de dependências ou refatores em todo o repositório que normalmente consumiriam a semana de um engenheiro. Se já trabalhou com agentes de programação paralelos, esta é essa ideia escalada e orquestrada pelo modelo em vez de por si.

Duas notas honestas. Primeiro, é uma pré-visualização de investigação, pelo que deve esperar arestas por limar e não o deve apontar a migrações críticas de produção sem revisão. Segundo, está limitado por plano, precisa de acesso Enterprise, Team ou Max. O TechCrunch enquadrou os Dynamic Workflows como a resposta da Anthropic à pressão competitiva de laboratórios rivais, e essa leitura faz sentido: é a funcionalidade de desenvolvimento em destaque deste lançamento.

Testámos o Opus 4.8 no Claude Code: Eis o Que Medimos

Redirecionámos o modelo predefinido do repositório do nosso pipeline de conteúdo de claude-opus-4-7 para claude-opus-4-8 e voltámos a executar as mesmas tarefas agênticas que usamos no dia a dia. Eis o que podemos dizer honestamente após a utilização prática inicial, qualitativo onde não temos números concretos de antes/depois, específico onde os temos.

Primeiro, a troca é genuinamente trivial. Mudar o ID do modelo para claude-opus-4-8 e iniciar uma sessão funcionou com zero alterações de configuração do nosso lado. A variante de contexto de 1M é endereçável como claude-opus-4-8[1m] se precisar da janela maior. Confirmámos que o Fast Mode com /fast o mantém no modelo Opus completo em vez de encaminhar silenciosamente para um modelo mais pequeno e barato, que é o comportamento que queríamos mas que não dávamos como garantido.

O que se destacou na utilização inicial: o Opus 4.8 está visivelmente mais disposto a contestar. Numa tarefa de refatoração, sinalizou uma suposição no nosso código existente como arriscada em vez de construir silenciosamente por cima dela, o tipo de comportamento que a afirmação da Anthropic de "4x menos provável de deixar falhas passar" prevê. Não vamos disfarçar isso de benchmark, é uma observação numa tarefa. Mas é a primeira coisa que notámos, e alinha-se com a narrativa de alinhamento.

O ganho de velocidade do Fast Mode foi real e óbvio em sessões interativas, o output começou a fluir mais depressa, embora não estejamos a publicar um número preciso de latência até termos um teste de temporização limpo e repetível. Se fizer a sua própria comparação, o método honesto é: o mesmo prompt, o mesmo estado do repositório, modo standard e depois /fast, e medir tanto o tempo real como o custo em tokens em ambos. Atualizaremos esta secção com números concretos quando esse teste estiver concluído.

Deve Atualizar do 4.7? (Mudar Já / Esperar / Ficar)

Se deve atualizar depende inteiramente da sua carga de trabalho, não de qual modelo "ganha" no geral. Os saltos no SWE-Bench Pro e no GDPval-AA são grandes e reais, pelo que utilizadores de programação e trabalho de conhecimento devem mudar. Equipas com forte componente de terminal têm uma razão genuína para esperar. Utilizadores sensíveis ao custo em tarefas perto do teto podem ficar no 4.7 sem perder quase nada.

Mude já se: o seu trabalho depende de programação agêntica (SWE-Bench Pro +4,9) ou tarefas de conhecimento (GDPval-AA +137 Elo). Estes são os maiores ganhos reais, e nos nossos testes o salto no SWE-Bench manifestou-se em PRs reais como menos caminhos errados. Os preços não mudaram, pelo que não há penalização de custo por atualizar.

Espere se: o seu fluxo de trabalho é fortemente orientado ao terminal, o GPT-5.5 ainda lidera o Terminal-Bench 2.1 (78,2% vs 74,6%), pelo que o enquadramento de "melhor modelo" ainda não se aplica a si. Espere também se está a meio de um projeto e uma troca de modelo iria turvar a sua avaliação.

Fique no 4.7 se: é sensível ao custo e o seu caso de utilização já está perto do teto, como a utilização de computador, onde o OSWorld-Verified se moveu apenas +0,6. Estaria a pagar o custo de mudança de atenção por um delta que não vai sentir.

Se o seu trabalho depende de programação ao estilo SWE-Bench ou tarefas de conhecimento, o 4.8 é uma atualização clara; se é fortemente orientado ao terminal, o GPT-5.5 pode ainda ter vantagem. Para o panorama mais alargado, veja onde o Opus 4.8 se situa entre os melhores agentes de programação com IA, e consulte o lançamento do 4.7 se quer o quadro completo dos deltas.

Como Mudo para o Opus 4.8 no Claude Code e na API?

A mudança é uma troca de ID de modelo quase trivial. Defina o seu modelo predefinido como claude-opus-4-8 (ou claude-opus-4-8[1m] para a janela de contexto de 1M), escolha um nível de esforço se o seu cliente o expuser, e está feito. Se constrói com a Messages API, pode agora colocar entradas de sistema dentro do array messages em vez de apenas no campo system de nível superior.

bash
# Claude Code: set the default model
/model claude-opus-4-8

# API request body (model ID swap):
{
  "model": "claude-opus-4-8",
  "messages": [
    { "role": "system", "content": "You are a senior engineer." },
    { "role": "user", "content": "Refactor this module." }
  ]
}

É toda a migração para a maioria das equipas. Se executa modelos em vários fornecedores e quer testar o 4.8 contra o GPT-5.5 ou o Gemini 3.1 Pro nas suas próprias tarefas, um proxy permite-lhe encaminhar entre modelos sem reescrever a sua aplicação. Comece em modo standard, confirme a qualidade do output na sua carga de trabalho real, e depois decida se a troca de velocidade por preço do Fast Mode vale a pena.

Na Techsy, construímos agentes de IA de produção exatamente nesta stack. Se está a escolher modelos para a construção de um agente, obtenha uma consulta gratuita e ajudamo-lo a escolher o certo para a sua carga de trabalho.

Sobre o Autor

Mert Batur Gurbuz é Cofundador da Techsy.io, onde a equipa entrega agentes de IA, sistemas de automação e pipelines de voz/SDR para clientes B2B. Estuda na University of Birmingham e escreve sobre a stack de ferramentas LLM que a equipa da Techsy realmente usa em produção.

Cofundador, Techsy.io, University of Birmingham · LinkedIn

Perguntas Frequentes

O que é o Claude Opus 4.8?

O Claude Opus 4.8 é o modelo de fronteira da Anthropic, lançado a 28 de maio de 2026, com o ID de modelo claude-opus-4-8 e uma variante de contexto de 1M, claude-opus-4-8[1m]. A Anthropic posiciona-o como o seu modelo mais honesto até agora, liderando 6 de 7 dos seus benchmarks publicados e disponível no Claude.ai, no Claude Code e na API.

Quando foi lançado o Claude Opus 4.8?

O Claude Opus 4.8 foi lançado a 28 de maio de 2026, apenas 41 dias após o Opus 4.7, a cadência Opus mais rápida que a Anthropic já lançou. Ficou disponível no mesmo dia no Claude.ai, no Claude Code e na API da Anthropic, sem lançamento faseado, pelo que pode redirecionar o seu modelo predefinido imediatamente.

O Claude Opus 4.8 é melhor do que o Opus 4.7?

Para a maioria do trabalho, sim. O Opus 4.8 lidera o SWE-Bench Pro com 69,2% vs 64,3%, ganha +137 Elo no GDPval-AA e vence 6 de 7 benchmarks contra o 4.7. A exceção é a programação agêntica de terminal, onde o GPT-5.5 ainda pontua mais alto do que ambos. Os preços mantêm-se inalterados, pelo que não há penalização de custo por atualizar.

Vale a pena atualizar do 4.7 para o Opus 4.8?

Depende da sua carga de trabalho. Mude já se faz programação agêntica ou trabalho de conhecimento, onde os ganhos são maiores. Espere se o seu trabalho é fortemente orientado ao terminal, uma vez que o GPT-5.5 ainda lidera aí. Fique no 4.7 se é sensível ao custo em tarefas perto do teto, como a utilização de computador, onde o delta é de apenas +0,6 pontos.

Quanto custa o Claude Opus 4.8?

O preço standard é $5 por milhão de tokens de input e $25 por milhão de tokens de output, idêntico ao Opus 4.7, pelo que não há aumento de preço. O Fast Mode custa $10/$50 por milhão de tokens e é cerca de 2,5x mais rápido no mesmo modelo. A Anthropic diz que o Fast Mode é três vezes mais barato do que o escalão Fast-Mode anterior.

O que é o Fast Mode no Claude Opus 4.8?

O Fast Mode é um escalão de maior velocidade que executa o Opus 4.8 cerca de 2,5x mais rápido a $10 de input / $50 de output por milhão de tokens, ativado com /fast no Claude Code. Crucialmente, mantém-no no modelo claude-opus-4-8 completo em vez de o rebaixar para um modelo mais pequeno. A Anthropic diz que é três vezes mais barato do que o escalão Fast-Mode anterior.

O que são os Dynamic Workflows no Claude Code?

Os Dynamic Workflows são uma funcionalidade em pré-visualização de investigação nos planos Enterprise, Team e Max que coordena centenas de subagentes paralelos numa única sessão. Combinado com o Claude Code e o Opus 4.8, consegue executar migrações à escala de codebase em centenas de milhares de linhas, do arranque ao merge. Espere arestas por limar, uma vez que ainda é uma pré-visualização.

O Opus 4.8 suporta uma janela de contexto de 1M tokens?

Sim, através da variante claude-opus-4-8[1m]. Endereça-a por esse ID de modelo quando precisa da janela de contexto maior. Note que a página pública de documentação de Modelos pode ainda estar a atualizar-se e pode não listar a entrada do 4.8, mas a variante é endereçável em tempo de execução hoje.

O Claude Opus 4.8 bate mesmo o GPT-5.5 em tudo?

Não. O GPT-5.5 ainda ganha em programação agêntica de terminal no Terminal-Bench 2.1, com 78,2% contra os 74,6% do Opus 4.8. O Opus 4.8 lidera os outros seis benchmarks publicados, incluindo o SWE-Bench Pro e o GDPval-AA, mas se o seu fluxo de trabalho é fortemente orientado ao terminal, o GPT-5.5 continua a ser a escolha mais forte para essa tarefa específica.

Como mudo para o Opus 4.8 no Claude Code?

Defina o seu modelo como claude-opus-4-8 (use /model claude-opus-4-8 no Claude Code) e escolha um nível de esforço se o seu cliente o oferecer. Para a janela de contexto de 1M, use claude-opus-4-8[1m]. É uma troca quase trivial sem outras alterações de configuração necessárias para a maioria das equipas.

Etiquetas

Claude Opus 4.8claude-opus-4-8claude codeanthropicopus 4.8 vs 4.7

Partilhar este artigo

Artigos relacionados

Mais em ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 chegou: inteligência quase Fable 5 a metade do preço

A Anthropic lançou o Claude Opus 5 a 24 de julho de 2026. Mais do que duplica o Opus 4.8 no Frontier-Bench e mantém o preço do Opus, mas perde alguns testes para o Fable 5 e o Mythos 5. Eis a tabela de benchmarks, o preço e a recomendação de mudar/esperar/ficar.

10 min read min de leitura
Ler
ai-machine-learning
Jul 20, 2026

8 Melhores APIs de Web Scraping com IA em 2026 (Testadas na Nossa Própria Stack de Agentes)

Testámos 8 APIs de web scraping com IA com preços reais de 2026, obtidos através da nossa própria stack de agentes. Firecrawl, Bright Data, ScrapingBee e mais 5, classificadas por output pronto para LLM, anti-bot e suporte MCP.

9 min read min de leitura
Ler
ai-machine-learning
Jul 20, 2026

Engenharia de Prompts para Programação: 7 Padrões Que Usamos Diariamente no Claude Code e Cursor (2026)

A maioria dos artigos sobre 'prompts de IA para programação' oferece 50 modelos para copiar. Este ensina os 7 padrões que usamos todos os dias para gerir um pipeline de 16 agentes no Claude Code, com exemplos reais de antes e depois, além de indicar onde cada padrão se encaixa no Claude Code, Cursor e Copilot em 2026.

11 min read min de leitura
Ler
Ver todos os artigos
Inicia o Teu Projeto

Pronto para criar algo extraordinário?

Vamos transformar a sua visão em realidade. A nossa equipa está pronta para o ajudar a criar software que faz a diferença.

Marca uma chamada de scope 30 minVer o Nosso Trabalho

Destaque da biblioteca

Skills do Claude

Ver tudo
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Automações AI

Ver tudo
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Destaque da biblioteca

Skills do Claude

Ver tudo
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Automações AI

Ver tudo
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Serviços

  • Soluções Empresariais
  • Aplicações Móveis
  • Aplicações Web

Soluções

  • Sistemas CRM
  • Integração de IA
  • Soluções ERP
  • Agentes de Voz
  • Automação de Processos
  • Cibersegurança

Biblioteca

  • Blogue
  • Portfólio

Comunidade

  • Automações AI
  • Skills do Claude

Ferramentas

  • Calculadora de Custo de App Móvel
  • Calculadora de Custo de API OpenAI / LLM
  • Calculadora de Custo de MVP
  • Calculadora de Custo de Agente de Voz AI

Empresa

  • Sobre
  • Parceiros
  • Contacto

Legal

  • Política de Privacidade
  • Termos de Serviço
  • Política de Cookies

Serviços

  • Soluções Empresariais
  • Aplicações Móveis
  • Aplicações Web

Soluções

  • Sistemas CRM
  • Integração de IA
  • Soluções ERP
  • Agentes de Voz
  • Automação de Processos
  • Cibersegurança

Biblioteca

  • Blogue
  • Portfólio

Comunidade

  • Automações AI
  • Skills do Claude

Ferramentas

  • Calculadora de Custo de App Móvel
  • Calculadora de Custo de API OpenAI / LLM
  • Calculadora de Custo de MVP
  • Calculadora de Custo de Agente de Voz AI

Empresa

  • Sobre
  • Parceiros
  • Contacto
LegalPolítica de PrivacidadeTermos de ServiçoPolítica de Cookies
TECHSY
© 2026 Techsy. Todos os direitos reservados.