Techsy
Contacto
Começar
Voltar ao blog
ai-machine-learning

Claude Opus 5 chegou: inteligência quase Fable 5 a metade do preço

Escrito por Mert Batur Gürbüz
Jul 24, 2026
15 min de leitura
Índice
Claude Opus 5 chegou: inteligência quase Fable 5 a metade do preço

Claude Opus 5 chegou: inteligência quase Fable 5 a metade do preço

A Anthropic lançou o Claude Opus 5 a 24 de julho de 2026, e a proposta é direta: inteligência de fronteira quase ao nível do Fable 5, a metade do preço. A prova principal é o Frontier-Bench v0.1, onde o Opus 5 marca 43,3% e mais do que duplica os 21,1% do Opus 4.8. O senão — e há sempre um — é que não ganha tudo. O GPT-5.6 Sol continua a superá-lo num teste de codificação agêntica, e em saúde e biologia a coroa vai para o Mythos 5. Eis o que realmente mudou, a tabela completa de benchmarks e se deve reconfigurar já o seu modelo predefinido.

Pontos-chave:

  • O Claude Opus 5 foi lançado a 24 de julho de 2026 na Claude API, Claude.ai, Claude Code e Claude Cowork, com o ID de modelo claude-opus-5.
  • Lidera a maioria dos benchmarks publicados pela Anthropic (Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench), mas fica atrás em alguns testes de codificação, direito e ciência.
  • O preço mantém-se inalterado face ao Opus 4.8: 5 $/25 $ por milhão de tokens, com um modo Fast a cerca de 2x o preço para aproximadamente 2,5x a velocidade.

O que foi lançado hoje: Claude Opus 5 em um minuto

O Claude Opus 5 é o novo modelo de fronteira da Anthropic, lançado a 24 de julho de 2026 e disponível no mesmo dia na API, Claude.ai, Claude Code e Claude Cowork. O ID de modelo é claude-opus-5. O enquadramento da Anthropic, segundo o anúncio, é que "aproxima-se da inteligência de fronteira do Claude Fable 5 a metade do preço." O preço padrão mantém-se em 5 $ de entrada / 25 $ de saída por milhão de tokens, o mesmo que o Opus 4.8.

Este é um salto geracional real para trabalho agêntico, não uma atualização pontual. Se vem do Claude Opus 4.8, a forma da API e a integração com o Claude Code transitam inalteradas, pelo que a migração é apenas uma troca de ID de modelo. O que é diferente é o teto: no Frontier-Bench v0.1, a Anthropic afirma que o Opus 5 mais do que duplica a pontuação do 4.8 com um custo por tarefa inferior, e regista números de estado da arte no GDPval-AA e no ARC-AGI-3.

O posicionamento importa. O Fable 5 é o modelo de fronteira mais caro da Anthropic. Chegar a distância de ataque com preços de Opus é toda a história deste lançamento, e é por isso que a frase "metade do preço" é aquela com que a Anthropic abre.

O que é realmente novo no Opus 5 face ao 4.8?

A maior mudança do 4.8 para o 5 é o discernimento: o Opus 5 é notavelmente melhor a verificar o seu próprio trabalho e a iterar até a tarefa estar realmente concluída, não apenas plausivelmente terminada. A Anthropic cita também engenharia de software mais forte, trabalho de conhecimento e investigação científica, além de melhor output visual. O preço e a API principal mantiveram-se.

Melhor discernimento e autoverificação

A mudança comportamental mais clara é que o Opus 5 se verifica a si próprio. A Anthropic cita Zimu Li, membro da equipa técnica, descrevendo o modelo como aquele que "verifica ramificações, confirma modelos" em vez de avançar de rompante. Para quem depende de um agente para detetar os próprios erros em produção, essa é a característica que faz a diferença. É também a mais difícil de vender num gráfico de benchmarks, pelo que deve ser tratada como uma alegação a testar nas suas próprias tarefas.

Inteligência de fronteira a custo de Opus

Sualeh Asif, cofundador da Cursor, resumiu o lançamento como "inteligência quase Fable 5 à velocidade e custo do Opus." É essa a leitura prática: equipas que queriam raciocínio de classe Fable 5 mas não conseguiam justificar o preço têm agora uma opção intermédia. No OSWorld 2.0, a Anthropic afirma que o Opus 5 supera o Fable 5 a cerca de um terço do custo, o que é o exemplo individual mais limpo do argumento de valor.

Alinhamento e postura de segurança

A Anthropic reporta que o Opus 5 tem a sua pontuação mais baixa de comportamento desalinhado até à data (2,3) e chama-lhe o modelo mais alinhado com a sua Constituição. No lado da segurança, os classificadores de cibersegurança são descritos como cerca de 85% menos restritivos que os do Fable 5, com um Cyber Verification Program empresarial para equipas que dele necessitem. Como com qualquer alegação de segurança de um fornecedor, útil saber, mas continua a valer a pena validar contra os seus próprios casos de red-team.

Benchmarks do Opus 5: onde ganha (e onde perde)

O Opus 5 lidera a maioria dos benchmarks publicados pela Anthropic, e as vitórias que importam para construtores de agentes são esmagadoras: Frontier-Bench v0.1 (43,3%), GDPval-AA (1861 Elo), ARC-AGI-3 (30,2%), OSWorld 2.0 (70,6%) e AutomationBench da Zapier (26,0%). As exceções honestas: o GPT-5.6 Sol ganha o DeepSWE v1.1, o Fable 5 supera por margem mínima o FrontierCode e os testes de direito, e o Mythos 5 leva saúde e biologia.

BenchmarkOpus 5Fable 5Opus 4.8GPT-5.6 Sol
Codificação de terminal agêntica, Frontier-Bench v0.143,3%33,7%21,1%34,4%
Trabalho de conhecimento, GDPval-AA v2 (Elo)1861174715931736
Resolução de problemas novos, ARC-AGI-330,2%—1,5%7,8%
Pesquisa agêntica, BrowseComp90,8%87,4%84,3%90,4%
Raciocínio multidisciplinar, Humanity's Last Exam (com ferramentas)64,7%63,9%57,9%—
Utilização de computador agêntica, OSWorld 2.070,6%66,1%55,7%62,6%
Codificação agêntica, DeepSWE v1.168,8%69,7%59,0%72,7%
Codificação agêntica, FrontierCode v1.1 (Main)53,4%53,5%46,5%47,5%
Fluxos de trabalho empresariais, AutomationBench26,0%17,4%17,0%18,1%
Legal Agent Benchmark (reservado)11,7%13,3%10,4%2,5%
Saúde, HealthBench Professional59,8%66,0%57,4%60,5%
Biologia, BioMysteryBench (difícil)49,4%46,5%42,4%—

Comparação de benchmarks do Claude Opus 5 vs Fable 5, Opus 4.8 e GPT-5.6 Sol no Frontier-Bench, GDPval-AA, ARC-AGI-3, OSWorld 2.0, AutomationBench e mais
Fonte: Anthropic

Leia os deltas, não apenas as pontuações absolutas. O Frontier-Bench saltou +22,2 pontos face ao Opus 4.8 (de 21,1 para 43,3), o maior salto individual e a razão pela qual a Anthropic chama a isto um lançamento de codificação e agentes. O GDPval-AA ganhou +268 Elo (de 1593 para 1861), ultrapassando todos os modelos da tabela em trabalho de conhecimento. O ARC-AGI-3 é o que chama a atenção: 30,2% contra 7,8% do GPT-5.6 Sol e 1,5% do Opus 4.8, o que a Anthropic enquadra como aproximadamente 3x o próximo melhor modelo público em resolução de problemas novos. No AutomationBench, 26,0% é cerca de 1,5x o campo, um sinal direto para quem constrói agentes de processos empresariais.

Duas notas honestas sobre as derrotas. Primeiro, o líder na coluna do Fable 5 em saúde (66,0%) e na divisão de biologia resolvida por humanos é na verdade o Mythos 5, o modelo especializado em ciência da Anthropic, não o Fable 5, pelo que essas não são vitórias comparáveis entre modelos gerais. Segundo, o cenário de codificação está genuinamente dividido: o GPT-5.6 Sol leva o DeepSWE v1.1 (72,7% vs 68,8%) e o Fable 5 ganha o FrontierCode por um fio (53,5% vs 53,4%). Se o seu trabalho é codificação pura ao estilo SWE-bench, o rótulo "melhor no geral" não escolhe automaticamente o Opus 5.

Quanto custa o Opus 5? Preço e modo Fast

O preço padrão do Opus 5 é 5 $ por milhão de tokens de entrada e 25 $ por milhão de tokens de saída, idêntico ao Opus 4.8 segundo o preçário publicado da Anthropic, pelo que não há aumento de preço pela atualização. A alegação de "metade do preço" é relativa ao Fable 5, não ao 4.8: obtém inteligência quase Fable 5 sem pagar tarifas de Fable 5. O modo Fast funciona a cerca de 2x o preço base para aproximadamente 2,5x a velocidade padrão, e a API suporta encaminhamento de recurso.

Então o que significa isto por tarefa? Com o preço padrão não paga nada extra face ao 4.8 e obtém um salto de capacidade substancial, o que torna a atualização quase gratuita para a maioria das cargas de trabalho. O modo Fast é a alavanca para sessões interativas: troca um prémio de preço de 2x por output que flui cerca de 2,5x mais rápido no mesmo modelo, o que compensa quando está à espera e prejudica quando executa lotes noturnos onde o tempo real é irrelevante. Se os limites de taxa são a sua restrição real, o nosso guia sobre limites de utilização do Claude cobre como os escalões interagem com o custo.

bash
# Claude Code: point your default model at Opus 5
/model claude-opus-5

# API request body (model ID swap):
{
  "model": "claude-opus-5",
  "messages": [
    { "role": "user", "content": "Refactor this module and verify the tests pass." }
  ]
}

Onde o Opus 5 se posiciona para agentes em produção

Os ganhos concentram-se exatamente onde os agentes em produção vivem: codificação de terminal (Frontier-Bench), utilização de computador (OSWorld 2.0), pesquisa agêntica (BrowseComp) e fluxos de trabalho empresariais multi-etapa (AutomationBench). Esses quatro são as cargas de trabalho que mais frequentemente falham em implementações reais, pelo que um modelo que salta nos quatro em simultâneo muda o que é possível entregar.

Essa é a parte em que vale a pena refletir. Um benchmark como o AutomationBench mede se um agente consegue completar um fluxo de trabalho real com múltiplas ferramentas de ponta a ponta, e os 26,0% do Opus 5 contra cerca de 17% do campo são a diferença entre "funciona bem em demo" e "sobrevive ao contacto com um CRM desorganizado." O resultado do OSWorld 2.0 (70,6%, batendo o Fable 5 a um terço do custo) diz o mesmo para agentes de utilização de computador que clicam através de software real. Para equipas que entregam agentes de IA para clientes, esses são os números que se traduzem em menos falhas às 2 da manhã.

Também reduz o custo de um padrão de design em que apostamos: autoverificação barata. Quando o modelo é genuinamente melhor a verificar as suas próprias ramificações, pode gastar menos tokens numa passagem de crítico separada e ainda assim detetar os mesmos erros. Isso é uma linha de orçamento real para quem executa agentes em volume.

Como estamos a integrar o Opus 5 na nossa stack

Construímos e operamos agentes de IA em produção na stack Claude na Techsy, pelo que um lançamento de fronteira é uma avaliação no mesmo dia, não uma manchete que lemos e seguimos em frente. Eis a nossa primeira leitura honesta, qualitativa onde ainda não temos números limpos de antes/depois, específica onde temos.

A troca em si é trivial, e esse é o ponto. Os nossos pipelines de conteúdo e automação fixam um modelo predefinido na configuração; mudar claude-opus-4-8 para claude-opus-5 e reiniciar uma sessão não exigiu quaisquer outras alterações, tal como todas as atualizações recentes do Opus. Se encaminha entre fornecedores e quer fazer A/B do Opus 5 contra o Fable 5 ou o GPT-5.6 Sol nas suas próprias tarefas, um proxy permite-lhe trocar de modelos sem reescrever a aplicação.

O que estamos a observar primeiro é a alegação de autoverificação, porque é a que realmente mudaria a nossa arquitetura. Os nossos agentes atuais executam um passo de crítico explícito para detetar edições más antes de serem aplicadas; se o Opus 5 sinalizar de forma fiável as suas próprias ramificações fracas, podemos afinar esse passo e poupar tokens. Não estamos a publicar um número sobre isso até termos executado num conjunto de tarefas repetível, a mesma disciplina que quereríamos de qualquer pessoa a citar métricas de agentes. Se quer o método, é o mesmo do nosso guia de avaliação de agentes de IA em produção: os mesmos prompts, o mesmo estado do repositório, contar os erros, não as impressões.

Deve mudar do Opus 4.8? (Mudar / Esperar / Ficar)

Se deve mudar depende da sua carga de trabalho, não de qual modelo "ganha" no geral. Os saltos em agêntico e trabalho de conhecimento são grandes e reais, pelo que a maioria das equipas deve mudar. Oficinas de codificação pura com um pipeline GPT ou Fable têm razão para testar antes de se comprometerem, e utilizadores perto do teto em tarefas baratas podem ficar quase sem perder nada.

Mude já se: o seu trabalho depende de tarefas agênticas, utilização de computador, automação de processos empresariais ou trabalho de conhecimento. O Frontier-Bench (+22,2 face ao 4.8), o AutomationBench (~1,5x o campo) e o GDPval-AA (+268 Elo) são os maiores ganhos reais, e o preço não mudou, pelo que não há penalização de custo na atualização.

Espere se: o seu fluxo de trabalho é codificação agêntica pura e já está no GPT-5.6 Sol ou Fable 5 para isso. O GPT-5.6 Sol continua a liderar o DeepSWE v1.1 e o Fable 5 supera o FrontierCode por margem mínima, pelo que execute a sua própria avaliação de codificação antes de reconfigurar. Espere também se está a meio de um projeto e uma troca de modelo turvaria uma avaliação já em curso.

Fique no 4.8 se: é sensível ao custo em tarefas que já estavam perto do teto para si e não toca nas cargas agênticas onde o Opus 5 se destaca. Estaria a pagar custo de mudança por um delta que não sentiria. Para o campo mais amplo, veja como os modelos se comparam na nossa análise do Claude Sonnet 5 e no panorama do Fable 5 e Mythos 5.

Escolhemos e ligamos modelos como este para construções de agentes de clientes todas as semanas. Se está a decidir em que modelo padronizar para um agente em produção, obtenha uma consulta gratuita e ajudamo-lo a adequar o modelo à carga de trabalho em vez do marketing.

Sobre o autor

Mert Batur Gurbuz é cofundador da Techsy.io, onde a equipa entrega agentes de IA, sistemas de automação e pipelines de voz/SDR para clientes B2B. Estuda na Universidade de Birmingham e escreve sobre a stack de ferramentas LLM que a equipa da Techsy realmente opera em produção.

Cofundador, Techsy.io, Universidade de Birmingham · LinkedIn

Perguntas frequentes

O que é o Claude Opus 5?

O Claude Opus 5 é o modelo de fronteira da Anthropic, lançado a 24 de julho de 2026, com o ID de modelo claude-opus-5. A Anthropic posiciona-o como aproximando-se da inteligência do Fable 5 a metade do preço, e lidera a maioria dos seus benchmarks publicados, incluindo o Frontier-Bench, o GDPval-AA e o ARC-AGI-3. Está disponível na Claude API, Claude.ai, Claude Code e Claude Cowork.

Quando foi lançado o Claude Opus 5?

O Claude Opus 5 foi lançado a 24 de julho de 2026. Ficou disponível no mesmo dia na Claude API, Claude.ai, Claude Code e Claude Cowork, sem lançamento faseado, pelo que pode reconfigurar imediatamente o seu modelo predefinido para claude-opus-5.

O Claude Opus 5 é melhor que o Opus 4.8?

Para a maioria do trabalho, sim. O Opus 5 mais do que duplica o Opus 4.8 no Frontier-Bench v0.1 (43,3% vs 21,1%), ganha 268 Elo no GDPval-AA e salta de 1,5% para 30,2% no ARC-AGI-3. O preço mantém-se, pelo que não há penalização de custo. As exceções são alguns testes de codificação e ciência onde o GPT-5.6 Sol, o Fable 5 ou o Mythos 5 ainda lideram.

Quanto custa o Claude Opus 5?

O preço padrão é 5 $ por milhão de tokens de entrada e 25 $ por milhão de tokens de saída, idêntico ao Opus 4.8. A frase "metade do preço" refere-se ao Fable 5, não ao 4.8: o Opus 5 oferece inteligência quase Fable 5 a tarifas de Opus. O modo Fast custa cerca de 2x o preço base e funciona aproximadamente 2,5x mais rápido no mesmo modelo.

O Claude Opus 5 bate o Fable 5?

Não em toda a linha. O Opus 5 supera o Fable 5 no OSWorld 2.0, BrowseComp, GDPval-AA e Frontier-Bench, e fá-lo a uma fração do preço do Fable 5. Mas o Fable 5 ainda supera o FrontierCode e o benchmark de direito, e o Mythos 5 (o modelo de ciência da Anthropic) lidera em saúde e biologia. A proposta é "quase Fable 5 a metade do preço", não "melhor que o Fable 5 em tudo."

Em que é que o Opus 5 perde?

O GPT-5.6 Sol ganha a codificação agêntica no DeepSWE v1.1 (72,7% vs 68,8%), o Fable 5 ganha o FrontierCode v1.1 por 0,1 pontos e o benchmark de direito reservado (13,3% vs 11,7%), e o Mythos 5 lidera o HealthBench Professional e os testes de biologia. Se a sua carga de trabalho é dominada por algum destes, faça benchmarks antes de mudar.

O Claude Opus 5 é bom para construir agentes de IA?

É construído para isso. Os maiores ganhos estão na codificação agêntica de terminal (Frontier-Bench), utilização de computador (OSWorld 2.0), pesquisa agêntica (BrowseComp) e fluxos de trabalho empresariais multi-etapa (AutomationBench), que são as cargas de trabalho que os agentes em produção executam. A sua autoverificação mais forte também permite gastar menos tokens numa passagem de crítico separada.

Como mudo para o Opus 5 no Claude Code e na API?

Defina o modelo como claude-opus-5 (use /model claude-opus-5 no Claude Code) e está feito para a maioria das equipas. Na API, altere o campo model para claude-opus-5; a forma do pedido é inalterada face ao Opus 4.8, pelo que não são necessárias outras alterações de código.

O que é o modo Fast no Claude Opus 5?

O modo Fast é um escalão de maior velocidade que executa o Opus 5 a aproximadamente 2,5x a velocidade padrão por cerca de 2x o preço standard. Mantém-no no modelo claude-opus-5 completo em vez de o encaminhar para um mais pequeno, o que o torna útil para sessões interativas onde está à espera de output e não vale a pena para trabalhos em lote insensíveis à latência.

Etiquetas

Claude Opus 5claude-opus-5AnthropicOpus 5 vs Opus 4.8benchmarks do Opus 5

Partilhar este artigo

Artigos relacionados

Mais em ai-machine-learning

ai-machine-learning
Jul 20, 2026

8 Melhores APIs de Web Scraping com IA em 2026 (Testadas na Nossa Própria Stack de Agentes)

Testámos 8 APIs de web scraping com IA com preços reais de 2026, obtidos através da nossa própria stack de agentes. Firecrawl, Bright Data, ScrapingBee e mais 5, classificadas por output pronto para LLM, anti-bot e suporte MCP.

9 min read min de leitura
Ler
ai-machine-learning
Jul 20, 2026

Engenharia de Prompts para Programação: 7 Padrões Que Usamos Diariamente no Claude Code e Cursor (2026)

A maioria dos artigos sobre 'prompts de IA para programação' oferece 50 modelos para copiar. Este ensina os 7 padrões que usamos todos os dias para gerir um pipeline de 16 agentes no Claude Code, com exemplos reais de antes e depois, além de indicar onde cada padrão se encaixa no Claude Code, Cursor e Copilot em 2026.

11 min read min de leitura
Ler
ai-machine-learning
Jul 19, 2026

Da PoC de IA à Produção: O Checklist de 12 Pontos Antes de Lançar

Uma demo de IA funcional não é um sistema em produção. Este checklist de 12 pontos percorre as três fases que qualquer funcionalidade de IA precisa antes do lançamento: reforçar, estabilizar e implementar, com limites concretos para tetos de custos, limites de taxa, fallbacks e gatilhos de rollback.

10 min read min de leitura
Ler
Ver todos os artigos
Inicia o Teu Projeto

Pronto para criar algo extraordinário?

Vamos transformar a sua visão em realidade. A nossa equipa está pronta para o ajudar a criar software que faz a diferença.

Marca uma chamada de scope 30 minVer o Nosso Trabalho

Destaque da biblioteca

Skills do Claude

Ver tudo
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Automações AI

Ver tudo
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Destaque da biblioteca

Skills do Claude

Ver tudo
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Automações AI

Ver tudo
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Serviços

  • Soluções Empresariais
  • Aplicações Móveis
  • Aplicações Web

Soluções

  • Sistemas CRM
  • Integração de IA
  • Soluções ERP
  • Agentes de Voz
  • Automação de Processos
  • Cibersegurança

Biblioteca

  • Blogue
  • Portfólio

Comunidade

  • Automações AI
  • Skills do Claude

Ferramentas

  • Calculadora de Custo de App Móvel
  • Calculadora de Custo de API OpenAI / LLM
  • Calculadora de Custo de MVP
  • Calculadora de Custo de Agente de Voz AI

Empresa

  • Sobre
  • Parceiros
  • Contacto

Legal

  • Política de Privacidade
  • Termos de Serviço
  • Política de Cookies

Serviços

  • Soluções Empresariais
  • Aplicações Móveis
  • Aplicações Web

Soluções

  • Sistemas CRM
  • Integração de IA
  • Soluções ERP
  • Agentes de Voz
  • Automação de Processos
  • Cibersegurança

Biblioteca

  • Blogue
  • Portfólio

Comunidade

  • Automações AI
  • Skills do Claude

Ferramentas

  • Calculadora de Custo de App Móvel
  • Calculadora de Custo de API OpenAI / LLM
  • Calculadora de Custo de MVP
  • Calculadora de Custo de Agente de Voz AI

Empresa

  • Sobre
  • Parceiros
  • Contacto
LegalPolítica de PrivacidadeTermos de ServiçoPolítica de Cookies
TECHSY
© 2026 Techsy. Todos os direitos reservados.