Claude Opus 5 CHEGOU! A Anthropic ACABA DE SOLTAR SEU NOVO GIGANTE da IA e Ele É MAIS INTELIGENTE E BARATO!
Olá, pessoal! Aqui é o Lucas Tech, e hoje o mundo da IA acordou com uma notícia DAQUELAS! A Anthropic, que a gente tanto acompanha, acaba de lançar o Claude Opus 5! E olha, preparem-se, porque ele chegou não só para substituir o Opus 4.8 como o modelo principal da linha Opus, mas para MUDAR O JOGO. Pensem em mais inteligência, recursos poderosos e, o melhor de tudo, um precinho que não mudou!
O Claude Opus 5 está se posicionando para quase alcançar a inteligência do Claude Fable 5, mas custando a metade do preço! Ele agora é o modelo padrão no Claude Max e o mais forte disponível no Claude Pro. Ou seja, a Anthropic está democratizando o acesso a uma IA de ponta.
O Que Mudou de Verdade no Nível da API? (Atenção, Devs!)
Se você trabalha com a API do Claude, tem umas coisinhas SUPER IMPORTANTES para ficar de olho antes de rodar qualquer benchmark:
"Pensar" (Thinking) Ligado Por Padrão: Antes, no Opus 4.8, as requisições rodavam sem "pensar" ativamente, a menos que você configurasse
thinking: {"type": "adaptive"}. Agora, no Opus 5, a mesma requisição já vem pensando por padrão! O parâmetroeffortcontrola a profundidade desse pensamento. Como omax_tokenslimita tanto o texto de "pensamento" quanto o da resposta, você vai precisar revisar seus valores existentes. Fique esperto!MUDANÇA CRÍTICA (Breaking Change)! Se você tentar desativar o pensamento (
thinking: {"type": "disabled"}) com os níveis de esforçoxhighoumax, a API vai te devolver um erro 400. Essa restrição é aplicada por requisição. A saída é simples: ou você limita o esforço ahigh(ou menos), ou simplesmente remove o campothinkingda sua requisição.- Delete Seus Prompts de Verificação: A Anthropic está pedindo para os desenvolvedores apagarem os prompts de verificação que usavam antes. Sabe aquelas instruções tipo "inclua uma etapa final de verificação"? Esquece! O modelo agora já verifica o próprio trabalho por conta própria, o que pode causar uma "super-verificação" desnecessária. O guia de prompting do Opus 5 tem os padrões de ajuste que você precisa.
O ID do modelo é claude-opus-5. O contexto é de 1 milhão de tokens como padrão e máximo, sem uma variante menor. A saída máxima é de 128 mil tokens na API síncrona de Mensagens. Mas se você usar a API de Mensagens em Lotes (Message Batches API) com o beta header output-300k-2026-03-24, você pode chegar a 300 mil tokens! E o prompt mínimo "cacheável" caiu para 512 tokens, antes era 1.024. Mais flexibilidade e eficiência!
Desempenho BRUTAL: Codificação e Agência
Nos benchmarks, o Opus 5 não veio para brincadeira:
- FrontierBench v0.1: Um novo benchmark com 74 tarefas. O Opus 5 marcou 43.3% no esforço máximo, contra 18.7% do Opus 4.8. O Fable 5 fez 33.7% e o GPT-5.6 Sol chegou a 37.5%. No esforço
xhigh, o Opus 5 atinge 44.4% – seu melhor resultado! - Segurança Reforçada: Uma diferença impressionante é que os classificadores de segurança do Opus 5 sinalizaram e recusaram apenas 5% das chamadas de API (4% dos testes), enquanto os do Fable 5 sinalizaram 42% das chamadas (26% dos testes). Isso significa um modelo mais robusto e menos propenso a falhas de segurança!
- SWE-bench: No SWE-bench Verified, o Opus 5 alcançou 96.0%. No SWE-bench Pro, fez 79.2%, quase batendo o Fable 5 (que ainda lidera com 80.0%). Mas no SWE-bench Multimodal, o salto foi enorme: de 38.4% para 59.4%!
- Agentes Digitais: Aqui estão as vitórias mais claras! O Opus 5 atingiu 70.57% no OSWorld 2.0, contra 55.7% do Opus 4.8. No Zapier AutomationBench, marcou 26.0% (Opus 4.8 fez 17.0% e Fable 5, 17.4%). E mesmo com um esforço médio, ele ainda faz 24% a um custo de apenas US$0.89 por tarefa.
- GDPval-AA v2: O Opus 5 lidera o ranking com pontuações ELO de 1861 e 1827. A configuração
xhighsupera todos os outros modelos usando 25% menos tokens de saída que omax. Eficiência e poder andando juntos!
Capacidade de Raciocínio Inovadora
O Opus 5 mostrou que é um gênio também na lógica:
- IMO 2026: A Anthropic testou o Opus 5 em todos os seis problemas da IMO 2026 (Olimpíada Internacional de Matemática) sem ferramentas ou agentes. Um painel de juízes (composto por três modelos) e especialistas humanos confirmaram: todas as 24 soluções geradas estavam corretas! A pontuação final de 42/42 é nível de MEDALHA DE OURO, superando o corte de 29/42. Absurdo!
- ARC-AGI-3: O Opus 5 alcançou 30.16% no ARC-AGI-3 com esforço alto. Isso é, aproximadamente, quatro vezes a melhor pontuação já registrada no ranking oficial! Para se ter uma ideia, o GPT-5.6 Sol fez 7.78% e o Opus 4.8 apenas 1.52%.
- Humanity’s Last Exam: Marcou 56.3% sem ferramentas e 64.7% com elas.
A seção multimodal traz uma lição prática muito valiosa: usar ferramentas para os agentes do Claude escala o poder computacional de forma muito mais custo-efetiva do que apenas aumentar o "pensamento adaptativo" do modelo.
Por exemplo, no Chartography, o Opus 5 fez 29.6% sem ferramentas e 83.0% com um container e uma ferramenta de corte de imagem. No BenchCAD Vision2Code, o voxel IoU saltou de 0.366 para 0.821 com ferramentas, superando o Claude Mythos 5 (0.678) por uma margem bem folgada.
Minha Visão
Cara, sério, essa atualização do Claude Opus 5 é um divisor de águas! Como entusiasta de tecnologia e alguém que adora ver a IA avançar, fico impressionado com a Anthropic não só melhorando a inteligência bruta, mas também pensando na usabilidade e na segurança para nós, desenvolvedores. O fato de ele ser mais poderoso, ter capacidade de raciocínio de "nível de ouro" na matemática, ser mais seguro contra ataques e ainda manter o mesmo preço é um presente. Isso vai acelerar a inovação de um jeito que a gente mal consegue imaginar. Menos "flagging" de segurança, mais capacidade de resolver problemas complexos, e o melhor: com ferramentas, ele fica ainda mais incrível e custo-efetivo! É um passo gigante para a IA se tornar ainda mais integrada e útil no nosso dia a dia e nos nossos projetos.
E aí, o que vocês acharam dessa novidade? Estão prontos para colocar o Claude Opus 5 para trabalhar nos seus projetos? Contem pra mim nos comentários!
Referência: Matéria Original
Posts relacionados:
Milhares de leitores adquiriram este banco de bateria ultrafino – e eu faria o mesmo por esse preço.
Como resolvei rapidamente um plugin crítico de código aberto sem alterar uma linha de código usando ChatGPT
O robô da Casa Branca: Foi mesmo o primeiro?
Seu Gerente de Fortuna é IA? Descubra se você é rico mesmo.