Principais conclusões
- Opus 4.5 é o novo rei da codificação: com uma pontuação de 80,9% no SWE-bench Verified, ele supera o GPT-5.1 e o Gemini 3 Pro.
- Haiku 4.5 supera seu peso: O modelo “pequeno” agora corresponde ao desempenho de codificação do Sonnet 4 da geração anterior.
- Guerra de preços: Opus 4.5 tem um preço agressivo de $5/milhão de tokens de entrada, prejudicando significativamente os concorrentes.
- Raciocínio Híbrido: Ambos os modelos apresentam novos recursos de raciocínio “alternáveis” para tarefas complexas.
Justamente quando parecia que a OpenAI e o Google haviam sugado todo o oxigênio da sala com seus lançamentos de novembro, a Anthropic respondeu com um contra-ataque massivo. O lançamento de Claude Opus 4.5 e Claude Haiku 4.5 não é apenas uma atualização iterativa; é um ataque calculado no coração do mercado de desenvolvedores.
Nas últimas semanas, a conversa foi dominada pelo raciocínio do GPT-5 e pela integração do ecossistema do Gemini 3. Mas a Anthropic manteve sua filosofia central: construir os modelos mais capazes, confiáveis e orientáveis para trabalhos sérios. Com esses novos lançamentos, eles estão defendendo fortemente que, para codificação e fluxos de trabalho de agentes complexos, Claude ainda é o modelo a ser batido.
Compreendendo Claude Opus 4.5
Lançado em 24 de novembro de 2025, o Opus 4.5 é o novo carro-chefe da Anthropic. Ele substitui o Opus original como o modelo “mais inteligente” da linha, projetado para as tarefas mais exigentes.
As especificações
- Janela de contexto: 200.000 tokens
- Preços: $5 por milhão de tokens de entrada / $25 por milhão de tokens de saída
- Recurso principal: Raciocínio Híbrido (alternar entre resposta instantânea e modo de “pensamento” estendido)
Os benchmarks
O número principal aqui é 80,9% no SWE-bench Verified. Para aqueles que não estão familiarizados com a avaliação de IA, o SWE-bench é o padrão ouro para testar a capacidade de uma IA de resolver problemas de engenharia de software do mundo real.
- Claude Opus 4,5: 80,9%
- GPT-5.1: ~78% (estimado)
- Gemini 3 Pro: ~76% (estimado)
Esta não é uma vitória com margem de erro; é uma liderança decisiva no domínio comercialmente mais valioso para LLMs no momento: escrever código.
Compreendendo Claude Haiku 4.5
Embora o Opus ganhe as manchetes, o Haiku 4.5 (lançado discretamente em 15 de outubro e agora totalmente implementado) pode ser o modelo mais importante para as empresas.
Por que é importante
Haiku sempre foi o modelo “rápido e barato”. Mas o Haiku 4.5 muda a equação ao ser “rápido, barato e e inteligente”. A Anthropic afirma que corresponde ao desempenho de codificação do Sonnet 4, um modelo que era de última geração há apenas alguns meses.
A Economia
- Preço: $1 por milhão de tokens de entrada / $5 por milhão de tokens de saída
- Caso de uso: este é o mecanismo para fluxos de trabalho “agenticos”. Se você possui um sistema que precisa executar milhares de subtarefas, como analisar logs, fazer triagem de tickets de suporte ou escrever testes unitários, o Haiku 4.5 o torna economicamente viável sem sacrificar a qualidade.
A comparação: Claude vs. GPT-5 vs.
O cenário da IA no final de 2025 é uma corrida de três cavalos. Aqui está como eles se comparam:
| Recurso | Cláudio Opus 4.5 | GPT-5.1 | Gêmeos 3 Pró |
|---|---|---|---|
| Força Primária | Codificação e Controle Agente | Raciocínio Geral e Multimodalidade | Integração do ecossistema do Google |
| Referência de codificação | 80,9% | ~78% | ~76% |
| Preços (Entrada/Saída) | $5 / $25 | ~$15 / $75 | ~$10 / $50 |
| Janela de contexto | 200 mil | 128 mil | 128 mil |
O veredicto: Se você estiver construindo um chatbot para o consumidor, o GPT-5 ainda pode ter vantagem em “personalidade”. Se você está profundamente envolvido no Google Workspace, o Gemini 3 é óbvio. Mas se você estiver criando software, agentes ou pipelines de dados complexos, Claude Opus 4.5 é objetivamente a melhor ferramenta para o trabalho no momento — e é significativamente mais barato.
Impacto na Indústria
A ascensão do “raciocínio híbrido”
Um dos recursos mais interessantes do Opus 4.5 é a capacidade de ativar e desativar o “raciocínio”. Ao contrário dos modelos o1 da OpenAI, que forçam uma pausa para “pensar”, Claude permite que os desenvolvedores escolham. Essa flexibilidade é crucial para aplicativos que precisam de baixa latência para consultas simples, mas de reflexão profunda para consultas complexas.
Segurança Empresarial
A Anthropic continua se apoiando fortemente em sua marca “IA Constitucional”. Opus 4.5 vem com recursos de segurança de nível empresarial e certificação “AI Safety Level 2”. Para bancos, prestadores de cuidados de saúde e agências governamentais, esta abordagem que coloca a segurança em primeiro lugar é muitas vezes o fator decisivo.
O que vem a seguir?
O lançamento do Opus 4.5 completa a programação 2025 da Anthropic. A questão agora é: como a OpenAI e o Google responderão? É provável que a indústria veja um “GPT-5.5” ou um “Gemini 3 Ultra” no início de 2026 para preencher a lacuna de codificação.
Mas, por enquanto, a bola está do lado deles. A Anthropic provou que você não precisa da maior máquina de hype para vencer; você só precisa do melhor código.
O resultado final
Claude Opus 4.5 é uma masterclass em engenharia focada. Ao priorizar a capacidade de codificação, a confiabilidade do agente e a economia, a Anthropic entregou exatamente o que a comunidade de desenvolvedores pediu. Não é apenas um concorrente digno do GPT-5; para muitos casos de uso, é a escolha superior.
Fontes (3)
- anthropic.com Anthropic Opus 4.5 Announcement
- anthropic.com Anthropic Haiku 4.5 Announcement
- aboutamazon.com AWS Bedrock News
🦋 Discussão no Bluesky
Discutir no Bluesky