Conclusiones clave
- Opus 4.5 es el nuevo rey de la codificación: con una puntuación del 80,9 % en SWE-bench Verified, supera tanto a GPT-5.1 como a Gemini 3 Pro.
- Haiku 4.5 supera su peso: el modelo “pequeño” ahora iguala el rendimiento de codificación del Sonnet 4 de la generación anterior.
- Guerra de precios: Opus 4.5 tiene un precio agresivo de $5/millón de tokens de entrada, lo que subcotiza significativamente a los competidores.
- Razonamiento híbrido: Ambos modelos cuentan con nuevas capacidades de razonamiento “alternables” para tareas complejas.
Justo cuando parecía que OpenAI y Google habían absorbido todo el oxígeno de la habitación con sus lanzamientos de noviembre, Anthropic respondió con un contraataque masivo. El lanzamiento de Claude Opus 4.5 y Claude Haiku 4.5 no es sólo una actualización iterativa; es un ataque calculado al corazón del mercado de desarrolladores.
Durante las últimas semanas, la conversación ha estado dominada por el razonamiento de GPT-5 y la integración del ecosistema de Gemini 3. Pero Anthropic se ha apegado a su filosofía central: construir los modelos más capaces, confiables y dirigibles para trabajos serios. Con estos nuevos lanzamientos, están demostrando firmemente que, para la codificación y los flujos de trabajo agentes complejos, Claude sigue siendo el modelo a batir.
Entendiendo a Claude Opus 4.5
Lanzado el 24 de noviembre de 2025, Opus 4.5 es el nuevo buque insignia de Anthropic. Reemplaza al Opus original como el modelo “más inteligente” de la línea, diseñado para las tareas más exigentes.
Las especificaciones
- Ventana de contexto: 200.000 tokens
- Precio: $5 por millón de tokens de entrada / $25 por millón de tokens de salida
- Función clave: Razonamiento híbrido (alternar entre respuesta instantánea y modo de “pensamiento” extendido)
Los puntos de referencia
El número principal aquí es 80,9% en SWE-bench Verified. Para aquellos que no están muy familiarizados con la evaluación de la IA, SWE-bench es el estándar de oro para probar la capacidad de una IA para resolver problemas de ingeniería de software del mundo real.
- Claude Opus 4.5: 80,9%
- GPT-5.1: ~78 % (estimado)
- Gemini 3 Pro: ~76% (estimado)
Esta no es una victoria por margen de error; Es una ventaja decisiva en el dominio de mayor valor comercial para los LLM en este momento: escribir código.
Entendiendo Claude Haiku 4.5
Si bien Opus acapara los titulares, Haiku 4.5 (lanzado silenciosamente el 15 de octubre y ahora completamente implementado) podría ser el modelo más importante para las empresas.
Por qué es importante
El haiku siempre ha sido el modelo “rápido y barato”. Pero Haiku 4.5 cambia la ecuación al ser “rápido, barato e inteligente”. Anthropic afirma que iguala el rendimiento de codificación de Sonnet 4, un modelo que era de última generación hace apenas unos meses.
La economía
- Precio: $1 por millón de tokens de entrada / $5 por millón de tokens de salida
- Caso de uso: este es el motor para flujos de trabajo “agentes”. Si tiene un sistema que necesita ejecutar miles de subtareas, como analizar registros, clasificar tickets de soporte o escribir pruebas unitarias, Haiku 4.5 lo hace económicamente viable sin sacrificar la calidad.
La comparación: Claude contra GPT-5 contra Gemini 3
El panorama de la IA a finales de 2025 es una carrera de tres caballos. Así es como se acumulan:
| Característica | Claude Opus 4.5 | GPT-5.1 | Géminis 3 Pro |
|---|---|---|---|
| Fuerza primaria | Codificación y control agente | Razonamiento general y multimodalidad | Integración del ecosistema de Google |
| Parámetro de codificación | 80,9% | ~78% | ~76% |
| Precios (entrada/salida) | $5 / $25 | ~$15 / $75 | ~$10 / $50 |
| Ventana de contexto | 200k | 128k | 128k |
El veredicto: Si estás creando un chatbot para consumidores, es posible que GPT-5 aún tenga la ventaja en “personalidad”. Si estás inmerso en Google Workspace, Gemini 3 es una obviedad. Pero si está creando software, agentes o canalizaciones de datos complejas, Claude Opus 4.5 es objetivamente la mejor herramienta para el trabajo en este momento y es significativamente más barato.
Impacto en la industria
El auge del “razonamiento híbrido”
Una de las características más interesantes de Opus 4.5 es la capacidad de activar y desactivar el “razonamiento”. A diferencia de los modelos o1 de OpenAI, que obligan a una pausa para “pensar”, Claude permite a los desarrolladores elegir. Esta flexibilidad es crucial para aplicaciones que necesitan baja latencia para consultas simples pero una profunda reflexión para las complejas.
Seguridad empresarial
Anthropic continúa apoyándose fuertemente en su marca “IA constitucional”. Opus 4.5 viene con funciones de seguridad de nivel empresarial y certificación “AI Safety Level 2”. Para los bancos, los proveedores de atención médica y las agencias gubernamentales, este enfoque de priorizar la seguridad suele ser el factor decisivo.
¿Qué sigue?
El lanzamiento de Opus 4.5 completa la línea 2025 de Anthropic. La pregunta ahora es: ¿cómo responderán OpenAI y Google? Es probable que la industria vea un “GPT-5.5” o un “Gemini 3 Ultra” a principios de 2026 para cerrar la brecha de codificación.
Pero por ahora la pelota está en su tejado. Anthropic ha demostrado que no necesitas la mayor exageración para ganar; solo necesitas el mejor código.
El resultado final
Claude Opus 4.5 es una clase magistral de ingeniería enfocada. Al priorizar la capacidad de codificación, la confiabilidad de la agencia y la rentabilidad, Anthropic ha entregado exactamente lo que pedía la comunidad de desarrolladores. No es sólo un digno competidor de GPT-5; Para muchos casos de uso, es la mejor opción.
Fuentes (3)
- anthropic.com Anthropic Opus 4.5 Announcement
- anthropic.com Anthropic Haiku 4.5 Announcement
- aboutamazon.com AWS Bedrock News
🦋 Discusión en Bluesky
Discutir en Bluesky