Anthropic anunció Claude Opus 4.5, su nuevo modelo insignia que ya está disponible y que promete convertirse en la referencia global para ingeniería de software, agentes autónomos y tareas complejas de productividad. La compañía afirma que es su sistema “más inteligente, eficiente y mejor alineado” hasta la fecha, capaz de transformar la forma en que desarrolladores, empresas y usuarios trabajan con IA.
Opus 4.5 establece un nuevo estándar en pruebas de ingeniería real, obteniendo el puntaje más alto en SWE-bench Verified, superando a todos los modelos de frontera actuales. Está disponible en las apps de Claude, en la API y en los principales proveedores de la nube, con precios de USD $5/$25 por millón de tokens, haciendo más accesible un nivel de rendimiento antes reservado para laboratorios de avanzada.
Los primeros evaluadores internos describen a Opus 4.5 como un modelo que “simplemente entiende” los problemas complejos. Es capaz de navegar ambigüedades, razonar entre trade-offs y resolver bugs de múltiples sistemas sin necesidad de guiarlo paso a paso. Incluso superó el desempeño de cualquier candidato humano en una prueba técnica de ingeniería aplicada bajo un límite de dos horas, un resultado que abre preguntas sobre el futuro del trabajo técnico.
Las mejoras son amplias: visión más precisa, razonamiento más profundo, mejor matemática, multilingüismo avanzado y liderazgo en 7 de 8 lenguajes de programación en benchmarks recientes. Su capacidad para encontrar soluciones creativas también sobresale: en una prueba donde otros modelos fallan, Opus 4.5 encontró un camino legítimo para resolver un problema adaptándose a restricciones reales, demostrando capacidad de “pensar” como un agente orientado a objetivos.

En seguridad, Anthropic asegura que Opus 4.5 es su modelo mejor alineado hasta ahora, más resistente a ataques de prompt injection y comportamientos no deseados. Las evaluaciones internas lo posicionan como el modelo de frontera más robusto en defensa frente a intentos maliciosos y desvíos de objetivo.
La actualización llega acompañada de mejoras en la Claude Developer Platform, con un nuevo parámetro de esfuerzo que permite elegir entre velocidad o máxima capacidad, reduciendo el uso de tokens hasta en un 76% sin sacrificar calidad. También mejora la coordinación entre subagentes, el manejo de contexto y la eficiencia en tareas de investigación profunda.
Claude Code recibe nuevas funciones como un Plan Mode más preciso, sesiones paralelas locales y remotas desde la app de escritorio, y mayor capacidad para ejecutar planes complejos. En la app de Claude, las conversaciones extensas ya no se cortan, gracias a un sistema automático de resumen de contexto. Además, Claude para Chrome ya está disponible para usuarios Max, y Claude para Excel amplía su acceso beta a Max, Team y Enterprise.
Fuente: Anthropic

