Anthropic ha presentado Claude Opus 5.5, que alcanzó 58 puntos en el Intelligence Index de Artificial Analysis, la cifra más alta registrada.
Anthropic lanzó así el primer integrante de su nueva familia Opus 5.5. Según la compañía, Claude Opus 5.5 incorpora mejoras en rendimiento, seguridad, comunicación, velocidad y eficiencia. Anthropic asegura que ofrece resultados similares a Claude Fable 5.1 en buena parte de las tareas, pero con un coste de ejecución un 40% inferior al de Claude Opus 5.
Un modelo para tareas complejas
Anthropic ha acompañado el lanzamiento con resultados de distintas pruebas. Claude Opus 5.5 obtiene las mejores posiciones en programación automatizada, uso de computadoras y trabajo intelectual, y supera a modelos anteriores.
Anthropic lo define como un investigador fiable y competente. Entre los ejemplos compartidos aparece una migración de código de 680.000 líneas completada en menos de un día, una tarea que, según Anthropic, habría requerido semanas para un equipo de ingeniería.
El modelo también está diseñado para detectar y corregir ineficiencias de software, crear gráficos para videojuegos, ejecutar migraciones complejas y realizar auditorías de código fuente.
Más velocidad y menor coste
Anthropic afirma haber reducido hasta un 40% los costes frente a Opus 5. Las tarifas de la API quedan en 4 dólares por millón de tokens de entrada y 20 dólares por millón de tokens de salida, mientras las lecturas de caché bajan a 0,20 dólares por millón de tokens.
Claude Opus 5.5 es un 30% más rápido que su antecesor. En los planes Pro, Max, Team y Enterprise, además, se amplían los límites de uso hasta cinco horas y se incorpora una opción para conservar el reinicio de uso.
El modelo ya está disponible en Amazon Web Services, Google Cloud y Microsoft Azure. Los desarrolladores pueden utilizarlo mediante la Claude Platform API.
Comunicación y seguridad reforzadas
Anthropic asegura que Opus 5.5 mejora la comunicación natural al priorizar la información importante y ofrecer respuestas más fluidas.
La seguridad también ocupa un lugar central. El modelo incorpora un clasificador que analiza las acciones antes de ejecutarlas y un entorno aislado de código abierto para auditorías.
Frente a ataques de prompt injection, Anthropic afirma que Opus 5.5 supera a su predecesor en programación, navegación y uso de herramientas. Gray Swan señala además que iguala a Claude Fable 5.1 en sus pruebas con la menor tasa de vulnerabilidad registrada hasta ahora entre los modelos evaluados.
En auditorías internas con casi 2.000 escenarios, Anthropic afirma que Opus 5.5 redujo en un 85% los intentos de eludir límites frente a Opus 5 o Mythos 5.1. Sin embargo, la empresa advierte que el modelo puede detectar cuándo está siendo evaluado, lo que dificulta interpretar algunos resultados de seguridad.
Primeras impresiones
Anthropic también ha difundido comentarios de profesionales que probaron el modelo. Aleksandar Mitic, ingeniero sénior de Spotify, destacó mejoras en la eficiencia de los tokens y afirmó que su equipo pudo completar las mismas tareas de forma más rápida y económica.
Fabian Hedin, CTO y cofundador de Lovable, señaló que Opus 5.5 permite compilaciones más rápidas manteniendo la calidad. Según su experiencia, el modelo recopila el contexto una sola vez, realiza menos ediciones y reduce los pasos necesarios.
La llegada de Claude Opus 5.5 no será aislada. Anthropic ha adelantado que durante las próximas semanas presentará Claude Sonnet 5.5 y Claude Haiku 5.5, con parte de las mejoras introducidas en rendimiento, eficiencia y seguridad. Así, la compañía prepara una ampliación de esta nueva generación de modelos.
