IA

Claude Opus 5.5 cuesta 40% menos cuando Anthropic llama a desacelerar la IA

Susan Hill
Añádenos en Google

Claude Opus 5.5 hace algo que los modelos anteriores de Anthropic no hacían: cuesta menos y funciona más rápido, al tiempo que iguala o supera a un sistema más grande y más caro. El modelo maneja programación agéntica, uso de computadoras, lectura de gráficos y razonamiento multidisciplinario a niveles que, según los propios datos de Anthropic, superan los de Claude Fable 5.1, el modelo previamente más capaz de la compañía, en varias métricas. Para las personas y desarrolladores que consideraban útil a Opus 5, pero costoso, la brecha entre lo que el modelo puede hacer y lo que cuesta ha cambiado de manera significativa.

La diferencia de precio es concreta. Opus 5.5 cobra US$4 por millón de tokens de entrada y US$20 por millón de tokens de salida; Opus 5 costaba US$5 y US$25, respectivamente. Las lecturas en caché bajan de US$0,50 a US$0,20 por millón de tokens. Anthropic afirma que las cargas de trabajo típicas cuestan en total cerca de un 40% menos. La velocidad sigue la misma tendencia: el modelo estándar genera texto más de un 30% más rápido que Opus 5. Una opción independiente de modo rápido, con un precio de US$8 por entrada y US$40 por salida por millón de tokens, alcanza hasta 2,5 veces la velocidad de Opus 5 estándar, una configuración útil para aplicaciones sensibles a la latencia.

Las cifras de rendimiento publicadas por Anthropic sitúan a Opus 5.5 por delante de Fable 5.1, Opus 5 y GPT-6 Astra en cuatro de seis pruebas de referencia. En Terminal-Bench 4.0, que evalúa la ejecución de código en un entorno de terminal activo, Opus 5.5 obtiene un 66,4% frente al 55,8% de Fable 5.1. En Humanity’s Last Exam, una prueba que abarca conocimientos académicos y profesionales de distintas disciplinas, el resultado es de 67,7% frente a 65,6%. OSWorld 2.0, que mide la operación de interfaces informáticas, muestra un 81,8% frente a un 80,7%. Una prueba de Deloitte concluyó que Opus 5.5, en su configuración de menor esfuerzo, detectó el 72% de los errores de programación conocidos durante la revisión, frente al 56% de Opus 5 con esfuerzo alto. Estas cifras provienen de Anthropic y de sus socios seleccionados; los márgenes de error declarados van de ±1,6 a ±5 puntos porcentuales, y al momento del lanzamiento no se ha publicado ninguna verificación independiente de terceros.

Dos áreas rompen el patrón. En AutomationBench, GPT-6 Astra obtiene un 41,4% frente al 40,0% de Opus 5.5. En Terminal-Bench-Science, la diferencia es mayor: Astra alcanza un 64,6%, mientras que Opus 5.5 se queda en un 58,7%. Ambas diferencias se encuentran dentro de los márgenes de error declarados —podrían ser ruido estadístico—, pero también podrían no serlo. Anthropic incluye estas filas en su propia tabla publicada, algo que más empresas de IA no hacen al lanzar sus productos. Las cifras aún necesitan un escrutinio independiente antes de poder considerarse concluyentes.

En materia de seguridad, Anthropic afirma que Opus 5.5 fue evaluado antes de su lanzamiento por equipos externos, entre ellos METR. En la propia auditoría interna de comportamiento de la empresa, con casi 2.000 escenarios diseñados para comprobar si el modelo intenta eludir las restricciones que se le imponen, se describe a Opus 5.5 como un 85% menos propenso que Opus 5 a intentar esa evasión. Los modelos más potentes suelen tener mayor capacidad para encontrar formas de sortear limitaciones, lo que hace que la mejora sea significativa si se sostiene. La experiencia de despliegue será la verdadera prueba.

Lo que vuelve inusual este lanzamiento es el momento en que ocurre. A principios de este mes, el CEO de Anthropic, Dario Amodei, publicó un ensayo en el que escribió que se había convencido de que abordar plenamente los riesgos de la IA exige «moderar el ritmo del avance de capacidades para que la prevención de riesgos tenga tiempo de mantenerse al día». Sam Altman, de OpenAI, y Elon Musk expresaron su acuerdo con la preocupación general. Jensen Huang, de Nvidia, dijo que la ciencia subyacente no la respalda. Y después Anthropic lanzó un modelo más rápido, más barato y más capaz que su predecesor. Una interpretación es que un modelo con mejores evaluaciones de seguridad y un acceso más amplio es precisamente lo que Amodei tenía en mente. Otra es que el ensayo identificaba el avance de capacidades como la preocupación, y las capacidades avanzaron. Ambas interpretaciones encajan en el mismo conjunto de hechos, y los benchmarks de Anthropic por sí solos no pueden resolver cuál es la correcta.

Claude Opus 5.5 está disponible desde el 22 de septiembre de 2026 bajo el ID de modelo de API claude-opus-5-5. Funciona dentro de Claude en los planes Pro, Max, Team y Enterprise, y se puede acceder a él a través de AWS, Google Cloud y Microsoft Azure. Anthropic está elevando los límites de uso en los niveles de suscripción de cinco horas. Sonnet 5.5 y Haiku 5.5, los miembros restantes de la familia 5.5, tienen previsto llegar en las próximas semanas, sin que se haya anunciado precio ni fecha concreta de lanzamiento para ninguno de los dos.

Etiquetas: , , , , ,

Añádenos en Google

Discussion

There are 0 comments.