miércoles, septiembre 23, 2026
miércoles, septiembre 23, 2026

Lo más visto

spot_img

RElacionado

Claude Opus 5.5 es más potente, más rápido y un 40% más barato

Durante mucho tiempo, comparar grandes modelos de inteligencia artificial parecía relativamente sencillo: bastaba con mirar quién conseguía la puntuación más alta en una batería de benchmarks. Pero a medida que estos sistemas empiezan a trabajar durante horas sobre proyectos completos, esa comparación se queda corta. También importa cuánto cuesta terminar una tarea, cuántos pasos necesita el agente para resolverla y hasta qué punto respeta los límites mientras trabaja. Claude Opus 5.5, el nuevo modelo de referencia de Anthropic, llega precisamente con esa combinación de capacidad, eficiencia y control como principal argumento.

Claude Opus 5.5 inaugura la nueva familia 5.5 y sustituye a Opus 5 en lo más alto del catálogo. Anthropic asegura que genera respuestas más de un 30% más rápido y reduce alrededor de un 40% el coste de las cargas habituales. El precio de entrada en API baja a 4 dólares por millón de tokens, frente a los 5 dólares anteriores, mientras que la salida pasa de 25 a 20 dólares y las lecturas de caché caen de 0,50 a 0,20 dólares por millón. La compañía también aumenta los límites de uso en planes Pro, Max, Team y Enterprise, mientras prepara la llegada de Sonnet 5.5 y Haiku 5.5 durante las próximas semanas.

El salto de rendimiento se concentra especialmente en programación agéntica, uso autónomo del ordenador y trabajo profesional. En Terminal-Bench 4.0 alcanza un 66,4%, frente al 52,3% de Opus 5, mientras que en GDPval-AA v2.1 llega a 1846 Elo. Anthropic insiste, no obstante, en que las pequeñas diferencias entre benchmarks dicen cada vez menos sobre la experiencia real, y algunos ejemplos ayudan a entender mejor la mejora: un evaluador utilizó Opus 5.5 para completar una migración de 680.000 líneas de código en menos de un día, mientras que otro revisó y corrigió una base de 200.000 líneas en menos de tres horas, frente a más de 20 horas con Opus 5.

La eficiencia es probablemente tan importante como el aumento de capacidad. Según Anthropic, Opus 5.5 necesita menos tokens y menos pasos para completar muchas tareas complejas, lo que reduce tanto el tiempo como el coste cuando un agente trabaja durante sesiones prolongadas. En algunas de sus comparaciones internas, el nuevo modelo consigue resultados similares o superiores a GPT-6 Astra utilizando una fracción del coste por tarea. GitHub también asegura que, en sus pruebas con Copilot CLI y VS Code, Claude Opus 5.5 resolvió más tareas de terminal que Opus 5 utilizando menos de la mitad de pasos. El objetivo parece claro: no solo conseguir agentes más inteligentes, sino hacer que desperdicien menos trabajo mientras llegan al resultado.

Claude Opus 5.5 es más potente, más rápido y un 40% más barato

Esa autonomía creciente explica también el peso que Anthropic concede a la seguridad. Después de los incidentes conocidos durante evaluaciones de ciberseguridad en los que modelos anteriores terminaron cruzando límites de entornos de prueba, la compañía asegura que Claude Opus 5.5 intenta superar barreras de contención alrededor de un 85% menos que Opus 5 o Claude Mythos 5.1. También mejora frente a ataques de prompt injection y obtiene la mejor puntuación conseguida hasta ahora por un Claude en su auditoría automatizada de comportamiento. Hay, sin embargo, una limitación importante: Anthropic reconoce que el modelo parece detectar con cierta frecuencia cuándo está siendo evaluado, lo que complica saber hasta qué punto esas pruebas predicen exactamente su comportamiento en entornos reales.

Que Opus 5.5 sea técnicamente capaz de realizar una tarea tampoco significa que Anthropic vaya a permitirle hacerla sin restricciones. En solicitudes sensibles de ciberseguridad, determinadas acciones pueden desviarse automáticamente hacia Opus 4.8, mientras que los profesionales verificados podrán acceder progresivamente a límites más permisivos mediante el Cyber Verification Program. Algo parecido ocurre con la biología, donde organizaciones aprobadas pueden solicitar acceso mediante el Life Sciences Verification Program. A esto se suma preserved thinking, una protección destinada a dificultar los ataques de destilación masiva. Anthropic está separando así con mucha más precisión dos conceptos que hasta ahora solían ir juntos: lo que el modelo puede hacer y lo que el usuario está autorizado a pedirle.

Claude Opus 5.5 ya está disponible en las plataformas de Anthropic, además de Amazon Web Services, Google Cloud y Microsoft Azure. También mejora un aspecto menos espectacular pero muy relevante en sesiones largas: la comunicación, con respuestas más claras, menos jerga y mayor fidelidad a las reglas de estilo definidas por el usuario. Todo apunta a que esta generación quiere competir menos por una décima adicional en un benchmark y más por el trabajo real que puede completar de forma fiable. Si esa tendencia continúa, la próxima fase de la carrera de IA no se decidirá únicamente por quién construye el modelo más capaz, sino por quién consigue que haga más, en menos tiempo, por menos dinero y con menos sorpresas por el camino.

 

Más infomación

La entrada Claude Opus 5.5 es más potente, más rápido y un 40% más barato se publicó primero en MuyComputer.

 

n-d.mx