Anthropic acaba de lanzar Claude Sonnet 5.5, la versión actualizada de su modelo rápido y económico, y hay una cifra que no encaja a la primera: en un benchmark de coding, y en su máximo nivel de esfuerzo, le gana a Opus 5.5.
En este artículo te cuento qué cambió de verdad, por qué dicen que es más barato si el precio por token es el mismo, para qué tareas tiene sentido usarlo y cómo se comportó cuando lo puse a trabajar en Claude Code.
Este artículo resume el video ¿Para qué sirve Sonnet 5.5 si ya tienes Opus 5.5?. Si prefieres verlo en acción, ahí está la demo completa.
Qué hay de nuevo en Claude Sonnet 5.5
Sonnet siempre ha sido el modelo "del medio" de Anthropic: no es el más inteligente, pero sí uno de los más rápidos y, en teoría, más baratos que ofrecen al público. Con la versión 5.5, la compañía dice que:
- Es alrededor de 30 % más rápido.
- Cuesta alrededor de 30 % menos por tarea.
- En Terminal Bench 4.0, usando su nivel de esfuerzo más alto, llega a superar a Opus 5.5.
Para ponerlo en contexto: Opus 5.5 se lanzó hace poco y es el modelo más potente que se usa a diario. Sonnet 5.5 no pretende ser más inteligente que Opus, pero sí acercarse bastante a su rendimiento con menos tiempo de espera.
¿Por qué es más barato si el precio es el mismo?
Es la duda más lógica: si el precio por token de Sonnet 5.5 es exactamente igual al de la versión anterior, ¿de dónde sale el ahorro?
La respuesta está en cómo genera el código. El modelo no solo produce más rápido, también gasta bastantes menos tokens para llegar al mismo resultado. En la comparación que muestra Anthropic, dos versiones entregan prácticamente la misma respuesta, pero la nueva lo hace en menos tiempo y con menos consumo de tokens. Dicho de otra forma: hace menos "ruido" para lograr lo mismo, y como pagas por token, la factura baja.
Benchmarks: High y Extra High frente a Opus 5.5
Los números más interesantes están en los niveles de esfuerzo (effort):
- En Terminal Bench 4.0, Sonnet 5.5 en su esfuerzo máximo supera a Opus 5.5 en el nivel High.
- En Frontier Code, Sonnet 5.5 en High queda casi a la par de Opus 5.5 en Low, lo que concuerda con lo que se ve en Terminal Bench.
- Con High y Extra High, el resultado es muy parecido a usar un Opus 5.5 con esfuerzo medio.
Resumiendo: en su esfuerzo máximo, Sonnet 5.5 se sitúa aproximadamente entre el nivel Low y el Medium de Opus 5.5. Es ligeramente inferior a Opus, pero bastante más rápido. Por supuesto, son benchmarks publicados por el propio fabricante: la prueba real es usarlo en tus tareas.
¿Para qué sirve Sonnet 5.5 si ya tienes Opus 5.5?
Esta es la pregunta del video, y la respuesta corta es: para todo lo que no necesita el modelo más potente. Algunos ejemplos donde tiene sentido:
- Tareas sencillas del día a día, como convertir un archivo de un formato a otro.
- Pequeñas modificaciones de código que quieres resolver rápido.
- Reescrituras mecánicas, como renombrar archivos.
- Delegar una planificación grande sin gastar el modelo más caro.
- Tareas de asistente, como redactar la respuesta a un correo.
Básicamente, es una fuerza de trabajo más barata y rápida que Opus, con algo de la inteligencia que hoy ofrece Opus. Si ya tienes Opus 5.5, no lo reemplaza: lo complementa para lo cotidiano y deja el modelo grande para lo difícil.
Protecciones de seguridad y contra destilación
Sonnet 5.5 mantiene las mismas protecciones que los modelos más grandes de Anthropic. En temas sensibles como ciberseguridad o biología, el modelo retrocede a una versión anterior. Además incorpora protecciones contra destilación, algo que la compañía viene implementando últimamente en sus modelos más actuales.
La demo en Claude Code
Para probarlo entré a Claude Code, cambié el modelo a Sonnet 5.5 y ajusté el nivel de esfuerzo con el comando:
/effort
Al dar Enter aparece una barra para elegir el nivel. Como en los benchmarks High y Extra High quedan muy cerca de un Opus medio, usé Extra High: la idea no era buscar el modelo más inteligente posible, sino construir rápido.
Un videojuego shooter 3D
Le pedí algo así: "Crea un videojuego shooter 3D futurista con armas láser, con bots enemigos y ambientado en un área desértica". Tras unos 30 minutos obtuve un videojuego de navegador inspirado en la jugabilidad de Doom, y es básicamente jugable. Para ser un primer intento, ya es un juego funcional. Aun así, un proyecto tan extenso no es el uso ideal de Sonnet: su fuerte son las modificaciones más rápidas.
Pasar un proyecto de JavaScript a TypeScript
Después probé una tarea típica para un modelo rápido: pedirle que pase la parte del servidor de un proyecto de JavaScript a TypeScript. Se nota que trabaja bastante más rápido que Opus al ver los mensajes y los logs. Eso sí, no es el mejor ejemplo, porque en una reescritura así conviene revisar los tipos de datos y ahí probablemente prefieras un modelo más inteligente. Para generar archivos y hacer modificaciones, en cambio, cumple bien.
API vs suscripción: cuánto cuesta realmente
Un detalle importante: el ahorro se nota sobre todo dentro de una suscripción. Si lo usas desde la API, sobre todo en su nivel de esfuerzo máximo, verás que no es tan barato como parece. Aun así, comparado con Opus, puedes conseguir algo cercano a su rendimiento por un costo menor, especialmente cuando trabajas a gran escala.
Sonnet 5.5 frente a Fable 5.1 y GPT-6 Astra
Según los benchmarks, Sonnet 5.5 supera a Fable 5.1, y también queda por encima de GPT-6 Astra, el modelo equivalente a un "Flash" de otros laboratorios y que hace unas semanas era de los más potentes. Esto sugiere que, por ahora, Anthropic tiene los modelos más potentes del mercado, y que con Opus 5.5 y Sonnet 5.5 estamos en un nuevo escalón de modelos inteligentes. Eso sí, la comprobación definitiva viene al usarlos en tareas reales.
Conclusión
Sonnet 5.5 es, en resumen, un modelo más rápido y más barato por tarea que Opus, con una inteligencia relativamente similar a la versión mínima de Opus. No cambia el precio por token, pero gasta menos tokens y responde antes.
- Si usas Opus para todo, esto te puede bajar la factura.
- Si vives en Claude Code, vale la pena jugar con los niveles High y Extra High.
- Si solo quieres saber si "se siente" más rápido, mira la demo en el video.
Y tú, ¿ya lo estás usando o sigues en Opus 5.5 para todo? Cuéntamelo en los comentarios y dime qué te gustaría que probara después.
Video completo: https://youtu.be/YVrlmVh0_m4