Volver al blog

Claude Sonnet 5.5: Anthropic acelera y abarata su modelo para el trabajo diario

Compartir

Anthropic lanzó Claude Sonnet 5.5 con más de 30% de mejora en velocidad y hasta 30% menos costo por tarea. Revisé sus benchmarks, precios y diferencias frente a Sonnet 5 y Opus 5.5 para entender qué cambia realmente para quienes usamos IA a diario.

Claude Sonnet 5.5: Anthropic acelera y abarata su modelo para el trabajo diario

Anthropic lanzó hoy, 28 de septiembre de 2026, Claude Sonnet 5.5. Apenas seis días después de presentar Opus 5.5, ya tenemos la segunda pieza de la nueva familia.

Y hay algo que me llamó la atención desde los primeros números: Anthropic no intentó vender Sonnet 5.5 simplemente como un Opus más barato.

La propuesta es bastante más práctica. Quieren un modelo rápido para las tareas que hacemos todos los días, suficientemente capaz para acercarse a Opus en varios escenarios y con un costo real por trabajo considerablemente menor. Anthropic

El 30% de ahorro necesita una explicación

Hay un detalle importante porque el anuncio puede prestarse a confusión.

Anthropic no redujo 30% el precio de los tokens.

Sonnet 5.5 conserva las tarifas de Sonnet 5:

ConceptoSonnet 5.5Opus 5.5
Entrada, 1M tokens$2 USD$4 USD
Salida, 1M tokens$10 USD$20 USD
Lectura de caché, 1M tokens$0.20 USD$0.20 USD
Escritura de caché, 1M tokens$2.50 USD$5 USD

El ahorro que anuncia Anthropic viene de otro lado: Sonnet 5.5 necesita normalmente menos tokens para completar el mismo trabajo. Según sus pruebas, esto puede representar hasta 30% menos costo por tarea. Anthropic

Para mí, esta métrica es bastante más interesante.

Cuando utilizamos un modelo mediante API, que cueste lo mismo cada token no significa que dos modelos cuesten lo mismo haciendo el trabajo. Uno puede necesitar varias iteraciones, más contexto y una salida enorme para resolver algo que otro termina mucho antes.

Es como cobrar la misma tarifa por hora a dos técnicos cuando uno termina el trabajo en tres horas y el otro en cinco.

También es bastante más rápido

Anthropic reporta que Sonnet 5.5 genera la salida más de 30% más rápido que Sonnet 5, convirtiéndolo en el Sonnet más rápido que han lanzado hasta ahora. Anthropic

Esto parece un dato secundario hasta que trabajas todo el día con IA.

En una pregunta aislada, esperar unos segundos adicionales da prácticamente igual. Cuando estás programando y encadenas decenas o cientos de interacciones con un agente, la latencia empieza a estorbar.

Ahí sí quiero velocidad.

El salto en programación es enorme

Esta parte fue la que primero me hizo detenerme en la tabla.

En Terminal-Bench 4.0, una prueba de programación mediante agentes trabajando en terminal, los resultados publicados por Anthropic son:

  • Sonnet 5.5: 70.6%
  • Sonnet 5: 10.3%
  • Opus 5.5: 66.4%

Sí, la diferencia entre generaciones es así de grande en esta evaluación.

Pero tampoco tomaría un benchmark aislado como prueba definitiva de que Sonnet sea mejor que Opus. La propia Anthropic advierte que Opus 5.5 continúa siendo claramente superior en trabajos complejos y abiertos que requieren mantener criterio durante periodos largos. Anthropic

Eso es importante.

Los benchmarks sirven para comparar comportamientos concretos bajo condiciones concretas. No son una calificación universal de inteligencia.

Cuando miramos más pruebas aparece una imagen más interesante

Los resultados oficiales publicados por Anthropic incluyen:

EvaluaciónSonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070.6%10.3%66.4%
CursorBench 4.055.5%34.1%57.8%
GDPval-AA v2.1184414491846
AA-Briefcase v1.1181113591822
Humanity's Last Exam64.5%54.9%67.7%
OSWorld 2.180.1%57.0%81.8%
Chartography61.6%15.6%64.4%

Aquí empieza a verse dónde encaja Sonnet 5.5.

En GDPval-AA queda apenas dos puntos detrás de Opus 5.5. En OSWorld la diferencia es de 1.7 puntos. En CursorBench son 2.3.

Sonnet ya no parece simplemente el hermano económico que aceptas cuando no quieres pagar Opus. En varias tareas se está acercando mucho al modelo superior. Anthropic

¿Entonces para qué queda Opus 5.5?

Para el trabajo difícil.

Anthropic plantea una división bastante clara.

Sonnet 5.5 está orientado a tareas cotidianas bien delimitadas: corregir bugs, programar, trabajar con documentos, crear presentaciones y hojas de cálculo, analizar imágenes y colaborar rápidamente.

Opus 5.5 está pensado para problemas complejos, abiertos y con mayor necesidad de mantener criterio durante mucho tiempo. Anthropic

Como desarrollador, esta separación me parece lógica.

No necesito utilizar el modelo más potente disponible para absolutamente todo. Si estoy corrigiendo un error localizado, revisando una función o generando documentación, quiero velocidad y precisión a un costo razonable.

Si tengo un problema de arquitectura, necesito analizar muchas dependencias o estoy delegando una tarea que puede tomar bastante tiempo, ahí sí tiene sentido subir a Opus.

Hay otra variable nueva: el nivel de esfuerzo

Claude permite modificar cuánto esfuerzo dedica el modelo al trabajo.

En las aplicaciones de Claude y Claude Code, Sonnet 5.5 utiliza Medium de forma predeterminada. En Claude Platform el valor predeterminado es High.

Un nivel menor reduce tiempo y consumo de tokens. Uno mayor permite al modelo trabajar más tiempo y revisar con mayor profundidad lo que está haciendo. Anthropic

Esto abre una opción que me interesa mucho más que elegir siempre entre modelos.

Podemos utilizar el mismo modelo de distinta manera dependiendo del problema.

Anthropic asegura, por ejemplo, que Sonnet 5.5 en Low o Medium supera en algunas evaluaciones el mejor resultado de Sonnet 5 gastando aproximadamente una décima parte por tarea. En FrontierCode, Sonnet 5.5 con High alcanza resultados considerablemente superiores a Sonnet 5 con un costo por tarea mucho menor. Anthropic

Ese tipo de optimización sí puede mover la factura de una aplicación que haga miles de operaciones.

También hay cambios importantes en seguridad

Hay otro detalle que puede pasar desapercibido entre tantos benchmarks.

Las capacidades de Sonnet 5.5 en ciberseguridad aumentaron lo suficiente para que Anthropic lo lance con protecciones similares a las implementadas en Opus 5.5.

Según la compañía, estas medidas están dirigidas a un conjunto reducido de solicitudes de alto riesgo y el desarrollo normal de software debería mantenerse prácticamente sin cambios. Anthropic

Anthropic también evaluó el comportamiento del modelo en aproximadamente 1,850 escenarios automatizados relacionados con alineación, engaño, resistencia al abuso y acciones contrarias a la intención del usuario. La empresa reporta resultados iguales o mejores que Sonnet 5 en la mayoría de esas pruebas, aunque reconoce que ninguna evaluación puede detectar todos los posibles fallos. Anthropic

Esa última parte conviene conservarla cuando vemos cualquier tabla de seguridad: son evaluaciones, no garantías.

Y todavía falta Haiku 5.5

La familia todavía no está completa.

Anthropic confirmó que Claude Haiku 5.5 llegará durante las próximas semanas, enfocado en aplicaciones de gran volumen donde velocidad y costo pesan todavía más. Anthropic

Entonces la estrategia empieza a quedar bastante clara:

  • Haiku para volumen y costo.
  • Sonnet para la mayoría del trabajo cotidiano.
  • Opus para los problemas complejos.

La diferencia es que Sonnet se acercó bastante a Opus en varios escenarios, y eso vuelve mucho más interesante la decisión de qué modelo usar.

Lo que me llevo

Durante mucho tiempo hemos comparado modelos fijándonos primero en quién consigue el porcentaje más alto.

Con Sonnet 5.5 me interesa otra métrica: cuánto cuesta resolver una tarea completa.

Un modelo que cobra exactamente lo mismo por token puede terminar siendo considerablemente más barato si necesita menos contexto, menos intentos y menos salida para llegar a un resultado correcto.

Y si además responde 30% más rápido, esa mejora empieza a sentirse directamente mientras trabajas.

Para quienes usamos IA como herramienta de desarrollo y no solamente como chatbot, ahí está probablemente la parte más importante de este lanzamiento.

Conclusión

Claude Sonnet 5.5 parece una actualización mucho más importante de lo que su “.5” podría sugerir.

El salto respecto a Sonnet 5 aparece en programación, trabajo profesional, uso de computadora, interpretación visual, velocidad y eficiencia. Al mismo tiempo, Anthropic mantiene a Opus 5.5 como la opción para problemas donde hace falta más razonamiento sostenido y criterio.

Quiero probar especialmente esa diferencia trabajando en proyectos reales. Los benchmarks me dicen dónde empezar a mirar; varias horas programando con ambos modelos me dirán cuál termino usando.

La información técnica y las evaluaciones completas están en el anuncio oficial de Claude Sonnet 5.5 y en las System Cards de Anthropic.

// Categoría

IA

Recibe novedades del sitio

Te avisamos cuando publiquemos artículos de tecnología, nuevas guías, cursos y recursos para ayudarte a trabajar mejor.

Solo cuando haya algo nuevo en el sitio. Sin publicidad y puedes darte de baja cuando quieras.

¿Esto se parece a un reto de tu empresa?

Cuéntame cómo funciona hoy y vemos si conviene automatizarlo, integrarlo o mejorarlo.

Cuéntame tu caso

La IA debe servirnos, no decidir por nosotros

La IA puede ahorrar tiempo y abrir oportunidades, pero también puede concentrar poder y desplazar decisiones humanas. El reto no es frenar la tecnología, sino usarla con criterio.

Leer artículo: La IA debe servirnos, no decidir por nosotros

Microsoft Build 2026 y la nueva PC para developers con IA local

Microsoft Build 2026 mostró algo más grande que Copilot: una nueva generación de PCs para developers capaces de correr modelos de IA localmente y conectarse con la nube.

Leer artículo: Microsoft Build 2026 y la nueva PC para developers con IA local

Agentes de IA en Windows: oportunidades y controles para empresas

Los agentes de IA prometen ejecutar más tareas. La oportunidad para las empresas está en diseñar procesos, permisos y controles antes de automatizar.

Leer artículo: Agentes de IA en Windows: oportunidades y controles para empresas