Imagina una oficina con dos profesionales veteranos. Una es la socia a la que llamas a la reunión cuando el caso es inusual y hay mucho en juego. El otro es el compañero que despacha el montón de la semana —cuarenta correos, tres hojas de cálculo, una presentación para el jueves— rápido y bien.
La mayoría de nosotros necesita a la segunda persona mucho más a menudo que a la primera. Claude Sonnet 5.5 es ese compañero.
Anthropic lo lanzó el 28 de septiembre de 2026, una semana después de Claude Opus 5.5, como segundo modelo de la familia Claude 5.5. Está pensado como el complemento cotidiano de Opus. En palabras de Anthropic, Opus está hecho para el trabajo complejo que exige un criterio cuidadoso, mientras que Sonnet 5.5 destaca en tareas cotidianas bien acotadas, en corregir errores y en crear documentos, presentaciones y hojas de cálculo cuidados.
¿Cuánto se acerca a Opus?
Más de lo que cabría esperar, al menos en las pruebas independientes.
Artificial Analysis tiene dos pruebas centradas en trabajo profesional terminado, no en preguntas de examen. En GDPval-AA v2.1, los modelos producen entregables reales —un modelo financiero, un memorando jurídico, un informe— y los resultados se comparan cara a cara, como partidas de ajedrez. Sonnet 5.5 obtuvo 1844 Elo. Opus 5.5 obtuvo 1846, una diferencia demasiado pequeña para importar. En la más reciente AA-Briefcase, que evalúa trabajo intelectual más largo y de varios pasos, logró 1811 frente a los 1822 de Opus.
La medida independiente más amplia es el Intelligence Index de Artificial Analysis, una puntuación compuesta a partir de evaluaciones exigentes. Con esfuerzo max, Sonnet 5.5 obtuvo 56, solo por detrás de Opus 5.5 con 58.
Para un Sonnet es un salto enorme. Su predecesor, Sonnet 5, obtuvo 1449 en GDPval-AA. En la práctica, el trabajo de oficina que antes necesitaba el modelo insignia puede pasar ahora al modelo más barato y rápido.
Dónde sigue ganando Opus
Hay dos terrenos en los que la diferencia es real.
Los datos. La prueba AA-Omniscience de Artificial Analysis plantea miles de preguntas sobre hechos. Sonnet 5.5 acertó el 54 %; Opus 5.5, el 66 %. Un modelo más pequeño simplemente guarda menos conocimiento. Pero hay un lado bueno: cuando Sonnet 5.5 no sabía una respuesta, se la inventó el 47 % de las veces, frente al 59 % de Opus 5.5. Sabe menos, pero está más dispuesto a reconocerlo. Aun así, para una fecha poco conocida, un nombre o una estadística, pídele que busque en la web o que cite una fuente.
El criterio. Aquí Anthropic es inusualmente directa. En varias pruebas, Sonnet 5.5 con esfuerzo max rinde de forma comparable a Opus 5.5. Pero en las pruebas internas de Anthropic y en las de evaluadores externos, Opus 5.5 sigue siendo claramente más fuerte en el trabajo complejo y abierto que exige un criterio sostenido. Si una pregunta no tiene un marco evidente —una decisión estratégica, un contrato con cláusulas poco habituales—, sigue siendo terreno de Opus.
En qué es bueno
Anthropic destaca los documentos, los resúmenes, las hojas de cálculo y las presentaciones, y dice que el modelo tiene buen ojo para el diseño: puede seguir una plantilla de diapositivas con tanta precisión que apenas hace falta retocarla. Su lectura de gráficos ha mejorado muchísimo. En la prueba Chartography de Anthropic, que pide leer valores de gráficos sin herramientas, obtuvo un 61,6 %, frente al 15,6 % de Sonnet 5.
También es rápido. Anthropic dice que la respuesta llega más de un 30 % más rápido que con Sonnet 5, y los primeros evaluadores lo notaron: Zendesk cuenta que las incidencias de soporte se procesaron un 20 % más rápido, y Box midió 2,4 veces la velocidad de la versión anterior.
Además puede manejar un ordenador. En OSWorld 2.1, donde un modelo hace clic y escribe para abrirse paso por aplicaciones de escritorio reales, Anthropic informa de un 80,1 % con puntuación parcial, cerca del 81,8 % de Opus 5.5.
Deja el control a media altura
Sonnet 5.5 tiene cinco niveles de esfuerzo: low, medium, high, xhigh y max. Las aplicaciones de Claude usan medium por defecto. Esto es lo que midió Artificial Analysis en cada nivel:
| Esfuerzo | Intelligence Index | Coste por tarea |
|---|---|---|
| Low | 36 | 0,41 $ |
| Medium | 41 | 0,59 $ |
| High | 47 | 1,08 $ |
| Xhigh | 52 | 2,74 $ |
| Max | 56 | 7,60 $ |
El último escalón es el caro. En max, Sonnet 5.5 escribió unos 193.000 tokens de salida por tarea, la cifra más alta que Artificial Analysis ha medido nunca y alrededor de un 60 % más que Opus 5.5 en max. Para la mayoría de la gente en la aplicación de Claude, eso significa simplemente esperar más. Para los desarrolladores que pagan por token, significa que un Sonnet al máximo ya no es la opción barata. Si una tarea necesita tanto razonamiento, normalmente merece Opus.
La pega honesta
Sin imágenes. Claude lee bien capturas de pantalla, gráficos y PDF escaneados, pero no genera imágenes, audio ni vídeo. Si quieres una aplicación que además dibuje y hable, ChatGPT y Gemini son más completos.
El precio por token no es el precio por tarea. Los tokens cuestan lo mismo que en Sonnet 5: 2 dólares por millón de entrada y 10 dólares por millón de salida. Anthropic dice que las tareas típicas cuestan hasta un 30 % menos porque el modelo termina en menos pasos. Eso vale con los ajustes normales; en max, como muestra la tabla, la factura sube deprisa.
Algunas peticiones están protegidas. Sonnet 5.5 es el primer Sonnet que llega con las salvaguardas de ciberseguridad más estrictas que Anthropic aplica a sus modelos más potentes. Las peticiones de seguridad de mayor riesgo pasan visiblemente a Sonnet 5. Para casi todo el mundo, esto nunca llega a importar.
Para quién es
| Si tu día se parece a… | Usa | Por qué |
|---|---|---|
| Correos, resúmenes, hojas de cálculo, presentaciones | Claude Sonnet 5.5 | Trabajo de oficina casi al nivel de Opus, rápido y en el plan gratuito |
| Decisiones de alto riesgo, datos poco conocidos, investigación enrevesada | Claude Opus 5.5 | Más conocimiento y un criterio claramente más fuerte |
| «Maneja este programa en mi ordenador y termina el trabajo» | GPT-6 Astra | Agente de uso del ordenador más fuerte y económico |
| Una sola aplicación para chat, imágenes y voz | ChatGPT o Gemini | Caja de herramientas creativa más amplia |
El veredicto para el día a día
Claude Sonnet 5.5 no sustituirá a Opus en las preguntas más difíciles, y Anthropic no finge lo contrario. Pero las preguntas más difíciles son una parte pequeña de la mayoría de las semanas. Para todo lo demás, es rápido, capaz, está en el plan gratuito de Claude y tiene un precio que te permite no pensar en ello. Déjalo en el ajuste predeterminado, comprueba los datos poco conocidos y llama a Opus cuando lo que está en juego sube.