Claude Sonnet 5.5 es casi un Opus 5.5 a mitad de precio. Anthropic lo lanzó el 28 de septiembre de 2026, seis días después de Opus 5.5, y los números de su propio anuncio lo dejan claro: en la mayoría de pruebas queda a uno o dos puntos del modelo grande, en programación agéntica con terminal incluso lo supera, y cuesta 2 dólares por millón de tokens de entrada y 10 de salida, la mitad que Opus. Además es más de un 30 % más rápido que Sonnet 5 y gasta menos tokens por tarea. Aquí tienes qué cambia, todos los benchmarks publicados, cuánto cuesta de verdad, dónde se puede usar y cuándo sigue compensando pagar por Opus.
Respuesta rápida: Claude Sonnet 5.5 salió el 28 de septiembre de 2026. Cuesta 2 dólares por millón de tokens de entrada y 10 de salida, igual que Sonnet 5 y la mitad que Opus 5.5. Según Anthropic, es más de un 30 % más rápido que Sonnet 5, usa hasta un 30 % menos de tokens por tarea y se queda muy cerca de Opus 5.5 en casi todas las pruebas: 80,1 % frente a 81,8 % en uso del ordenador (OSWorld 2.1) y 1844 frente a 1846 puntos en trabajo profesional (GDPval-AA). En programación con terminal, Terminal-Bench 4.0, lo supera: 70,6 % frente a 66,4 %. Está disponible en las apps de Claude, en la API como claude-sonnet-5-5 y en AWS, Google Cloud y Microsoft Azure.
Sonnet 5.5 en una tabla
| Dato | Claude Sonnet 5.5 |
|---|---|
| Lanzamiento | 28 de septiembre de 2026 |
| Familia | Claude 5.5: segundo modelo, tras Opus 5.5 (22 de septiembre); Haiku 5.5 llegará «en las próximas semanas» |
| Precio en la API | 2 $ por millón de tokens de entrada y 10 $ de salida |
| Caché | 0,20 $ por millón en lectura y 2,50 $ en escritura |
| Velocidad | Más de un 30 % más rápido que Sonnet 5 generando texto |
| Eficiencia | Hasta un 30 % menos de tokens por tarea |
| Esfuerzo por defecto | Alto en la API; medio en Claude Code y en las apps web |
| Identificador en la API | claude-sonnet-5-5 |
| Plataformas | Apps de Claude, Claude Platform, AWS, Google Cloud y Microsoft Azure |
Los benchmarks: casi Opus, muy por encima de Sonnet 5
Anthropic publicó una tabla con ocho pruebas que compara Sonnet 5.5 con su predecesor, con Opus 5.5 y, en algunas, con GPT-6 Sol de OpenAI. Las que se miden en porcentaje son estas:
Claude Sonnet 5.5 frente a Sonnet 5 y Opus 5.5
Porcentaje de acierto en las pruebas publicadas por Anthropic. Más es mejor.
- Sonnet 5.5
- Sonnet 5
- Opus 5.5
Ver los datos en tabla
| Dato | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6 % | 10,3 % | 66,4 % |
| OSWorld 2.1 | 80,1 % | 57,0 % | 81,8 % |
| Humanity's Last Exam | 64,5 % | 54,9 % | 67,7 % |
| Chartography | 61,6 % | 15,6 % | 64,4 % |
| CursorBench 4.0 | 55,5 % | 34,1 % | 57,8 % |
| FrontierCode 1.1 | 46,2 % | 42,4 % | 54,4 % |
Tres lecturas rápidas:
- El salto frente a Sonnet 5 es enorme en tareas de agente. En Terminal-Bench 4.0, que mide si un modelo resuelve tareas reales de programación y sistemas trabajando en una terminal, pasa del 10,3 % al 70,6 %. En OSWorld 2.1, que mide el uso de un ordenador con ratón y teclado, del 57,0 % al 80,1 %. En Chartography, del 15,6 % al 61,6 %.
- Frente a Opus 5.5, la diferencia es pequeña. Queda entre 1,7 y 3,2 puntos por debajo en uso del ordenador, CursorBench, Humanity's Last Exam y Chartography. La excepción es Terminal-Bench, donde Sonnet 5.5 gana por 4,2 puntos.
- FrontierCode es donde más se nota el tamaño. En esa prueba de programación difícil, Sonnet 5.5 saca un 46,2 % en su mejor configuración, frente al 54,4 % de Opus 5.5 y el 49,3 % de GPT-6 Sol.
Las otras dos pruebas, GDPval-AA y AA-Briefcase, no se miden en porcentaje sino con una puntuación de tipo Elo que compara modelos entre sí en trabajo profesional real: informes, hojas de cálculo, presentaciones. Por eso van en un gráfico aparte:
Trabajo profesional: puntuación Elo
GDPval-AA v2.1 y AA-Briefcase v1.1. Más es mejor.
- Sonnet 5.5
- Sonnet 5
- Opus 5.5
- GPT-6 Sol
Ver los datos en tabla
| Dato | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| GDPval-AA | 1 844 | 1 449 | 1 846 | 1 487 |
| AA-Briefcase | 1 811 | 1 359 | 1 822 | 1 483 |
Aquí el resultado es todavía más llamativo: Sonnet 5.5 empata prácticamente con Opus 5.5 (1844 frente a 1846 en GDPval-AA, 1811 frente a 1822 en AA-Briefcase) y saca más de 350 puntos a GPT-6 Sol. Si ya leíste nuestro análisis de Opus 5.5, la conclusión es incómoda para el modelo grande: en trabajo de oficina, pagas el doble por casi lo mismo.
| Prueba | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70,6 % | 10,3 % | 66,4 % | — |
| FrontierCode 1.1 (principal) | 46,2 % | 42,4 % | 54,4 % | 49,3 % |
| CursorBench 4.0 | 55,5 % | 34,1 % | 57,8 % | — |
| GDPval-AA v2.1 (Elo) | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 (Elo) | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64,5 % | 54,9 % | 67,7 % | — |
| OSWorld 2.1 | 80,1 % | 57,0 % | 81,8 % | — |
| Chartography | 61,6 % | 15,6 % | 64,4 % | 53,6 % |
Una advertencia: son cifras de la propia Anthropic, con su configuración de pruebas. Además, según The Decoder, algunos resultados de trabajo profesional salieron de una versión previa al lanzamiento con un fallo, ya corregido, que podía afectar a las respuestas estructuradas. Las pruebas independientes llegarán en las próximas semanas.
Precio: lo mismo que Sonnet 5, la mitad que Opus
Anthropic ha mantenido exactamente la tarifa de Sonnet 5:
Precio de la API por millón de tokens
Tarifa estándar en dólares, sin impuestos. Menos es mejor.
- Sonnet 5.5
- Opus 5.5
Ver los datos en tabla
| Dato | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| Entrada | 2 $ | 4 $ |
| Salida | 10 $ | 20 $ |
| Modelo | Entrada (por millón) | Salida (por millón) | Lectura de caché |
|---|---|---|---|
| Claude Sonnet 5.5 | 2 $ | 10 $ | 0,20 $ |
| Claude Sonnet 5 | 2 $ | 10 $ | 0,20 $ |
| Claude Opus 5.5 | 4 $ | 20 $ | 0,20 $ |
Pero el precio por token cuenta solo la mitad de la historia. Como Sonnet 5.5 gasta menos tokens para resolver la misma tarea y hace menos llamadas a herramientas, Anthropic calcula que cada tarea cuesta hasta un 30 % menos que con Sonnet 5, aunque la tarifa sea idéntica. Y hay un dato todavía más fuerte: en varias pruebas, Sonnet 5.5 con esfuerzo bajo o medio supera la mejor puntuación de Sonnet 5 costando aproximadamente una décima parte por tarea. En FrontierCode, con el mismo ajuste, saca unos 10 puntos más que Sonnet 5 por alrededor de una quinceava parte del coste.
Si pagas una suscripción de Claude en lugar de la API, esto se traduce en otra cosa: tu límite de uso rinde más, porque cada tarea consume menos. Tienes cómo funcionan los planes en nuestra comparativa de Cursor, Claude Code, Copilot y Codex.
Más rápido y con menos tokens por tarea
La velocidad es la mejora que más se nota en el día a día. Anthropic asegura que Sonnet 5.5 genera texto más de un 30 % más rápido que Sonnet 5, y que agrupa mejor las llamadas a herramientas: en lugar de pedir un archivo, esperar, pedir otro y esperar, lanza varias peticiones a la vez. Para un agente que trabaja en un repositorio, eso significa terminar antes y gastar menos.
Las empresas que lo han probado dan cifras en la misma línea. Box habla de respuestas 2,4 veces más rápidas con un 12 % menos de tokens; Zendesk, de tickets procesados un 20 % más rápido; Atlassian, de agentes hasta un 30 % más rápidos que con Sonnet 5. Son testimonios elegidos por Anthropic para su anuncio, así que conviene tomarlos como lo que son, pero apuntan todos en la misma dirección.
Niveles de esfuerzo: cuál usar
Como Opus 5.5, Sonnet 5.5 permite elegir cuánto «piensa» antes de responder, en varios niveles que van de bajo a máximo. Por defecto, Anthropic lo configura en esfuerzo alto en la API y en esfuerzo medio en Claude Code y en las apps web. Explicamos cómo cambiarlo en el tutorial de niveles de esfuerzo y modo rápido, que sirve igual para Sonnet 5.5.
Hay un detalle curioso en la letra pequeña: en FrontierCode, Sonnet 5.5 saca peor nota con esfuerzo máximo que con el nivel inmediatamente inferior. Según la explicación recogida por The Decoder, con el esfuerzo al máximo el modelo activa más a menudo una función de revisión de código que reparte el trabajo entre varios subagentes, y eso a veces provoca que se agote el tiempo o que haga cambios fuera del alcance pedido. Moraleja práctica: más esfuerzo no siempre es mejor. Para programar, el nivel medio o alto suele ser el punto dulce.
| Tarea | Esfuerzo recomendado |
|---|---|
| Preguntas rápidas, resúmenes, correos | Bajo |
| Programación del día a día, cambios acotados | Medio (el de Claude Code) |
| Refactorizaciones, análisis de documentos largos | Alto |
| Problemas muy difíciles, sin prisa | Muy alto; prueba el máximo solo si lo anterior no basta |
Qué más cambia: diseño, tareas largas y seguridad
- Mejor en diseño e interfaces. Anthropic destaca que cuida más el acabado visual cuando genera páginas y aplicaciones.
- Tareas largas. Aguanta mejor los trabajos de muchas horas, algo que su predecesor hacía peor. Como anécdota, es el primer Sonnet que ha completado Pokémon Rojo guiándose solo por capturas de pantalla.
- Menos búsquedas innecesarias. CodeRabbit, la empresa de revisión de código, destaca que ha desaparecido la tendencia de Sonnet 5 a buscar en la web demasiado a menudo.
- Ciberseguridad con salvaguardas de Opus. Sus capacidades de ciberseguridad han mejorado lo suficiente como para que Anthropic le aplique las mismas protecciones que a Opus 5.5. Según la empresa, la depuración rutinaria no se ve afectada.
- Protección contra la destilación. Añade clasificadores que impiden extraer su razonamiento para entrenar otros modelos.
En un momento en el que OpenAI ha tenido que pausar sus modelos más potentes tras un incidente con un agente, que Anthropic lance un modelo con más capacidad agéntica y salvaguardas reforzadas es también un mensaje.
Lo que dicen las empresas que lo han probado
El anuncio incluye testimonios de clientes con acceso anticipado. Estos son los más concretos:
- Epic Games (Daniel Vogel, director de operaciones): superó sus listones de calidad en auditorías de diseño de sistemas y manejó decenas de miles de líneas de código manteniendo respuestas ágiles.
- CodeRabbit (David Loker, vicepresidente de IA): «La tendencia de Sonnet 5 a recurrir a la búsqueda web demasiado a menudo y su alto consumo de tokens han desaparecido».
- Box (Yashodha Bhavnani): más preciso, 2,4 veces más rápido y con un 12 % menos de tokens.
- Zendesk (Abhinay Kathuria): tickets procesados un 20 % más rápido.
- Atlassian (Jamil Valliani): sus agentes Rovo pueden funcionar hasta un 30 % más rápido que con Sonnet 5.
Dónde se puede usar
- Apps de Claude (web, escritorio y móvil).
- Claude Code, con esfuerzo medio por defecto. Si programas con él, nuestro tutorial de Claude Code explica cómo cambiar de modelo.
- API de Claude, con el identificador
claude-sonnet-5-5. - Nubes: Amazon Web Services, Google Cloud y Microsoft Azure.
Anthropic indica además que está disponible con retención de datos cero en todos sus niveles, algo relevante para empresas españolas que manejan datos sensibles. Si trabajas con Claude desde España, te interesa también saber que Anthropic abrió oficina en Madrid.
Sonnet 5.5, Opus 5.5 o Fable 5.1: cuál elegir
| Si necesitas… | Elige | Por qué |
|---|---|---|
| Un modelo para casi todo, con buen coste | Sonnet 5.5 | Rinde casi como Opus a la mitad de precio y más rápido |
| Programación con agentes en terminal | Sonnet 5.5 | Gana a Opus en Terminal-Bench 4.0 |
| Los problemas de programación más difíciles | Opus 5.5 | Le saca 8 puntos en FrontierCode |
| Razonamiento de máxima dificultad | Opus 5.5 | Mejor en Humanity's Last Exam |
| Agentes que trabajan durante días | Fable 5.1 | Anthropic lo presenta como su modelo para agentes de muy larga duración (análisis de Fable 5.1) |
| Mucho volumen al menor coste | Espera a Haiku 5.5 | Llegará en las próximas semanas para aplicaciones de gran volumen |
Para la mayoría de usuarios y empresas, la recomendación es sencilla: usa Sonnet 5.5 por defecto y sube a Opus 5.5 solo cuando notes que se queda corto. Si quieres ver cómo quedan frente a los modelos de OpenAI y Google, tienes nuestra comparativa de alternativas a ChatGPT.
Las pegas y lo que falta por saber
- Son cifras de Anthropic. Faltan pruebas independientes, y algunas de trabajo profesional salieron de una versión previa con un fallo ya corregido.
- El esfuerzo máximo no siempre ayuda, como muestra el caso de FrontierCode.
- No se han detallado en el anuncio la ventana de contexto ni el máximo de salida, así que hay que consultarlos en la documentación de la API antes de diseñar aplicaciones que dependan de ellos.
- Sonnet 5 sigue en la tabla, pero no hay fecha de retirada anunciada. Si lo usas en producción, conviene planificar la migración con calma: misma tarifa y mejor rendimiento hacen que haya poco motivo para quedarse.
El equipo para trabajar con Claude
Claude funciona en la nube, así que no necesitas un ordenador potente para usarlo. Lo que sí mejora mucho el trabajo con agentes es la pantalla y, si ejecutas el código que genera, algo de memoria:
- Un monitor pensado para programar, como el BenQ RD280U, con formato 3:2 que muestra más líneas de código a la vez.
- Memoria de sobra para contenedores y tests: 64 GB de DDR5 Crucial Pro a 6000 MHz.
- Un teclado cómodo para escribir instrucciones largas: el Redragon K673 Pro con distribución española.
Y si quieres aprender a sacarle partido, tres libros en español: De cero a experto en Claude IA, una guía general; Aprende Claude Code CLI, centrado en la herramienta de programación; y Programar con Inteligencia Artificial: agentes, MCP y vibe coding, sobre el flujo de trabajo con agentes.
Preguntas frecuentes
¿Cuándo salió Claude Sonnet 5.5?
El 28 de septiembre de 2026, seis días después de Claude Opus 5.5. Es el segundo modelo de la familia Claude 5.5; Haiku 5.5 llegará en las próximas semanas.
¿Cuánto cuesta Claude Sonnet 5.5 en la API?
2 dólares por millón de tokens de entrada y 10 por millón de salida, igual que Sonnet 5 y la mitad que Opus 5.5. La lectura de caché cuesta 0,20 dólares por millón y la escritura, 2,50.
¿Es Sonnet 5.5 mejor que Opus 5.5?
En casi todas las pruebas queda ligeramente por debajo, entre 1 y 3 puntos, pero supera a Opus 5.5 en Terminal-Bench 4.0 (70,6 % frente a 66,4 %) y empata en trabajo profesional. Opus sigue siendo mejor en los problemas de programación más difíciles.
¿Cuánto más rápido es Sonnet 5.5 que Sonnet 5?
Según Anthropic, genera texto más de un 30 % más rápido y usa hasta un 30 % menos de tokens por tarea, lo que abarata cada tarea hasta un 30 % aunque la tarifa sea la misma.
¿Puedo usar Sonnet 5.5 en Claude Code?
Sí. En Claude Code funciona con esfuerzo medio por defecto, y se puede cambiar el nivel de esfuerzo según la tarea.
¿Cuál es el identificador de Sonnet 5.5 en la API?
claude-sonnet-5-5. También está disponible en Amazon Web Services, Google Cloud y Microsoft Azure.
¿Cuándo sale Claude Haiku 5.5?
Anthropic solo ha dicho que llegará en las próximas semanas, pensado para aplicaciones de gran volumen y sensibles al coste.
Lecturas relacionadas
- Claude Opus 5.5: benchmarks, precio y análisis
- Niveles de esfuerzo y modo rápido: tutorial
- Cómo crear skills para Claude Code
- OpenAI frena GPT-6.1 Astra por seguridad
Este artículo contiene enlaces afiliados a Amazon con el tag arkaiacorp-21. Si compras a través de estos enlaces, Arkaia puede recibir una comisión sin coste adicional para ti. Nuestra valoración editorial es independiente y no varía según los ingresos por afiliación.
Comentarios
Inicia sesion para dejar un comentario
Acceder