Claude Haiku 5.5 es el modelo pequeño y rápido que Anthropic lanzó el 7 de octubre de 2026: cuesta 0,10 dólares por millón de tokens de entrada y 0,50 de salida, un 90 % menos que Haiku 4.5 en la mayoría de peticiones, y en sus pruebas supera con claridad a GPT-6 Luna, el modelo pequeño de OpenAI. Ya está disponible en Claude.ai para todos los planes, incluido el gratuito, en Claude Code y en la API como claude-haiku-5-5. No pretende competir con Opus 5.5 ni con Sonnet 5.5 en las tareas difíciles: está hecho para el trabajo repetitivo y de mucho volumen, y para actuar como ayudante rápido de los modelos grandes. Te explicamos qué es, cuánto cuesta, qué dicen sus benchmarks y cuándo te conviene usarlo.
En resumen: 0,10 $ / 0,50 $ por millón de tokens (entrada / salida) hasta 100.000 tokens de contexto; 0,50 $ / 2,50 $ por encima. 72,4 % en OSWorld 2.1 (uso del ordenador) frente al 15,7 % de Haiku 4.5 y el 48,9 % de GPT-6 Luna. Es el modelo más rápido de Anthropic y el primer Haiku con niveles de esfuerzo. Úsalo para resumir, clasificar, extraer datos, chat en tiempo real y como subagente; para programar en serio, Sonnet 5.5 u Opus 5.5.
Claude Haiku 5.5 en datos
| Dato | Detalle |
|---|---|
| Lanzamiento | 7 de octubre de 2026 |
| Identificador en la API | claude-haiku-5-5 |
| Precio (hasta 100.000 tokens) | 0,10 $ entrada · 0,50 $ salida por millón de tokens |
| Precio (más de 100.000 tokens) | 0,50 $ entrada · 2,50 $ salida por millón de tokens |
| Ahorro frente a Haiku 4.5 | Un 90 % en peticiones de hasta 100.000 tokens; un 75 % de media según Anthropic |
| Disponible en | Claude.ai (todos los planes), Claude Code, API, AWS, Google Cloud y Microsoft |
| Novedad | Primer Haiku con niveles de esfuerzo (de bajo a máximo) |
| Pensado para | Resúmenes, clasificación, extracción, chat y voz en tiempo real, subagentes, uso del ordenador |
¿Qué es Claude Haiku 5.5?
Es el modelo más pequeño, rápido y barato de la familia Claude 5.5, la que completan Sonnet 5.5 y Opus 5.5. Anthropic lo define como «el modelo pequeño más barato, rápido y capaz» que ha lanzado, y lo ha diseñado para tareas repetitivas y de gran volumen: resúmenes, compactación de conversaciones largas, consultas a bases de datos, clasificación de peticiones o atención al cliente en directo.
La familia Claude tiene ahora cinco niveles: Mythos y Fable por arriba, Opus como modelo de trabajo diario para tareas complejas, Sonnet para tareas bien acotadas y Haiku para el volumen. Si te perdiste los lanzamientos anteriores, los tienes en nuestros análisis de Claude Opus 5.5 y Claude Sonnet 5.5.
Es también el modelo más rápido de Anthropic a velocidad estándar (solo Opus en modo rápido le supera), lo que lo hace adecuado para conversaciones de voz, chats de soporte y asistentes dentro de aplicaciones, donde cada segundo de espera cuenta.
¿Cuánto cuesta Haiku 5.5?
0,10 dólares por millón de tokens de entrada y 0,50 por millón de salida, siempre que la petición no pase de 100.000 tokens. Por encima de ese tamaño, el precio sube a 0,50 y 2,50 dólares. Según Anthropic, alrededor del 90 % de las peticiones que recibía Haiku 4.5 entraban en el tramo barato.
| Precio por millón de tokens | Haiku 5.5 (hasta / más de 100K) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Entrada | 0,10 $ / 0,50 $ | 1,00 $ | 2,00 $ |
| Salida | 0,50 $ / 2,50 $ | 5,00 $ | 10,00 $ |
| Lectura de caché | 0,01 $ / 0,05 $ | 0,10 $ | 0,10 $ |
| Escritura de caché | 0,125 $ / 0,625 $ | 1,25 $ | 2,50 $ |
Precio por millón de tokens
Dólares en la API de Anthropic. Haiku 5.5 en peticiones de hasta 100.000 tokens. Menos es mejor.
- Entrada
- Salida
Ver los datos en tabla
| Dato | Entrada | Salida |
|---|---|---|
| Haiku 5.5 | 0,10 $ | 0,50 $ |
| Haiku 4.5 | 1,00 $ | 5,00 $ |
| Sonnet 5.5 | 2,00 $ | 10,00 $ |
Dos matices que Anthropic explica en su anuncio. Primero, el ahorro real frente a Haiku 4.5 es de alrededor del 75 % de media, no del 90 %, porque Haiku 5.5 usa un tokenizador nuevo (el mismo de Sonnet 5.5 y Opus 5.5) que gasta algo más de tokens por tarea. Segundo, como en el resto de modelos, el caché de prompts ahorra hasta un 90 % y el procesamiento por lotes, un 50 %.
Un ejemplo con números
Para ver qué significa en la práctica, imagina una tarea que consume 1 millón de tokens de entrada y genera 200.000 de salida (por ejemplo, resumir unos cientos de correos o documentos cortos), con peticiones de menos de 100.000 tokens y sin caché:
| Modelo | Entrada | Salida | Total |
|---|---|---|---|
| Haiku 5.5 | 0,10 $ | 0,10 $ | 0,20 $ |
| Haiku 4.5 | 1,00 $ | 1,00 $ | 2,00 $ |
| Sonnet 5.5 | 2,00 $ | 2,00 $ | 4,00 $ |
Es una cuenta orientativa: Haiku 5.5 gasta algo más de tokens por tarea por su tokenizador nuevo, y con caché o procesamiento por lotes todo baja. Pero sirve para ver el orden de magnitud: lo que antes costaba 2 dólares con Haiku 4.5 ahora cuesta unos céntimos, y eso hace rentables tareas que antes no lo eran, como clasificar todo el correo de una empresa o resumir cada llamada de soporte.
Para comparar con OpenAI y Google, tienes la evolución de precios en nuestra comparativa Claude Sonnet 5.5 o GPT-6.1 Sol.
Benchmarks: Haiku 5.5 frente a Haiku 4.5, GPT-6 Luna y Sonnet 5.5
Anthropic ha publicado los resultados de Haiku 5.5 frente a su predecesor, frente al modelo pequeño de OpenAI y con Sonnet 5.5 como referencia:
| Prueba | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 (ref.) |
|---|---|---|---|---|
| Trabajo profesional · GDPval-AA v2.1 (Elo) | 1620 | 735 | 1437 | 1840 |
| Trabajo con documentos · AA-Briefcase v1.1 (Elo) | 1578 | 614 | 1336 | 1824 |
| Uso del ordenador · OSWorld 2.1 | 72,4 % | 15,7 % | 48,9 % | 83,9 % |
| Razonamiento · Humanity's Last Exam (sin herramientas) | 45,9 % | 10,2 % | — | 56,9 % |
| Razonamiento · Humanity's Last Exam (con herramientas) | 57,4 % | 18,7 % | — | 64,5 % |
| Programación con agentes · Terminal-Bench 4.0 | 39,2 % | 0,0 % | 16,4 % | 70,6 % |
| Programación con agentes · FrontierCode 1.1 | 46,4 % | — | 42,4 % | 52,1 % |
| Razonamiento visual · Chartography | 46,4 % | 6,4 % | 29,1 % | 61,6 % |
Haiku 5.5 frente a Haiku 4.5, GPT-6 Luna y Sonnet 5.5
Porcentaje de acierto en tres pruebas. Más es mejor.
- Haiku 5.5
- Haiku 4.5
- GPT-6 Luna
- Sonnet 5.5 (referencia)
Ver los datos en tabla
| Dato | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 (referencia) |
|---|---|---|---|---|
| Uso del ordenador (OSWorld 2.1) | 72,4 % | 15,7 % | 48,9 % | 83,9 % |
| Programación en terminal (Terminal-Bench 4.0) | 39,2 % | 0,0 % | 16,4 % | 70,6 % |
| Razonamiento visual (Chartography) | 46,4 % | 6,4 % | 29,1 % | 61,6 % |
Lo que dicen estas cifras:
- El salto frente a Haiku 4.5 es enorme en todo, sobre todo en uso del ordenador (de 15,7 % a 72,4 %) y en programación con agentes en terminal (de 0 a 39,2 %).
- Supera a GPT-6 Luna en todas las pruebas comparables, con la mayor diferencia en uso del ordenador (+23,5 puntos) y en Terminal-Bench (+22,8).
- Sonnet 5.5 sigue claramente por encima en las tareas complejas, sobre todo en programación con agentes (70,6 % frente a 39,2 % en Terminal-Bench). Anthropic lo dice sin rodeos: para ese tipo de trabajo, Sonnet y Opus siguen siendo mejores opciones.
Son resultados publicados por el propio fabricante. Las pruebas de Artificial Analysis (GDPval-AA y AA-Briefcase) son externas, pero las ejecuta Anthropic con su configuración; los detalles están en la ficha técnica del modelo.
El primer Haiku con niveles de esfuerzo
Haiku 5.5 es el primer modelo de su gama con control de esfuerzo: como en Opus y Sonnet, puedes elegir cuánto «piensa» antes de responder, en cinco niveles (bajo, medio, alto, muy alto y máximo). Con poco esfuerzo es más rápido y barato; con mucho, acierta más en tareas difíciles a cambio de gastar más tokens.
Anthropic ha publicado gráficas de acierto frente a coste en OSWorld, GDPval-AA y Humanity's Last Exam para cada nivel de esfuerzo, comparadas con Haiku 4.5, Sonnet 5.5 y GPT-6 Luna. Es la palanca que permite usar un único modelo barato para tareas de dificultad variable. Explicamos cómo funcionan los niveles en nuestro tutorial de niveles de esfuerzo de Opus 5.5, y el mecanismo es el mismo.
¿Cuándo usar Haiku 5.5 y cuándo Sonnet u Opus?
Usa Haiku 5.5 cuando la velocidad y el volumen importen más que resolver un problema difícil. Es la recomendación de Anthropic, y la resumimos así:
| Tarea | Modelo recomendado |
|---|---|
| Resumir, clasificar o etiquetar miles de textos | Haiku 5.5 |
| Chat de soporte, asistente de voz o en una app | Haiku 5.5 |
| Rellenar formularios o pasar datos entre aplicaciones (uso del ordenador) | Haiku 5.5 |
| Subagente que hace búsquedas o cambios pequeños para un modelo mayor | Haiku 5.5 |
| Cambios de código acotados en muchos archivos | Haiku 5.5 o Sonnet 5.5 |
| Tareas bien definidas de programación o análisis | Sonnet 5.5 |
| Programación compleja y trabajo de conocimiento difícil | Opus 5.5 |
El patrón que más se va a ver es el de orquestador y subagentes: un modelo grande (Opus o Fable) planifica el trabajo y reparte subtareas a varios Haiku que trabajan en paralelo. Es lo que hace, por ejemplo, Cognition en Devin, y lo que permite Claude Code. Si quieres montar algo así, empieza por nuestro tutorial del Claude Agent SDK.
Lo que dicen las empresas que lo han probado
Anthropic ha publicado los resultados de varias empresas que lo probaron antes del lanzamiento:
- HubSpot: la mejor puntuación que han visto en su batería de tareas de CRM, un 92,8 % de media en tres ejecuciones, y el más rápido de todos los modelos probados.
- Box: 11 puntos más que Haiku 4.5 con la mitad de latencia aproximadamente.
- Asana: más de un 30 % menos de latencia en tareas completas y hasta 2,5 veces más rápido por turno de agente.
- AlphaSense: mejora estadísticamente significativa sobre Haiku 4.5 en preguntas sobre documentos (0,84 frente a 0,76) en un servicio que hace unos 8 millones de llamadas a la semana.
- Cognition: con Haiku 5.5 como ayudante de Opus 5.5, su sistema Devin Fusion mantiene 66,2 puntos en FrontierCode reduciendo coste y latencia.
Las otras novedades: Sonnet más barato y créditos para Max
Anthropic aprovechó el lanzamiento para anunciar otros tres cambios:
- Sonnet 5.5 más barato: la lectura de caché baja a la mitad, de 0,20 a 0,10 dólares por millón de tokens. Como en el trabajo con agentes la mayoría de tokens son lecturas de caché, Sonnet 5.5 sale alrededor de un 20 % más barato en la práctica.
- Créditos de API para Max y Team: los suscriptores de Max 5x reciben 100 dólares al mes en créditos de API, los de Max 20x, 200, y los equipos Team, hasta 500 compartidos. Sirven para cualquier modelo.
- Uso del ordenador y del navegador en los SDK: los SDK de Python y TypeScript incorporan en beta el control del ordenador y del navegador, para lo que Haiku 5.5 es especialmente adecuado por precio y velocidad.
En seguridad, Anthropic afirma que Haiku 5.5 mejora mucho frente a Haiku 4.5 en sus evaluaciones de alineamiento, con menos comportamientos no deseados y menos disposición a colaborar en usos indebidos. Sus salvaguardas de ciberseguridad bloquean las pruebas de penetración y técnicas ofensivas, aunque admiten más tareas defensivas que las de Sonnet 5.5.
Lo que Haiku 5.5 no hace bien
Conviene tener claros sus límites antes de cambiar todo a Haiku por el precio:
- Programación compleja: en Terminal-Bench 4.0 se queda en el 39,2 %, frente al 70,6 % de Sonnet 5.5. Para tareas largas de programación con agentes, Anthropic recomienda Sonnet u Opus.
- Razonamiento difícil: en Humanity's Last Exam sin herramientas saca un 45,9 %, once puntos menos que Sonnet 5.5.
- Peticiones muy largas: por encima de 100.000 tokens el precio se multiplica por cinco, y el ahorro frente a otros modelos se reduce.
- Ciberseguridad ofensiva: sus salvaguardas bloquean las pruebas de penetración; para eso hay que solicitar el programa de verificación de Anthropic.
La regla práctica: empieza con Haiku 5.5 en las tareas sencillas y de volumen, mide los resultados y sube a Sonnet solo donde Haiku falle.
Cómo usar Haiku 5.5
- En Claude.ai (web, iOS y Android): elige Haiku 5.5 en el selector de modelo. Está en todos los planes, también en el gratuito.
- En Claude Code: está disponible como modelo, y es una buena opción para subagentes y tareas rápidas. Lo explicamos en nuestro tutorial de Claude Code.
- En la API: con el identificador
claude-haiku-5-5. Anthropic publica una guía de migración desde Haiku 4.5. - En la nube: Amazon Web Services, Google Cloud y Microsoft.
import anthropic
client = anthropic.Anthropic()
respuesta = client.messages.create(
model="claude-haiku-5-5",
max_tokens=500,
messages=[{"role": "user", "content": "Clasifica este correo como queja, consulta o pedido: ..."}],
)
print(respuesta.content[0].text)
El equipo para trabajar con agentes
Haiku 5.5 corre en los servidores de Anthropic, así que no necesitas un ordenador potente para usarlo. Lo que sí ayuda cuando trabajas con agentes y Claude Code durante horas es un buen puesto de trabajo: un monitor grande para ver código, terminal y navegador a la vez, un teclado cómodo y un equipo fiable.
Un monitor 4K con USB-C
Un 27 pulgadas 4K con USB-C carga el portátil y conecta la imagen con un solo cable.
Ver el monitor Dell 27 Plus 4K S2725QC con USB-C en Amazon
Ver el monitor ASUS ProArt PA279CV 4K con USB-C en Amazon
Un teclado para escribir mucho
Ver el teclado Logitech MX Keys S en Amazon
Un ordenador para programar
Un Mac mini con chip M5 Pro o un MacBook Pro con M5 Pro funcionan muy bien para desarrollar con agentes, y si además quieres probar modelos abiertos en local, un mini PC con Ryzen AI y mucha memoria es la alternativa en Windows o Linux (tienes más opciones en los mejores mini PC).
Ver el Mac mini con M5 Pro en Amazon
Ver el MacBook Pro de 14" con M5 Pro en Amazon
Ver el mini PC GEEKOM A9 MAX con Ryzen AI 9 HX 470 en Amazon
Preguntas frecuentes
¿Qué es Claude Haiku 5.5?
El modelo más pequeño, rápido y barato de la familia Claude 5.5 de Anthropic, lanzado el 7 de octubre de 2026 y pensado para tareas de mucho volumen y respuestas en tiempo real.
¿Cuánto cuesta Claude Haiku 5.5?
0,10 dólares por millón de tokens de entrada y 0,50 por millón de salida en peticiones de hasta 100.000 tokens; 0,50 y 2,50 dólares por encima de ese tamaño.
¿Haiku 5.5 es gratis en Claude.ai?
Sí, se puede elegir en todos los planes de Claude.ai, incluido el gratuito, con los límites de uso de cada plan.
¿Es mejor Haiku 5.5 que GPT-6 Luna?
En las pruebas publicadas por Anthropic, sí en todas las comparables: por ejemplo, 72,4 % frente a 48,9 % en OSWorld 2.1 y 39,2 % frente a 16,4 % en Terminal-Bench 4.0.
¿Sirve Haiku 5.5 para programar?
Para cambios acotados y como subagente, sí. Para programación compleja con agentes, Sonnet 5.5 y Opus 5.5 siguen siendo claramente mejores.
¿Qué son los niveles de esfuerzo de Haiku 5.5?
Un ajuste que decide cuánto razona el modelo antes de responder, de bajo a máximo. Menos esfuerzo es más rápido y barato; más esfuerzo acierta más en tareas difíciles.
¿Cuál es el identificador de Haiku 5.5 en la API?
claude-haiku-5-5, disponible en la API de Anthropic, Amazon Web Services, Google Cloud y Microsoft.
Lecturas relacionadas
- Claude Fable 5.1 y Mythos 5.1
- Cursor, Claude Code, Copilot o Codex: cuál elegir
- Cómo crear un agente con la API de Claude y MCP
- Las mejores alternativas a ChatGPT
Este artículo contiene enlaces afiliados a Amazon con el tag arkaiacorp-21. Si compras a través de estos enlaces, Arkaia puede recibir una comisión sin coste adicional para ti. Nuestra valoración editorial es independiente y no varía según los ingresos por afiliación.
Comentarios
Inicia sesion para dejar un comentario
Acceder