Por Redacción Pangea IA · 7 de octubre de 2026
Anthropic ha lanzado Claude Haiku 5.5, su modelo más rápido y barato para clasificar, resumir, extraer datos y atender tareas repetitivas a gran escala. La novedad reduce un 90 % la tarifa por token frente a Haiku 4.5 cuando el prompt no supera los 100.000 tokens: cuesta 0,10 dólares por millón de tokens de entrada y 0,50 dólares por millón de salida. Para peticiones más largas, las tarifas suben a 0,50 y 2,50 dólares, respectivamente. La compañía calcula que el coste medio por trabajo baja alrededor de un 75 %, una cifra distinta de la rebaja nominal porque el nuevo tokenizador utiliza más tokens para procesar el mismo texto.
Qué es Claude Haiku 5.5 y para qué sirve
Haiku es la familia ligera de Anthropic. No pretende sustituir a Sonnet u Opus en un análisis ambiguo, una migración compleja de software o una tarea larga que exige criterio sostenido. Su terreno natural son las operaciones breves, frecuentes y verificables: etiquetar miles de solicitudes, extraer campos de facturas, resumir conversaciones, decidir a qué departamento debe llegar un ticket, generar consultas de base de datos o responder en tiempo real dentro de una aplicación.
El modelo admite texto e imágenes como entrada y texto como salida. Tiene una ventana de contexto de un millón de tokens, hasta 128.000 tokens de salida en la API normal y 300.000 en la API por lotes, todavía en beta. Es también el primer Haiku con razonamiento adaptativo: decide cuándo necesita pensar más y el desarrollador puede ajustar el esfuerzo para equilibrar calidad, latencia y coste.
Anthropic lo presenta además como subagente de modelos mayores. Un Claude Opus 5.5 puede elaborar el plan y delegar en varios Haiku tareas pequeñas como buscar una cifra en un informe, compactar el historial de un agente o comprobar un dato. Esa arquitectura solo compensa cuando cada subtarea tiene una salida clara y puede validarse: multiplicar agentes sin controles también multiplica llamadas, errores y consumo.
Precio de Claude Haiku 5.5: dos tramos que conviene entender
| Concepto | Prompt de hasta 100.000 tokens | Prompt de más de 100.000 tokens | Haiku 4.5 |
|---|---|---|---|
| Entrada | 0,10 $/millón | 0,50 $/millón | 1 $/millón |
| Salida | 0,50 $/millón | 2,50 $/millón | 5 $/millón |
| Lectura de caché | 0,01 $/millón | 0,05 $/millón | 0,10 $/millón |
| Escritura de caché, 5 minutos | 0,125 $/millón | 0,625 $/millón | 1,25 $/millón |
El salto de precio aparece cuando el prompt supera los 100.000 tokens. No se refiere únicamente al último mensaje del usuario, sino al contexto que la aplicación envía al modelo: instrucciones, historial, documentos y resultados de herramientas. En el tramo corto, Haiku 5.5 cuesta una décima parte por token que Haiku 4.5. En el largo, cuesta la mitad. Anthropic afirma que aproximadamente el 90 % de las solicitudes al Haiku anterior quedaban dentro del primer tramo.
La API por lotes ofrece un 50 % de descuento adicional en entrada y salida a cambio de procesar trabajos de forma asíncrona. Puede tener sentido para clasificar un archivo de incidencias durante la noche o resumir un repositorio documental, pero no para un chat, una llamada o un asistente que debe responder al instante. La caché reduce aún más el coste cuando muchas peticiones reutilizan las mismas instrucciones o documentos.
Dos ejemplos de coste para una pyme
Clasificar cien mil consultas cortas
Supongamos que cada ejecución utiliza 10.000 tokens de entrada entre instrucciones, datos y contexto, y produce 2.000 de salida. Con Haiku 5.5, la llamada costaría unos 0,002 dólares: 0,001 por la entrada y 0,001 por la salida. Cien mil ejecuciones sumarían unos 200 dólares. A las tarifas de Haiku 4.5, la misma cantidad nominal de tokens costaría unos 2.000 dólares.
Es una comparación matemática, no una promesa de factura. La documentación advierte de que el tokenizador nuevo produce aproximadamente un 30 % más de tokens para el mismo texto, aunque la variación depende del idioma y del contenido. Por eso Anthropic habla de un ahorro medio por tarea cercano al 75 %, no del 90 %. También influyen las repeticiones, el razonamiento, la caché, las herramientas y la longitud de la respuesta.
Analizar un documento muy largo
Una llamada con 150.000 tokens de entrada y 10.000 de salida entra en el tramo largo. Costaría aproximadamente 0,10 dólares con Haiku 5.5: 0,075 por la entrada y 0,025 por la salida. Con las tarifas de Haiku 4.5, el cálculo nominal sería 0,20 dólares. El descuento sigue siendo relevante, pero es menor y puede hacer preferible dividir el documento, recuperar solo los fragmentos pertinentes o reutilizar una caché.
Rendimiento: mejora amplia, pero los datos son del fabricante
Anthropic publica saltos grandes frente a Haiku 4.5. En su evaluación de trabajo profesional GDPval-AA, Haiku 5.5 obtiene 1.620 puntos frente a 735; en la parte sin conexión de OSWorld, que mide uso del ordenador, pasa del 15,7 % al 72,4 %; y en Terminal-Bench 4.0, centrado en tareas de terminal, alcanza el 39,2 %. En esas mismas pruebas, Sonnet 5.5 continúa por delante en los trabajos complejos.
Las cifras proceden de evaluaciones publicadas por Anthropic y no convierten a Haiku en la opción correcta para cualquier tarea. Cambian con las herramientas, el nivel de esfuerzo, el prompt y la forma de puntuar. Los testimonios incluidos en el anuncio también pertenecen a clientes seleccionados por el proveedor. Son señales útiles para decidir qué probar, no sustitutos de una evaluación propia.
La comparación más relevante para una empresa es el coste por resultado válido. Un modelo barato puede salir caro si obliga a repetir llamadas o corregir errores; uno más potente puede sobrar para extraer cuatro campos estables. La reciente actualización a Claude Sonnet 5.5 mantiene ventaja en automatizaciones complejas, código y trabajo de varias etapas, mientras Haiku encaja mejor en operaciones estrechas y masivas.
Qué cambia para pymes y autónomos de España
La rebaja abre casos que antes podían ser difíciles de justificar: revisar automáticamente formularios de contacto, proponer categorías contables sin aprobar asientos, resumir llamadas, transformar correos en campos de un CRM o preparar respuestas que una persona valida. También puede permitir que una aplicación reserve Sonnet u Opus para las excepciones y envíe la mayoría de operaciones sencillas a Haiku.
- Elegir una tarea repetitiva y reversible. Conviene empezar por clasificación, extracción o borradores, no por pagos, decisiones laborales o cambios irreversibles.
- Reunir entre 50 y 200 casos reales. El conjunto debe incluir errores frecuentes, documentos incompletos y excepciones, con el resultado esperado.
- Medir tres variables. Calidad, latencia y coste total por resultado aceptado, incluido el tiempo humano de revisión.
- Comparar al menos dos modelos. Haiku 5.5 frente al modelo actual y, si la tarea es compleja, frente a Sonnet 5.5.
- Desplegar con una ruta de vuelta. Empezar con una parte pequeña del tráfico, registrar fallos y conservar el modelo anterior durante la validación.
La disponibilidad técnica no resuelve por sí sola privacidad ni cumplimiento. Anthropic ofrece Haiku 5.5 en su API, Amazon Bedrock, Google Cloud y Microsoft Foundry. Cada organización debe revisar dónde se procesa el dato, las condiciones del proveedor, los recargos de región y el contrato de encargado de tratamiento. Si el flujo usa datos personales, la evaluación debe incluir minimización, permisos, conservación y supervisión humana. La ampliación de Claude para pequeñas empresas muestra el potencial de conectar procesos, pero también por qué conviene empezar con permisos mínimos.
Seguridad, disponibilidad y límites
Haiku 5.5 ya figura como modelo activo con el identificador claude-haiku-5-5. La documentación oficial lo sitúa en la API y en las nubes de Amazon, Google y Microsoft; el registro del sistema del producto también confirma su uso en la web y las aplicaciones de Claude. El precio final puede variar en servicios de terceros y por opciones de residencia regional.
Es el primer modelo Haiku que incorpora salvaguardas específicas de ciberseguridad. Anthropic indica que son más restrictivas que las de Haiku 4.5, aunque menos que las aplicadas a Sonnet 5.5. Las tareas defensivas ordinarias siguen permitidas, mientras que las pruebas de penetración y técnicas con mayor potencial ofensivo pueden bloquearse. En biología utiliza protecciones similares a Sonnet 5, Sonnet 5.5 y Opus 5.
El lanzamiento incluye dos cambios adicionales. Las lecturas de caché de Sonnet 5.5 bajan de 0,20 a 0,10 dólares por millón de tokens; Anthropic estima que eso reduce alrededor de un 20 % el coste de muchas tareas con agentes. Además, durante esta semana comenzará a ofrecer crédito mensual de API: 100 dólares para Max 5x, 200 para Max 20x y hasta 500 compartidos en Team. Son condiciones anunciadas por la empresa y pueden depender de la cuenta y del despliegue progresivo.
Conclusión: el modelo pequeño se convierte en infraestructura
Claude Haiku 5.5 importa menos por ganar un benchmark que por cambiar la economía de las tareas breves. Una tarifa de 0,10 y 0,50 dólares por millón de tokens en el tramo corto permite ejecutar clasificación, extracción y soporte a una escala que antes exigía recortar volumen o buscar otro proveedor. La contrapartida es una estructura de precio con dos tramos y un tokenizador que impide trasladar la rebaja nominal directamente a la factura.
Para una pyme, la decisión sensata no es migrar toda su automatización, sino probar un proceso de bajo riesgo y medir el coste por resultado correcto. Haiku 5.5 puede encargarse del trabajo repetitivo; Sonnet y Opus siguen teniendo sentido para excepciones, planificación y decisiones difíciles. Ese reparto, con evaluación y supervisión, es donde el nuevo modelo tiene más posibilidades de aportar valor real.
Lecturas relacionadas
Fuentes consultadas
- Anthropic: presentación de Claude Haiku 5.5 (7 de octubre de 2026; consulta: 7 de octubre de 2026).
- Claude Platform: especificaciones, precios y disponibilidad de Haiku 5.5 (consulta: 7 de octubre de 2026).
- Reuters: lanzamiento y posicionamiento empresarial de Claude Haiku 5.5 (7 de octubre de 2026; consulta: 7 de octubre de 2026).
- VentureBeat: precios, créditos de API y usos empresariales (7 de octubre de 2026; consulta: 7 de octubre de 2026).


Deja una respuesta