Por qué Anthropic cortó el precio de Claude Haiku 5.5 un 90%
Anthropic lanzó el 7 de octubre de 2026 Claude Haiku 5.5, su modelo pequeño más barato hasta la fecha, con un recorte de precio del 90% para peticiones por debajo de 100.000 tokens. La tarifa base queda en US$0,10 por millón de tokens de entrada y US$0,50 por millón de tokens de salida, igualando a GPT-6 Luna de OpenAI según los datos publicados por la propia Anthropic y recogidos por VentureBeat.
El lanzamiento llega en un momento de presión competitiva feroz. OpenAI presentó GPT-6 Sol y GPT-6 Luna el 22 de septiembre de 2026, con precios también recortados un 50% frente a sus predecesores GPT-5.6, y Anthropic ya había lanzado Opus 5.5 y Sonnet 5.5 durante las semanas previas según Unite.AI y TechRepublic. Haiku 5.5 completa la familia 5.5 en aproximadamente un mes.
Qué cambia en el precio: dos tramos, no uno
Anthropic estructuró la tarifa de Haiku 5.5 en dos tramos, una decisión que define dónde conviene usarlo:
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días- Peticiones por debajo de 100.000 tokens: US$0,10 entrada, US$0,50 salida, US$0,01 lectura de caché y US$0,125 escritura de caché por millón de tokens.
- Peticiones por encima de 100.000 tokens: US$0,50 entrada, US$2,50 salida, US$0,05 lectura y US$0,625 escritura por millón.
La diferencia entre tramos es cinco veces superior, lo que obliga a routing de modelos real en producción, no solo a elegir el más barato. Anthropic reconoce que cerca del 90% de las peticiones a Haiku 4.5 caían en el tramo corto, pero las cargas que crucen el umbral de 100K verán un salto de coste inmediato.
Según Anthropic el coste medio de un workload cae alrededor del 75% frente a Haiku 4.5, una vez descontado el efecto del nuevo tokenizer, que consume algo más de tokens para el mismo trabajo. La cifra es reportada por el propio vendor, no validada de forma independiente todavía.
Dónde queda Haiku 5.5 frente a la competencia
La siguiente tabla compara precios base, sin descuentos por batch, herramientas ni tarifas negociadas, según los datos publicados por cada proveedor y consolidados por VentureBeat:
- Anthropic Haiku 5.5 (<100K): US$0,10 entrada / US$0,50 salida.
- OpenAI GPT-6 Luna (base): US$0,10 entrada / US$0,50 salida, con recargo por encima de 272.000 tokens de entrada.
- Google Gemini 3.5 Flash-Lite: US$0,30 entrada / US$2,50 salida.
- Anthropic Haiku 5.5 (>100K): US$0,50 entrada / US$2,50 salida.
- Google Gemini 3.8 Flash (promo hasta 31-dic-2026): US$0,75 entrada / US$3,75 salida.
- xAI Grok 4.3 (<200K): US$1,25 entrada / US$2,50 salida.
- xAI Grok 4.7 (<200K): US$2,00 entrada / US$6,00 salida.
- OpenAI GPT-6.1 Sol: US$2,00 entrada / US$10,00 salida.
- Anthropic Sonnet 5.5: US$2,00 entrada / US$10,00 salida.
Haiku 5.5 queda empatado en precio con GPT-6 Luna en el tramo corto, pero el umbral de cada proveedor es distinto: los 100.000 tokens de Anthropic frente a los 272.000 de OpenAI, lo que significa que un agente con contexto grande verá precios divergentes entre proveedores aunque el número de entrada parezca equivalente.
Benchmarks: gana a su predecesor, no a la familia grande
Anthropic publicó resultados propios en cinco evaluaciones, todos favorables a Haiku 5.5 frente a Haiku 4.5 y GPT-6 Luna en los test seleccionados. Sonnet 5.5 sigue siendo superior en capacidad bruta. Resultados según VentureBeat:
- GDPval-AA v2.1 (knowledge work): 1.620 Haiku 5.5 vs. 1.437 Luna, frente a 1.840 de Sonnet 5.5.
- AA-Briefcase v1.1: 1.578 Haiku 5.5 vs. 1.336 Luna.
- OSWorld 2.1 (subset offline): 72,4% Haiku 5.5 vs. 48,9% Luna.
- Terminal-Bench 4.0 (coding agéntico): 39,2% Haiku 5.5 vs. 16,4% Luna.
- FrontierCode 1.1: 46,4% Haiku 5.5 vs. 42,4% Luna.
Haiku 5.5 introduce niveles de effort ajustables (low, medium, high, max). El 39,2% en Terminal-Bench se alcanza al esfuerzo máximo; en medium baja a aproximadamente 20%, según los materiales de Anthropic. Esto importa para el coste real: subir el effort aumenta la factura pero mejora la calidad, y la decisión debe tomarse workload por workload.
Qué dicen los clientes tempranos (con letra pequeña)
Anthropic cita seis empresas como testers tempranos. AlphaSense (Daniel Campos) reporta una mejora estadísticamente significativa frente a Haiku 4.5 en 400 consultas estilo producción para su función Ask in Document*, con 0,84 vs. 0,76 en una carga que mueve unas 8 millones de llamadas por semana. *HubSpot* (Ze'ev Klapow) obtuvo un 92,8% promedio en su evaluación de CRM en tres ejecuciones. Asana (Aaron Vinh) dice haber visto una reducción de latencia superior al 30% y hasta 2,5 veces más inferencia por turno de agente. Box (Yashodha Bhavnani) reporta 11 puntos de mejora con aproximadamente la mitad de latencia. Cognition (Walden Yan) usa Haiku 5.5 como modelo secundario en Devin Fusion, y Rogo (Alex Wang) lo posiciona en lookups cortos y subagentes de resumen.
Caveat: ninguno de estos testimonios aporta cifras de tokens por segundo comparables entre proveedores. Anthropic tampoco publica throughput oficial en los materiales revisados; afirma que Haiku 5.5 es su modelo más rápido a velocidad estándar, pero admite que Opus en Fast Mode lo supera.
Los cambios complementarios que no debes pasar por alto
El lanzamiento de Haiku 5.5 viene empaquetado con dos cambios que afectan a quienes ya usan Claude:
- Sonnet 5.5 cache reads bajan de US$0,20 a US$0,10 por millón de tokens, un 50%. Anthropic estima alrededor de un 20% de ahorro en workloads agénticos típicos, ya que las lecturas de caché son una parte creciente del consumo. Según Unite.AI.
- Créditos mensuales de API para suscriptores Max y Team: US$100 para Max 5x, US$200 para Max 20x y hasta US$500 compartidos en planes Team, aplicables a cualquier modelo de la plataforma.
Haiku 5.5 ya está disponible en Anthropic, AWS, Google Cloud y Microsoft Azure bajo el identificador claude-haiku-5-5, y los SDK de Python y TypeScript añaden soporte beta para uso de navegador y computadora. Anthropic también endureció restricciones de ciberseguridad frente a Haiku 4.5: las pruebas de pentesting quedan bloqueadas por defecto, y las organizaciones que necesiten acceso más amplio pueden aplicar a los programas de verificación.
¿Qué significa esto para tu startup?
Si estás pagando Anthropic por agente, este lanzamiento toca directamente tu cuenta de infraestructura. Rutas cortas a Haiku, rutas largas a Sonnet u Opus ya no es opcional: es donde está el ahorro. El recorte del 90% aplica solo a tu primer tramo, no a tu factura entera.
Acciones concretas que puedes aplicar esta semana:
- Mide la distribución de longitudes de tus prompts en producción. Si más del 80% cae por debajo de 100K tokens, Haiku 5.5 baja tu coste medio de forma inmediata; si predominan >100K, el ahorro real es 50% y conviene comparar con GPT-6 Luna, que mantiene el tramo barato hasta 272K.
- Reescribe tu router para que enrute por tamaño, no solo por capacidad. Subir todo a Sonnet 5.5 o Opus 5.5 multiplica tu factura entre 20x y 40x frente a Haiku 5.5 en el tramo corto. Un clasificador simple por número de tokens antes del router paga la factura.
- Activa la caché de Sonnet 5.5. Pasó de US$0,20 a US$0,10 por millón de tokens de lectura, y los workloads agénticos con contexto repetido ven caídas de coste reales.
- Si gastas más de US$1.000/mes en API de Claude, evalúa el plan Max 5x o Max 20x: los créditos mensuales (US$100-200) sirven de colchón para experimentar con Haiku 5.5 sin penalizar el runway.
La lección de fondo: la batalla de 2026 no es solo qué modelo es más listo, sino cuánto trabajo útil entrega por dólar. Anthropic, OpenAI y Google están compitiendo en precio por millón de tokens, y eso cambia la economía de cualquier producto agéntico que dependa de LLMs en producción. Un founder que no reescriba su router en los próximos 60 días va a pagar el doble que su competidor por el mismo producto.
Fuentes
- Anthropic launches Claude Haiku 5.5 with 90% API price reduction, matching GPT-6 Luna - VentureBeat
- Anthropic Releases Claude Haiku 5.5, Cutting Small-Model API Prices - Unite.AI
- Anthropic upgrades Claude with new Haiku 5.5 model - 9to5Mac
- Anthropic Launches Claude Opus 5.5 With Lower Prices and Faster Output - TechRepublic
- OpenAI Launches GPT-6 Sol and Luna, Halves API Prices - CIOL
- OpenAI Releases GPT-6 Sol and Luna: 50% Cheaper API Pricing and Benchmarks - MarkTechPost
- Anthropic's Claude Sonnet 5.5 Is Out, Beats Opus 5.5 at Coding for Half the Price - Decrypt
Leíste lo que hace la IA. ¿Y en tu negocio?
En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.
👥 Probar 7 días














