Claude Haiku 5.5: 75% más barato y rival de GPT-6 Luna

Claude Haiku 5.5 llega para reescribir la economía de los agentes

Anthropic presentó Claude Haiku 5.5, su modelo pequeño más capaz, rápido y barato hasta la fecha. La compañía asegura que, en promedio, cuesta alrededor de un 75% menos que Haiku 4.5 y, para los prompts de hasta 100.000 tokens (el 90% de las solicitudes que recibía el Haiku anterior), el descuento real roza el 90%, según los datos publicados en la página oficial del lanzamiento.

Para una startup hispanohablante que hoy paga por inferencia a gran escala, esa cifra no es un detalle técnico: cambia la ecuación de qué automatizar y qué dejar fuera del presupuesto. El nuevo Haiku entra a competir de frente con GPT-6 Luna de OpenAI, que según Yahoo Finance cobra US$0,10 por millón de tokens de entrada y US$0,50 por millón de salida — exactamente el mismo precio que Anthropic fijó para Haiku 5.5 en su franja corta.

Qué trae Haiku 5.5 bajo el capó

El modelo está pensado para tareas de alto volumen y sensibles al coste: resúmenes, compactaciones de contexto, consultas a bases de datos, clasificación de tickets y atención al cliente en vivo. En el comunicado oficial, Anthropic lo presenta como un buen compañero de los modelos más grandes —Sonnet 5.5 y Opus 5.5— cuando actúa como subagente en flujos de trabajo de programación.

Leíste lo que hace la IA. ¿Y en tu negocio?

En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.

👥 Probar 7 días

En pruebas de referencia internas, Haiku 5.5 obtiene resultados muy por encima de Haiku 4.5:

  • OSWorld 2.1 (uso de computador, subconjunto offline): 72,4% frente a 15,7%.
  • Terminal-Bench 4.0 (codificación agéntica): 39,2% frente a 0,0%.
  • Humanity’s Last Exam con herramientas: 57,4% frente a 18,7%.
  • GDPval-AA v2.1 (trabajo de conocimiento): 1.620 frente a 735.

En la mayoría de esos benchmarks, Haiku 5.5 queda por debajo de Sonnet 5.5, que sigue siendo la referencia para tareas agénticas complejas, pero gana de forma consistente al también nuevo GPT-6 Luna de OpenAI, según la propia tabla comparativa de Anthropic. El modelo es, además, el primero de la familia Haiku en ofrecer un ajuste de esfuerzo que permite a los desarrolladores decidir entre optimizar coste o capacidad, igual que en Sonnet y Opus.

Precios: la nueva tabla de Anthropic

Concepto (por millón de tokens) Haiku 5.5 (≤100k / >100k) Haiku 4.5 Sonnet 5.5
Lectura de caché US$0,01 / US$0,05 US$0,10 US$0,10
Escritura de caché US$0,125 / US$0,625 US$1,25 US$2,50
Tokens de entrada US$0,10 / US$0,50 US$1,00 US$2,00
Tokens de salida US$0,50 / US$2,50 US$5,00 US$10,00

El cambio de precios no se quedó en Haiku. Anthropic también redujo a la mitad el precio de las lecturas de caché de Sonnet 5.5 —de US$0,20 a US$0,10 por millón de tokens— lo que abarata alrededor de un 20% la mayoría de trabajos agénticos, según TechRepublic. La compañía enmarca el movimiento en la creciente presión competitiva por costes: en el sector se habla abiertamente de un «colapso de precios» donde los modelos de gama baja pueden llegar a costar 1/100 de los flagship.

Por qué importa: la guerra de precios de la inferencia se acelera

El movimiento de Anthropic llega en un momento de presión cruzada. Por un lado, OpenAI lanzó GPT-6 Sol y Luna a finales de septiembre con rebajas del 50% frente a GPT-5.6, dejando a Luna en US$0,10 de entrada y US$0,50 de salida por millón de tokens, exactamente el mismo precio que Haiku 5.5. Por otro, Google mantiene precios introductorios para Gemini 3.8 Flash —US$0,75 de entrada y US$3,75 de salida— válidos, según análisis del sector, hasta el 31 de diciembre de 2026.

Yahoo Finance recogió el contexto: «la guerra de precios de la IA se intensifica» mientras los clientes enterprise buscan recortar costes tras el ciclo de gasto desbocado del «tokenmaxxing» de 2025. Anthropic, además, está preparando su salida a bolsa antes de Acción de Gracias y reportó US$4.600 millones de facturación en 2025, con pérdidas de US$42.000 millones en el mismo período, según el prospecto S-1 al que accedió Reuters.

Para una startup que hoy diseña su arquitectura de IA, la conclusión es directa: si tu aplicación depende de un modelo de gama media-alta para cada llamada, estás pagando de más. El patrón que están adoptando las empresas citadas por Anthropic y OpenAI es routing por dificultad: un clasificador barato decide qué consulta va a un modelo ligero y cuál necesita escalar a Sonnet 5.5, Opus 5.5 o GPT-6 Astra.

Qué significa esto para tu startup

Si estás construyendo agentes, soporte automatizado o cualquier flujo de alto volumen sobre Claude, Haiku 5.5 es el nuevo suelo de precio por defecto para las tareas que no requieren razonamiento profundo. Esto es lo que puedes hacer desde hoy:

  • Audita tu mix de modelos por tarea. Clasifica las llamadas a la API en tres baldes —razonamiento complejo, generación media y ejecución repetitiva— y mapea cada uno contra Opus 5.5, Sonnet 5.5 y Haiku 5.5. Es esperable que entre el 50% y el 80% de las llamadas a tu agente caigan en el último balde, donde Haiku 5.5 ya es competitivo con Sonnet en capacidad.
  • Mueve resumen, clasificación y compactación de contexto a Haiku 5.5. Las compactaciones que alimentan el contexto de Sonnet u Opus en flujos de RAG o codificación agéntica son el caso de uso estrella según Anthropic: son baratas, rápidas y alivian la carga del modelo grande que viene detrás.
  • Aprovecha el ajuste de esfuerzo. Como Haiku 5.5 hereda el parámetro de effort (low, medium, high) ya disponible en Sonnet y Opus, puedes experimentar con un mismo modelo en lugar de mantener tres SKUs separados. Empieza en medium y solo sube a high donde verifiques que la calidad cae.
  • Cuidado con los precios temporales. Algunas tarifas actuales son introductorias: GPT-5.6 Sol tiene precio promocional hasta el 21 de noviembre de 2026, y Gemini 3.6–3.8 Flash mantiene precio de lanzamiento hasta fin de año. Si tu modelo de negocio depende de un competidor barato, planifica con el precio regular.
  • Créditos nuevos para experimentar. Anthropic anunció que esta semana llega un crédito mensual de API para suscriptores Max 5x (US$100), Max 20x (US$200) y Team (hasta US$500), utilizable en cualquier modelo de la familia. Si ya estás en uno de esos planes, es momento de prototipar sin quemarte en costes de prueba.

Disponibilidad y siguiente paso

Haiku 5.5 está disponible desde el lanzamiento en la API de Anthropic, en Amazon Web Services, Google Cloud y Microsoft Azure, con el identificador claude-haiku-5-5. Los SDK de Python y TypeScript ya se actualizaron con soporte beta para computer use y browser use, los dos casos donde la combinación de velocidad, capacidad y precio del modelo brilla especialmente.

El contexto es claro: en menos de un mes, OpenAI, Anthropic y Google han movido ficha en precio, capacidad y disponibilidad. Para founders hispanohablantes, la pregunta dejó de ser «qué modelo uso» y pasó a ser «qué arquitectura de enrutamiento diseño para que mi coste por tarea baje de un dígito sin perder calidad».

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

Leíste lo que hace la IA. ¿Y en tu negocio?

En CAR, dueños de empresa arman en 7 días su primer sistema funcionando: que ningún cliente se les escape, o que el informe del lunes salga solo. Con otros emprendedores al lado.

👥 Probar 7 días

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...