Claude Fable 5.1: caché 4 veces más barata y agente largo

Anthropic lanza Claude Fable 5.1: más agente largo y caché a la cuarta parte del precio

Anthropic puso hoy en disponibilidad general a Claude Fable 5.1, sucesor de Fable 5 y primer modelo «Mythos-class» de la casa con cache reads a US$0,25 por millón de tokens, una cuarta parte del precio de su predecesor. La nueva versión mantiene los precios de input (US$10/MTok) y output (US$50/MTok) pero ataca directamente el coste real de los agentes largos: re-leer contexto cacheado ahora cuesta 0,025 veces el input base, frente al 0,1 de los demás modelos Claude. En trabajos muy agentic, la factura típica cae hasta un 45% según Anthropic, según recoge 9to5Mac.

Fable 5.1 llega con un mensaje claro: si tu problema requiere cadenas largas de razonamiento, investigación multi-paso, coding sostenido o trabajo sobre documentos, hojas y slides, este es el modelo a usar. Para casi todo lo demás, Anthropic recomienda empezar con Claude Opus 5.

Qué cambia respecto a Fable 5

La nueva versión trae ocho modificaciones documentadas: tres son rompedoras para integraciones existentes y cinco son aditivas.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Las tres que rompen código:

  • Tool use forzado deja de funcionar. tool_choice con type: "any" o type: "tool" devuelve 400 invalid_request_error. Solo se admitentes auto y none. El motivo es que thinking está siempre activo en Fable 5.1 y un tool forzado lo saltaría, degradando la calidad de los argumentos.
  • Los thinking blocks solo fluyen en una dirección. Fable 5.1 lee los bloques de modelos anteriores, pero ningún modelo anterior puede leer los suyos. Si una conversación baja de Fable 5.1 a Opus 5 o Fable 5, se pierde el razonamiento en los turnos ejecutados ahí.
  • Editar turnos anteriores invalida thinking blocks. Cambiar el system prompt, las tools o un mensaje anterior produce error en la siguiente request. La alternativa es tratar la conversación como append-only: usar mid-conversation system messages para añadir instrucciones y mid-conversation tool changes para modificar herramientas.

Las cinco que suman:

  • Per-message effort (beta) vía el header mid-conversation-output-config-2026-07-01: cambiar el nivel de esfuerzo entre turnos sin invalidar el cache.
  • Turn-scoped system messages (beta) vía mid-conversation-system-clear-at-2026-08-21: mensajes de sistema que aplican solo al turno actual y dejan de contar como input una vez consumido.
  • Progress updates legibles (beta) vía thinking-display-updates-2026-08-18: devuelve como texto las actualizaciones entre tool calls; útil para interfaces de usuario que necesitan narrar qué hace el agente.
  • Cache read a 1/4 de precio sobre la tarifa de Fable 5.
  • Provenance de contenido: marca de agua estadística en el texto generado y credenciales C2PA en imágenes/videos creados por el modelo a través del Files API.

El check de binding de thinking se aplica ya a cuentas creadas a partir del 31 de agosto de 2026; para cuentas anteriores la API registra el mismatch pero solo actúa si la request fija thinking.block_binding.prefix_mismatch_behavior.

Precios detallados y dónde corre

Concepto Precio (USD)
Input base US$10 / MTok
Cache write 5 min US$12,50 / MTok
Cache write 1 hora US$20 / MTok
Cache read US$0,25 / MTok
Output US$50 / MTok
Batch input US$5 / MTok
Batch output US$25 / MTok

Disponibilidad: API de Claude con ID claude-fable-5-1, Amazon Bedrock (anthropic.claude-fable-5-1) y Google Cloud Vertex AI. La gemela Claude Mythos 5.1 se ofrece solo a participantes aprobados de Project Glasswing (ciberseguridad y life sciences). Ambos comparten especificaciones y precios, y mantienen retención de datos de 30 días, no estando disponibles bajo zero data retention salvo autorización expresa.

Por qué importa para founders y product builders

La combinación de thinking siempre activo, caché barato y control de effort por mensaje convierte a Fable 5.1 en una herramienta especialmente afinada para agentes que ejecutan docenas de tool calls sobre el mismo contexto (un codebase, un data lake, una base legal). El propio Anthropic cita el caso del fondo Millennium: el modelo identificó la causa de un crash raro en sus sistemas internos que ni su equipo ni otros modelos habían logrado explicar en varios años.

Si tu producto ya corre sobre Fable 5, el coste por sesión en workload agentic debería bajar entre un 25% y un 45% solo con el cambio de modelo, según el tipo de uso que reporta 9to5Mac. Si estás en Opus 5, conviene correr evals en Fable 5.1 a esfuerzo alto solo cuando Opus 5 a alto esfuerzo se queda corto — la ganancia se concentra en el extremo superior.

¿Qué significa esto para tu startup?

Más allá del titular, hay decisiones técnicas que tomar esta semana:

  • Audita tu uso de tool_choice. Si en algún endpoint usabas "any" o "tool": "nombre" para forzar una llamada, esa llamada va a empezar a fallar. Migra a "auto" + strict: true o mueve el schema a structured outputs. Anthropic lo detalla en su guía de prompting para Fable 5.1.
  • Mide el coste de tus agentes con caché. Antes de cambiar de modelo, instrumenta una semana con cache_read_input_tokens separado de input_tokens en tus logs. Vas a ver que en sesiones largas de coding/research la fracción cacheada suele superar el 70%. Aplicar la nueva tarifa sobre esa fracción te dice cuánto ahorras en producción.
  • Revisa tu manejo de thinking blocks. Si tu código construye el array messages a mano y edita turnos anteriores (re-emitir system prompts, reordenar tools, eliminar mensajes intermedios), vas a empezar a ver errores 400 con "The block is bound to a different conversation". La salida limpia es rediseñar para append-only y usar turn-scoped system messages para recordatorios por turno en lugar de inyectar texto y borrarlo.
  • Planifica el effort por turno, no por sesión. Si una parte de tu flujo (por ejemplo, parsear output de un tool) es rutinaria y otra (decidir próximos pasos) requiere más razonamiento, ahora puedes fijar output_config.effort: "low" en los turnos simples y effort: "high" solo en los complejos. El cache sobrevive al cambio.
  • Considera Vertex AI o Bedrock si ya estás ahí. Si tu infra corre en AWS o GCP, evita salir a la API pública: desplegar como anthropic.claude-fable-5-1 en Bedrock simplifica el SOC2 y mantiene los datos dentro de tu tenancy. Para Mythos 5.1 sigue siendo necesario pasar por el programa Glasswing.

Lo que no se mueve (y por qué)

Anthropic mantiene sin cambios tres comportamientos de Messages API que conviene no romper:

  • No se puede apagar thinking. thinking: {"type": "enabled"} con budget_tokens y thinking: {"type": "disabled"} devuelven 400. Hay que omitir el campo o enviar {"type": "adaptive"}.
  • temperature, top_p, top_k también devuelven 400. Fable 5.1 gestiona esos parámetros internamente.
  • Thinking display por defecto sigue siendo "omitted". Si quieres ver lo que el modelo dice entre tool calls, opta por la beta "updates" o "summarized".

Contexto del sector

Fable 5 había tenido un lanzamiento agitado en junio de 2026, con suspensión temporal por restricciones de exportación del gobierno de EE.UU. que se levantaron en julio, según documenta CNET. La versión 5.1 llega con el ecosistema en plena estabilización: Anthropic superó US$30.000M de revenue anualizado, frente a unos US$9.000M a finales de 2025, y según el mismo medio mira a una OPV antes de fin de año. Amazon ha invertido US$8.000M desde 2024 y añadió US$5.000M adicionales en 2026, con planes de hasta US$20.000M más. Google, Microsoft y Nvidia también son inversores.

En el plano operativo, conviene recordar que Claude tuvo varios incidentes de servicio en agosto de 2026 — incluyendo uno multi-modelo el 24 de agosto que afectó a Mythos 5, Fable 5, Opus 5 y Opus 4.8 durante unas 3,5 horas, según el historial de estado de Anthropic recogido por IBTimes. Para productos que dependen de agentes en producción, esto refuerza la recomendación de mantener un modelo de respaldo configurado y un plan de fallback manual.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...