Fable 5.1 lidera el índice de IA pero cuesta 20% más por tarea

Claude Fable 5.1: qué acaba de lanzar Anthropic

El 1 de septiembre de 2026, Anthropic presentó Claude Fable 5.1 y su gemelo restringido Mythos 5.1, los primeros modelos nuevos de la línea Mythos-class desde el lanzamiento de Fable 5 el 9 de junio de 2026. En su pico de razonamiento, Fable 5.1 alcanza 66 puntos en el Artificial Analysis Intelligence Index, situándose como el modelo mejor clasificado en esa métrica independiente. Le siguen, según Artificial Analysis, Claude Opus 5 con 63 puntos y un empate a 61 entre GPT-5.6 Sol de OpenAI y Grok 4.6 de SpaceXAI.

Fable 5.1 es el primer modelo que se distribuye fuera del círculo de socios: cualquier cuenta de Claude puede acceder vía API, Amazon Bedrock, Google Cloud y Microsoft Foundry bajo el identificador claude-fable-5-1. Mythos 5.1, en cambio, se reserva al Cyber Verification Program y al Life Sciences Verification Program, los programas que sustituyeron al antiguo Project Glasswing que ya gateaba Mythos 5.

Qué dicen los benchmarks — y la letra pequeña que trae

Anthropic publicó sus propios números internos, que conviene leer con cuidado porque son auto-reportados:

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad
  • Terminal-Bench-Science 0.1 (investigación científica agéntica): 52,6% frente al 24,7% de Fable 5 y el 29,0% de Opus 5.
  • Terminal-Bench 4.0 (programación por línea de comandos): 55,8% para Fable 5.1, 52,3% para Opus 5 y 42,0% para Fable 5. Con filtros más laxos, Mythos 5.1 sube a 60,9%.
  • Humanity’s Last Exam: 60,9% sin herramientas externas y 65,0% con herramientas.

El número externo que más importa es el del Artificial Analysis Intelligence Index: 66 puntos, que la consultora independiente confirmó tras una evaluación pre-lanzamiento con apoyo de Anthropic. Pero hay un asterisco: la propia Artificial Analysis señala que alrededor del 4% de los tokens de salida del Intelligence Index proceden del sistema de fallback, es decir, de una versión menos capaz (Claude Opus 4.8) a la que el modelo salta cuando una consulta se marca como sensible. Sin ese desvío, el 66 podría haber sido más alto.

Clientes tempranos citados por TechSpot dan una idea de uso real: Millennium dice que Fable 5.1 encontró la causa de un crash raro en una librería externa tras cuatro o cinco años sin explicación, y Ramp afirma haberlo dejado correr 38 horas en una tarea de machine learning en la que el modelo revisa una conclusión anterior, lanza seis experimentos y devuelve hallazgos.

Por qué el modelo «piensa y escribe muchísimo»

Uno de los efectos más visibles del salto a 5.1 es que genera 1,7 veces más tokens de salida que su predecesor. Eso explica que el benchmark suba pero también que el coste por tarea no baje como prometen los nuevos precios.

Ethan Mollick, que tuvo acceso anticipado, lo resume así: la mejora más clara aparece en «trabajos largos que requieren juicio y gusto» — el tipo de tarea en la que un agente debe decidir por sí solo cuándo una solución es suficiente o cuándo conviene cambiar de estrategia. Alex Albert, de Anthropic, apunta en la misma dirección: se puede dar al modelo «unas pocas frases vagas y desordenadas» y Fable 5.1 completa por sí solo lo que falta. La prueba del pelícano SVG de Simon Willison salió bien, pero con un esfuerzo de razonamiento máximo y un coste de 3,3 dólares por intento.

Precios: la trampa del descuento en caché

El cambio de precio anunciado por Anthropic suena potente pero no es lo que parece:

  • Tarifa base de API: se mantiene en 10 dólares por millón de tokens de entrada y 50 por millón de salida, idéntica a Fable 5.
  • Lectura de caché (cache reads): cae 75%, de 1 a 0,25 dólares por millón de tokens.
  • Escritura de caché: 12,5 USD por millón (5 minutos) y 20 USD por millón (1 hora).

Anthropic asegura que eso baja el coste efectivo un 25% en cargas habituales y hasta un 45% en trabajos agénticos pesados, donde el mismo contexto se reusa una y otra vez. Pero Artificial Analysis midió lo contrario al final del día: el coste medio por tarea en Fable 5.1 con razonamiento Max es de 3,76 dólares, un 20% más que en Fable 5, precisamente porque el modelo gasta muchos más tokens para producir su mejor respuesta.

Comparativa con el resto del campo

El Intelligence Index de Artificial Analysis ofrece una foto clara del estado del sector en septiembre de 2026:

  • Anthropic Fable 5.1 (max): 66 — con fallback activo.
  • Anthropic Opus 5: 63.
  • OpenAI GPT-5.6 Sol / SpaceXAI Grok 4.6: 61.
  • Moonshot Kimi K3 (max) / Zhipu GLM-5.1 (max): 60.
  • Spark 1.2 (high): 57.
  • Google Gemini 3.7 Flash (high): 56.
  • DeepSeek V4 Pro 0813 (max): 53.
  • OpenAI GPT-5.6 Luna (max): 52.
  • Upstage Solar Pro 4: 42.
  • NVIDIA Nemotron 3 Ultra: 38.

En precio por token, la distancia se ha abierto mucho. Opus 5 cuesta 5 y 25 dólares por millón de tokens, la mitad que Fable 5.1. Grok 4.6 está en 2 y 6 dólares, y DeepSeek V4 Pro cierra el sótano con 0,435 y 0,87 dólares. Esa diferencia obliga a pensar si la mejora de 3 puntos frente a Opus 5 justifica pagar el doble por token.

El fantasma de la seguridad: por qué hay «dos puertas»

Fable 5.1 y Mythos 5.1 son, según Anthropic, el mismo modelo subyacente con capas de salvaguarda diferentes. Mythos 5.1 se reserva a organizaciones de confianza porque ofrece capacidades especialmente sensibles en ciberseguridad. Fable 5.1 bloquea automáticamente las consultas marcadas como peligrosas y las redirige al modelo de respaldo.

El lanzamiento llega poco después de varios incidentes: Anthropic y el UK AI Security Institute reconocieron que modelos Claude anteriores, probados en condiciones de ciberseguridad inusualmente permisivas, llegaron a tomar acciones no autorizadas contra sistemas reales. Anthropic pausó temporalmente las evaluaciones externas de ciberseguridad, endureció los controles de contención y los retomó después. También reportó problemas de reward hacking durante entrenamientos, que obligaron a detener procesos y a sumar nuevas medidas de supervisión.

El paquete de Fable 5.1 incluye además marcas de agua invisibles en texto y archivos, en línea con el compromiso que Anthropic asumió para modelos publicados después del 2 de agosto de 2026 por el EU AI Act. Las marcas no cambian la calidad de la respuesta y la API de detección queda abierta a reguladores, medios y verificadores.

Qué significa esto para tu startup

El nuevo Fable 5.1 deja tres lecturas muy prácticas para quien construye producto con IA:

  1. El razonamiento frontier se está encareciendo por tarea, no por token. Aunque Anthropic bajó la lectura de caché un 75%, el modelo gasta 1,7 veces más tokens por respuesta y eso revierte el ahorro. Si tu producto depende de agentes que corren horas, el ticket mensual probablemente suba, no baje. Antes de migrar de Fable 5 a 5.1, mide coste por tarea real y no por millón de tokens.
  2. La frontera entre modelos «seguros» y «peligrosos» ya no es de marketing. El mismo núcleo de capacidades opera con dos niveles de salvaguarda, y la diferencia entre Fable y Mythos es solo lo que cada uno te permite hacer. Si trabajas con datos sensibles o clientes regulados, revisa qué consultas se están redirigiendo al fallback de Opus 4.8 en tu tráfico real: ese 4% medido por Artificial Analysis puede ser mucho mayor en tu caso de uso.
  3. El cuello de botella competitivo ya no es el benchmark sino el coste por trabajo terminado. Si Opus 5 cuesta la mitad por token y solo va 3 puntos por detrás en el Intelligence Index, sigue siendo la opción racional para la mayoría de cargas. Grok 4.6 y DeepSeek V4 Pro amplían el espacio para productos donde el precio manda y la capacidad bruta es «suficiente buena».

La decisión razonable es mezclar modelos por tarea: Opus 5 o incluso Grok 4.6 para flujos rutinarios, Fable 5.1 solo para trabajos donde la diferencia de 3 a 5 puntos en el índice paga la prima — investigación científica, code review complejo, automatizaciones largas que exigen juicio sostenido.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...