Anthropic lanza Claude Sonnet 5.5: 30% más rápido

Anthropic lanza Claude Sonnet 5.5: el mid-tier que ya compite con su propio flagship

Anthropic presentó este lunes Claude Sonnet 5.5, el segundo modelo de la familia Claude 5.5, seis días después del lanzamiento de Opus 5.5. La promesa de la compañía, recogida por Simon Willison: corre más de un 30% más rápido que Sonnet 5 y cuesta hasta un 30% menos por tarea, al mismo precio por token ($2 de entrada y $10 de salida por millón). El detalle incómodo: en varios benchmarks de programación agentic, Sonnet 5.5 supera a Opus 5.5, que es el modelo más caro de la casa. Para un founder construyendo con LLMs, eso reconfigura la decisión de qué modelo pagar.

Qué cambia frente a Sonnet 5

El precio por token no se mueve: $2 por millón de tokens de entrada y $10 por millón de salida, con cache reads a $0.20 y cache writes a $2.50, según el anuncio de Anthropic reportado por Unite.AI. Pero la compañía asegura que Sonnet 5.5 completa el mismo trabajo con menos tokens y a mayor velocidad, lo que cierra el círculo del "hasta 30% menos por tarea". En la práctica, Sonnet 5.5 queda a la mitad del precio de Opus 5.5, que sigue en $4 de entrada y $20 de salida.

Anthropic también recalibró los cinco niveles de esfuerzo (low, medium, high, xhigh, max) y ahora Medium es el default en Claude Code y en las apps de Claude, mientras que la API arranca en High. Para founders con pipelines que asumían Sonnet 5 como costo base, esto significa que el costo marginal por feature de IA puede caer sin renegociar contratos.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Cómo queda la familia Claude 5.5

Sonnet 5.5 es el segundo eslabón de la familia 5.5, después de Opus 5.5 (lanzado el 22 de septiembre) y antes de Haiku 5.5, que Anthropic confirmó para "las próximas semanas". El propio Simon Willison lo dejó por escrito en su blog: espera que Haiku 5.5 sea competitivo en precio con GPT-6 Luna. Mientras tanto, la apuesta de Anthropic es clara: Sonnet 5.5 es el nuevo modelo del plan gratuito de claude.ai, un movimiento que deja al free tier de ChatGPT —que sigue con Luna 5.6, según Willison— una capa por debajo en capacidad bruta.

Benchmarks clave: dónde gana y dónde pierde

Los números que Anthropic puso sobre la mesa, replicados por Mashable, Decrypt y Unite.AI, dibujan un mapa claro:

  • Terminal-Bench 4.0 (tareas agentic de coding): Sonnet 5.5 marca 70.6%, frente a 66.4% de Opus 5.5 y apenas 10.3% de Sonnet 5. El tester independiente Artificial Analysis midió 63.6% para Sonnet 5.5 contra 59.6% de Opus 5.5 y 59.1% de GPT-6 Astra.
  • FrontierCode v1.1 (Main): Sonnet 5.5 alcanza 52.1% en esfuerzo Xhigh (46.2% en Max), frente a 54.4% de Opus 5.5 y 49.3% de GPT-6 Sol.
  • GDPval-AA v2.1 (trabajo real en 44 ocupaciones): 1.844 Elo para Sonnet 5.5 frente a 1.846 de Opus 5.5 y 1.449 de Sonnet 5.
  • CursorBench 4.0: 55.5% para Sonnet 5.5 frente a 57.8% de Opus 5.5 y 34.1% de Sonnet 5.

Lectura para founders: en coding agentic, Sonnet 5.5 está al nivel del flagship anterior o lo supera. En trabajo de conocimiento sostenido (reportes, análisis complejos), Opus 5.5 todavía manda, según reconoce la propia Anthropic.

Lo que reportan los early testers

Anthropic publicó resultados de equipos que ya probaron Sonnet 5.5 en producción, según recoge Unite.AI:

  • Base44 (118 builds reales de apps): Sonnet 5.5 promedió 3.6 iteraciones por build contra 7.7 de Opus 5, con la menor cantidad de tool calls fallidos entre los modelos que Base44 comparó.
  • Slack: 14% menos tokens de salida en evaluaciones offline de Slackbot, sin cambiar el prompt.
  • Zendesk: tickets procesados 20% más rápido que con los modelos Claude que corren en producción.
  • Balyasny Asset Management: 121.000 tokens por respuesta frente a 497.000 de Sonnet 5, sobre una suite privada de 2.441 tareas financieras.
  • Box: 2.4x más rápido con 12% menos tokens totales.
  • Atlassian: Rovo Agents corren hasta 30% más rápido que con Sonnet 5.

CodeRabbit, según su VP de AI David Loker, ya está moviendo revisiones de código simples y moderadas a Sonnet 5.5, con planes de ampliar a más casos en las próximas semanas.

El matiz que Anthropic no destaca

Hay un asterisco importante. Artificial Analysis detectó que Sonnet 5.5, a esfuerzo max, escribe alrededor de 193.000 tokens por tarea —el número más alto entre los modelos que la firma testeó y cerca de un 60% más que Opus 5.5. Eso lleva el costo por tarea a unos $7.60, alrededor de un 50% por encima de Sonnet 5, lo que contradice la promesa de "hasta 30% de ahorro" si se le pide al modelo pensar al máximo. El ahorro real aparece en configuraciones medias: en Medium, Anthropic dice que Sonnet 5.5 iguala el mejor puntaje de coding de Sonnet 5 por menos de la décima parte del costo. Decrypt lo resume bien: rendimiento casi flagship a fracción del precio, siempre que el dial se quede bajo.

Seguridad, migración y free tier

Sonnet 5.5 es el primer modelo de la línea Sonnet que llega con salvaguardas comparables a las de Opus en ciberseguridad y biología, más clasificadores anti-distilación para bloquear intentos de extraer el modelo vía cuentas masivas. En ciberseguridad, las solicitudes de alto riesgo caen a Sonnet 5 como fallback; el trabajo rutinario de bugfixing no se ve afectado.

Para developers que migran desde Sonnet 5, Anthropic publicó una guía con breaking changes: adaptive thinking corre por defecto, el setting "thinking off" devuelve error 400, los usuarios que corrían sin thinking deben migrar al nuevo parámetro between_tools, y la elección forzada de herramientas se reemplaza por elección automática con strict tools. El mínimo prompt cacheable baja de 1.024 a 512 tokens.

Y un movimiento estratégico: Sonnet 5.5 es ahora el modelo del free tier en claude.ai. Quien aún no probó Claude puede testearlo sin pagar; Simon Willison le pidió desde ese tier una página HTML con un pelícano 3D en WebGL y obtuvo una página funcional.

Qué significa esto para tu startup

  • Recalibra tu mix de modelos. Si hoy resuelves coding agentic con Opus 5.5 por defecto, vale la pena correr un A/B contra Sonnet 5.5 en tareas bien acotadas. Anthropic y Base44 reportan la misma calidad o mejor con la mitad de precio por token y menos tokens por tarea; el ahorro puede ser de 40-50% por workflow.
  • Mueve el dial de esfuerzo con cabeza. El ahorro real está en Medium o High. Si subes a Xhigh o Max esperando mejor calidad, Sonnet 5.5 puede terminar costando más por tarea que Sonnet 5. Define en qué casos vale la pena (debugging complejo, planificación) y en cuáles no (clasificaciones, resúmenes, generación de boilerplate).
  • Prepara la migración antes de que llegue Haiku 5.5. Anthropic confirmó que Haiku 5.5 sale en las próximas semanas. Si tu arquitectura está atada a Sonnet 5, migrar a Sonnet 5.5 con adaptive thinking y between_tools te deja listo para encadenar Haiku 5.5 sin reescribir integraciones.

Conclusión

Sonnet 5.5 es la señal más clara hasta ahora de que la frontera de capacidad en LLMs dejó de ser una pirámide estricta: el modelo medio de Anthropic ya compite de tú a tú con el flagship de la semana pasada, a mitad de precio. Para founders, eso no es solo una buena noticia de costos; es una invitación a repensar qué casos de uso justifican pagar Opus y cuáles se resuelven igual de bien en el siguiente escalón. La pregunta interesante deja de ser "qué modelo es mejor" y pasa a ser "qué esfuerzo de razonamiento necesita cada tarea concreta que tengo en producción".

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...