Sonnet 5.5: misma API, menor costo por tarea completa
Anthropic presentó Claude Sonnet 5.5 este lunes 28 de septiembre de 2026 como el modelo intermedio de su nueva familia 5.5. La gran sorpresa no está en su precio por token, que se mantiene igual que su antecesor: US$2 por millón de tokens de entrada y US$10 por millón de salida, con lecturas de caché a US$0,20 y escrituras de caché a US$2,50 por millón. La diferencia está en otra métrica: el costo total por tarea completada.
Según la compañía, Sonnet 5.5 genera respuestas más de un 30% más rápido que Sonnet 5 y reduce el costo total de una tarea hasta un 30%. El ahorro no viene de una bajada en la tarifa API, sino de que el modelo necesita menos tokens y menos llamadas a herramientas (tool calls) para llegar al mismo resultado, según reportó VentureBeat.
En otras palabras, Anthropic deja de competir solo por precio de catálogo y empieza a vender costo por trabajo terminado, una variable mucho más cercana al cálculo real de cualquier startup que opera agentes.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadBenchmarks: Sonnet 5.5 casi alcanza a Opus 5.5
El movimiento estratégico se entiende al mirar los números. Anthropic publicó evaluaciones internas donde Sonnet 5.5 se acerca mucho a Opus 5.5, su modelo premium presentado el 22 de septiembre.
- GDPval-AA (rendimiento en tareas reales de 44 ocupaciones): Sonnet 5.5 logra 1844, frente a 1846 de Opus 5.5 y 1449 de Sonnet 5.
- AA-Briefcase: 1811 de Sonnet 5.5 contra 1822 de Opus 5.5.
- OSWorld 2.1 (uso parcial de computadora): Sonnet 5.5 alcanza 80,1%, Opus 5.5 logra 81,8% y Sonnet 5 apenas 57%.
- Chartography (reconocimiento visual de gráficos): 61,6% de Sonnet 5.5, 64,4% de Opus 5.5 y solo 15,6% de Sonnet 5.
La brecha se amplía en benchmarks de programación. En Terminal-Bench 4.0, Sonnet 5.5 marca 70,6%, frente a 10,3% de Sonnet 5 y 66,4% de Opus 5.5. En CursorBench 4.0, Sonnet 5.5 obtiene 55,5%, apenas detrás del 57,8% de Opus 5.5.
Anthropic también difundió un dato económico relevante: en varias evaluaciones, Sonnet 5.5 en esfuerzo bajo o medio supera la mejor marca de Sonnet 5 gastando aproximadamente una décima parte por tarea. En FrontierCode, Sonnet 5.5 en esfuerzo alto supera a Sonnet 5 en el mismo esfuerzo por unos 10 puntos, con un costo por tarea cercano a una quinceava parte.
Anthropic describe Opus 5.5 como el modelo preferido para trabajo ambiguo o abierto que requiere juicio sostenido; Sonnet 5.5 se posiciona para trabajo cotidiano bien definido: depuración de software, coding, documentos, hojas de cálculo y diseño de interfaces. Por defecto, Claude Code y las apps de consumo usarán esfuerzo medio; la API de Claude Platform usará alto.
Lo que reportan los clientes en producción
Anthropic compartió a VentureBeat pruebas tempranas de clientes que aterrizan las promesas en métricas concretas.
Box, según su VP de Productos de IA Yashodha Bhavnani, vio que Sonnet 5.5 revisaba mejor los documentos fuente y detectaba errores que su antecesor no atrapaba: fue 2,4 veces más rápido y usó 12% menos tokens totales.
Zendesk, en cientos de casos de soporte probados, reportó respuestas 20% más rápidas y menos decisiones incorrectas que con los modelos Claude actualmente en producción, según Abhinay Kathuria, director de IA.
Slack, con su principal engineer Curtis Allen, observó mejoras en casi todas sus evaluaciones offline de Slackbot sin necesidad de cambiar prompts, con menos pasos y aproximadamente 14% menos tokens de salida.
El caso más elocuente para founders que construyen agentes de código es el de Lovable. Su cofundador y CTO Fabian Hedin afirmó que Sonnet 5.5 necesitó cerca de un tercio menos de tool calls y aproximadamente la mitad de ejecuciones de shell para completar trabajos de programación.
Base44, finalmente, probó 118 builds reales de aplicaciones: Sonnet 5.5 alcanzó resultados comparables a Opus 5 con un promedio de 3,6 iteraciones por build, frente a las 7,7 de Opus 5, además de producir la menor cantidad de tool calls fallidas entre los modelos que compararon.
El patrón es claro: cuando los agentes fallan menos, los retries, la latencia y el coste de infraestructura caen en cadena. El precio por token es solo una parte de la factura.
El nuevo mapa de precios de la IA frontier
Sonnet 5.5 llega en un momento de competencia feroz en la franja de modelos de gama media-alta, como recoge VentureBeat y confirma el análisis de mercado de mdtechknowledge (note.com).
- GPT-6 Sol (OpenAI, lanzado el 22 de septiembre): mismo precio API que Sonnet 5.5, US$2 entrada / US$10 salida, US$0,20 lectura de caché y US$2,50 escritura. Contexto de 1,05 millones de tokens. Su tarifa estándar se aplica hasta los 272.000 tokens de entrada; por encima de ese umbral, todo el request se cobra a US$4/US$15 con caché más cara.
- Gemini 3.8 Flash (Google): precio introductorio de US$0,75 entrada / US$3,75 salida hasta el 31 de diciembre de 2026; después sube a US$1,50/US$7,50 desde el 1 de enero de 2027, según la documentación oficial citada por VentureBeat.
- MiMo-V2.6-Pro y Flash (Xiaomi): modelos de peso abierto bajo licencia MIT. MiMo-V2.6-Pro cuesta US$0,435/US$0,87 por millón de tokens vía API; la versión Flash baja a US$0,14/US$0,28. El detalle clave: cualquiera puede descargar los pesos y personalizarlos sin pagar a Xiaomi.
En la franja alta, Claude Opus 5.5 se mantiene en US$4/US$20 por millón, US$0,20 lectura y US$5 escritura de caché. Es 20% más barato que Opus 5 en tokens y, según Mashable, cerca de 40% más económico de operar en cargas típicas. Anthropic bajó los precios de Opus 5 en lugar de subir a la tarifa prevista, según recordó VentureBeat: Sonnet 5 se introdujo en junio como precio introductorio y se hizo permanente en agosto en US$2/US$10, no en los US$3/US$15 planeados.
El cuadro completo, según mdtechknowledge, muestra hasta 125 veces de diferencia en costo de salida por millón de tokens entre los modelos top (Fable 5.1 y GPT-6 Astra, ambos a US$50) y los más livianos (GPT-6 Luna a US$0,50). La economía del token dejó de ser un detalle técnico para volverse una decisión de arquitectura.
Qué cambia en seguridad y despliegue
Sonnet 5.5 es el primer modelo Sonnet que Anthropic lanza con salvaguardas de ciberseguridad al nivel de sus sistemas más capaces, según VentureBeat. El desarrollo rutinario de software y la remediación de vulnerabilidades seguirán funcionando; las solicitudes de mayor riesgo se redirigirán automáticamente a Sonnet 5. Anthropic anunció que ampliará su Cyber Verification Program para que defensores aprobados accedan a capacidades avanzadas en Sonnet 5.5, Opus 5.5 y los modelos Mythos.
La compañía también introduce protecciones contra ataques de destilación de modelos: clasificadores diseñados para bloquear la extracción del razonamiento, y un sistema ampliado de preserved thinking que vincula los bloques de razonamiento a la cuenta que los creó.
El modelo está disponible desde el día de lanzamiento en Amazon Web Services, Google Cloud y Microsoft Azure, con soporte de zero-data-retention. El identificador en la API es claude-sonnet-5-5. Claude Haiku 5.5, enfocado en cargas de alto volumen y sensibles al costo, llegará en las próximas semanas, confirmó Anthropic.
¿Qué significa esto para tu startup?
Si hoy usas Sonnet 5 o modelos equivalentes para correr agentes, el cambio central no es de precio API sino de costo total por flujo terminado. La migración a Sonnet 5.5 se justifica sola si reduces retries y tool calls fallidos, como muestran los datos de Lovable y Base44.
Acciones concretas que puedes tomar esta semana:
- Audita cuántas tool calls falla tu agente en producción. Si superas el 20% de intentos, la nueva eficiencia de Sonnet 5.5 debería traducirse en ahorros visibles aunque la tarifa API no cambie.
- Rutea por nivel de esfuerzo, no por modelo. Anthropic ofrece cinco niveles (low a max). Tareas repetitivas bien definidas corren bien en low/medium; reserva high/xhigh para planificación, verificación final y casos ambiguos.
- Vuelve a cotizar tu arquitectura multi-modelo. Con Sonnet 5.5 cerca de Opus 5.5 en GDPval-AA (1844 vs 1846) y Terminal-Bench 4.0 (70,6% vs 66,4%), una parte de tu carga que hoy va al modelo premium puede bajar de tier sin pérdida perceptible.
- Revisa los prompts cacheables. Con lecturas de caché a US$0,20 por millón en Anthropic, OpenAI y Google, los prefijos repetidos en agentes de soporte y código son la palanca más rápida para bajar factura.
El verdadero cambio de 2026 no es que baje el precio del token, es que el costo por tarea útil se vuelve la métrica que define qué modelo contratar. Para una startup que opera agentes en producción, esa variable manda sobre cualquier tabla de precios.
Fuentes
- Anthropic launches Claude Sonnet 5.5 with 30% cost reduction per task
- Anthropic launches Claude Opus 5.5, promising Fable-level performance at a lower price – Mashable
- Anthropic Launches Claude Opus 5.5 With Lower Prices and Faster Output – TechRepublic
- GPT-6 Sol vs Claude Opus 5.5: Coding, Pricing, and AI Agents – TechRepublic
- OpenAI Releases GPT-6 Sol and Luna: 50% Cheaper API Pricing – MarkTechPost
- The Unstoppable Price Collapse of AI Token Rates – note.com
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













