Anthropic lanza Claude Sonnet 5.5, el segundo modelo de la familia 5.5
Claude Sonnet 5.5 ya está disponible: corre más de 30% más rápido que Sonnet 5 y, según Anthropic, cuesta hasta 30% menos por tarea —aunque la tarifa por millón de tokens no cambia. Es el segundo modelo de la familia 5.5, después de Claude Opus 5.5 (lanzado el 22 de septiembre, según TechCrunch), y precede a Claude Haiku 5.5, que llegará «en las próximas semanas» según la propia compañía.
El movimiento llega en la semana en que Anthropic presentaría públicamente su S-1 ante la SEC, según reportó Crypto Briefing, en medio de una guerra de precios con OpenAI que ya movió la aguja en OpenRouter.
¿Qué ofrece Sonnet 5.5 frente a Sonnet 5?
Anthropic diseñó Sonnet 5.5 como un complemento de menor costo y mayor velocidad para Opus 5.5, no como reemplazo. La propia compañía lo posiciona para «tareas cotidianas bien delimitadas»: arreglar bugs, producir documentos pulidos, generar slides y hojas de cálculo, y entender interfaces con buen criterio de diseño. Opus 5.5 sigue siendo, según Anthropic, el modelo para «trabajo complejo que requiere juicio sostenido».
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadLas cuatro palancas del salto generacional, según Anthropic:
- Rendimiento. 70,6% en Terminal-Bench 4.0, una evaluación de coding agentico, frente al 10,3% de Sonnet 5. Es la primera vez que un modelo Sonnet completa Pokémon Red usando solo capturas de pantalla, según la propia compañía.
- Costo. Mantiene la lista de precios de Sonnet 5 —2 USD por millón de tokens de entrada, 10 USD por millón de tokens de salida, 0,20 USD por millón de cache reads y 2,50 USD por millón de cache writes— pero completa las tareas con menos tokens. De ahí el recorte de hasta 30% por trabajo.
- Velocidad. Genera respuestas más de 30% más rápido que Sonnet 5. Anthropic lo describe como «el Sonnet más rápido hasta la fecha».
- Alineación y seguridad. Es el primer modelo Sonnet que se lanza con salvaguardas cibernéticas del nivel de Opus 5.5 y con clasificadores que bloquean ataques de destilación industrial.
¿Cuánto cuesta y cómo queda frente a la competencia?
La lista de precios de Sonnet 5.5 coincide con la de Sonnet 5:
| Precio por millón de tokens | Sonnet 5.5 | Opus 5.5 | GPT-6 Sol (según The Decoder) |
|---|---|---|---|
| Input | 2 USD | 4 USD | 2 USD |
| Output | 10 USD | 20 USD | 10 USD |
| Cache reads | 0,20 USD | 0,20 USD | 0,20 USD |
| Cache writes | 2,50 USD | 5 USD | 2,50 USD |
El costo efectivo es el verdadero dato: por tarea, Sonnet 5.5 puede costar alrededor de una quinceava parte que Sonnet 5 en el mismo ajuste de FrontierCode, según Anthropic. The Decoder comparó las listas: en input y output, Sonnet 5.5 iguala a GPT-6 Sol, y en cache writes también. La diferencia con OpenAI se mantiene en los modelos pequeños: GPT-6 Luna aparece listado en 0,10 USD input y 0,50 USD output según esa misma fuente, lo que deja a Haiku 5.5 con un trabajo claro por delante.
¿Cómo rinde frente a Opus 5.5 y GPT-6 Sol?
Sonnet 5.5 no reemplaza a Opus 5.5, pero se le acerca más que cualquier Sonnet anterior. En varias evaluaciones en esfuerzo bajo o medio, iguala o supera el mejor puntaje de Sonnet 5 a aproximadamente una décima parte del costo por tarea, según Anthropic.
Datos publicados por Anthropic (algunos bajo una salvedad de pre-lanzamiento):
- Terminal-Bench 4.0 (coding agentico): 70,6% (Sonnet 5: 10,3%; Opus 5.5: 66,4% en Xhigh).
- FrontierCode 1.1 (Main): 46,2% en Max y 52,1% en Xhigh (Sonnet 5: 42,4%; Opus 5.5: 54,4%; GPT-6 Sol: 49,3%). Anthropic aclara que en Max, Sonnet 5.5 corre más a menudo una sub-rutina de code review que en algunos casos excede el alcance de la tarea y le baja el puntaje.
- CursorBench 4.0: 55,5% (Sonnet 5: 34,1%; Opus 5.5: 57,8%) —a dos puntos del modelo mayor.
- GDPval-AA v2.1 (knowledge work sobre 44 ocupaciones y nueve industrias): 1844 (Sonnet 5: 1449; Opus 5.5: 1846; GPT-6 Sol: 1487). Dos puntos por debajo de Opus 5.5 y cerca de 400 por encima de Sonnet 5.
- AA-Briefcase v1.1: 1811 (Sonnet 5: 1359; Opus 5.5: 1822; GPT-6 Sol: 1483).
- Humanity’s Last Exam con herramientas: 64,5% (Sonnet 5: 54,9%; Opus 5.5: 67,7%).
- OSWorld 2.1 (computer use): 80,1% parcial (Sonnet 5: 57,0%; Opus 5.5: 81,8%).
- Chartography (reconocimiento visual de gráficos): 61,6% (Sonnet 5: 15,6%; Opus 5.5: 64,4%; GPT-6 Sol: 53,6%).
Anthropic aclara dos salvedades técnicas: los puntajes de GDPval-AA y AA-Briefcase fueron corridos por Artificial Analysis sobre un despliegue previo con un bug en structured outputs, ya corregido, lo que en todo caso subestimaría el rendimiento real. Y los puntajes de GPT-6 Sol podrían no reflejar una corrección reciente de OpenAI en image understanding, según una nota al pie de la propia compañía.
¿Qué dicen los primeros testers?
Varios clientes publicaron métricas concretas, recogidas por Unite.ai a partir de sus propios anuncios:
- Base44 (Gabriel Grinberg, head of engineering): en 118 builds reales, Sonnet 5.5 promedió 3,6 iteraciones por build frente a 7,7 con Opus 5, con la menor cantidad de tool calls fallidos de todos los modelos que Base44 comparó.
- Slack (Curtis Allen, principal engineer): cerca de 14% menos tokens de salida en evaluaciones offline de Slackbot, sin cambios de prompt.
- Zendesk (Abhinay Kathuria, director of AI): tickets procesados 20% más rápido que con los modelos Claude que usan en producción.
- Balyasny Asset Management: cerca de 121.000 tokens por respuesta frente a 497.000 con Sonnet 5, sobre 2.441 tareas financieras de una suite interna.
- Box: resultados 2,4 veces más rápidos con 12% menos tokens totales.
- Atlassian: sus clientes pueden correr Rovo Agents hasta 30% más rápido que con Sonnet 5.
- CodeRabbit (David Loker, VP of AI): mejor juicio a través de niveles de complejidad, con muchos menos tokens de salida; planean mover a Sonnet 5.5 las revisiones simples y moderadas.
¿Qué cambia para los desarrolladores que ya usan Sonnet 5?
Sonnet 5.5 está disponible desde el lanzamiento en Amazon Web Services, Google Cloud, Microsoft Azure y la Claude Platform, con el ID claude-sonnet-5-5 y con cero data retention por defecto. Anthropic publicó una guía de migración con cinco cambios que rompen compatibilidades:
- Adaptive thinking corre por defecto; el setting «thinking off» devuelve HTTP 400.
- Quienes corrían Sonnet 5 con thinking off deben migrar a la nueva opción
between_tools, la más baja disponible. - Forced tool choice se rechaza; Anthropic lo reemplaza por automatic tool choice + strict tools.
- El mínimo de prompt cacheable baja de 1.024 a 512 tokens.
- Aparece un esquema de cinco categorías de refusal stop reasons:
cyber,bio,frontierllm,reasoningextractionygeneralharms. El reintento server-side solo aplica acyberyfrontier_llm.
Sonnet 5.5 introduce cinco niveles de esfuerzo recalibrados —low, medium, high, xhigh y max— con Medium como default en Claude Code y las apps, y High en la Claude Platform y la API. Anthropic señala que, en low o medium, Sonnet 5.5 ya supera el mejor puntaje de Sonnet 5 en varios benchmarks a cerca de una décima parte del costo por tarea.
¿Por qué importa el timing?
Anthropic no está lanzando en el vacío. Crypto Briefing reportó que la compañía presentó un S-1 confidencial ante la SEC en junio de 2026 y que la presentación pública se anticipaba para fines de septiembre, con Goldman Sachs, Morgan Stanley y JPMorgan como underwriters. En mayo, según la misma fuente, Anthropic cerró una Serie H de 65.000 millones de USD a una valoración post-money de 965.000 millones.
El contexto competitivo también pesa. Blockonomi reportó que a fines de julio el run rate anualizado de Anthropic rondaba los 65.000 millones de USD, contra más de 40.000 millones de OpenAI. Pero el lanzamiento de GPT-6 Astra el 3 de septiembre habría devuelto a OpenAI al primer puesto de OpenRouter por primera vez en más de 30 meses, según métricas de la industria citadas en ese artículo. Los datos de Ramp colocan a OpenAI con cerca del 13% del gasto enterprise en IA rastreado, contra 8% de Anthropic, aunque la empresa de Dario Amodei mantiene 80% de su revenue en clientes enterprise y más de 1.000 clientes gastando al menos 1 millón de USD al año, según Crypto Briefing.
En coding, Sonnet 5.5 no compite solo contra Opus 5.5: CursorBench está construido sobre sesiones reales del editor Cursor, una pieza central del stack de programación asistida por IA. La mejora de 34,1% a 55,5% en una evaluación así importa más que un benchmark sintético: cambia la economía de tiempo del propio flujo de programación.
¿Qué significa esto para tu startup?
Para un founder con poco presupuesto, el dato clave no es el precio lista —es el costo por tarea. Si Sonnet 5.5 hace la misma unidad de trabajo con menos tokens y más rápido, una pyme puede correr el mismo volumen mensual por una fracción menor de la factura, o subir el volumen sin subir el costo. Cuatro movimientos concretos:
- Re-evalúa tu proveedor de coding agentico. Si hoy pagas Sonnet 5 o GPT-6 Sol, pide una corrida paralela de Sonnet 5.5 sobre las mismas tareas de tu backlog. Base44 vio 3,6 iteraciones por build con Sonnet 5.5 frente a 7,7 con Opus 5; ese tipo de delta cambia cuánto tarda un PR en mergear.
- Usa los niveles de esfuerzo como knob de margen. No mandes Sonnet 5.5 a Max para una refactor simple. Empieza en Low o Medium, sube solo cuando la tarea lo justifique. Anthropic dice que en low o medium ya supera el mejor resultado de Sonnet 5 en varios benchmarks a una décima parte del costo por tarea.
- Audita las nuevas categorías de refusal. Si tu producto toca cybersecurity o biología, las cinco nuevas categorías de stop reason —
cyber,bio,frontierllm,reasoningextraction,generalharms— pueden bloquear flujos que antes pasaban. Si trabajas en esos verticales, aplica al Cyber Verification Program o al Life Sciences Verification Program. - Revisa el cambio de cache. El mínimo de prompt cacheable baja de 1.024 a 512 tokens: si tu sistema de cache depende de prompts largos, podrías ahorrar más de lo previsto; si dependía de prompts cortos, ahora también cachean.
Conclusión
Claude Sonnet 5.5 es, sobre todo, una jugada de pricing: misma lista de precios que Sonnet 5, mismo techo de capacidad que Opus 5.5 en varias pruebas, y un recorte de costo por tarea que se siente en producción. Anthropic eligió competir con OpenAI donde el competidor es más débil —costo efectivo y coding agentico— sin canibalizar su propio Opus 5.5. Para una startup que mira la factura de OpenAI o Anthropic cada mes, la pregunta práctica es directa: ¿cuánto de tu tráfico actual puede correr en Sonnet 5.5 a esfuerzo bajo o medio sin perder calidad?
Fuentes
- Introducing Claude Sonnet 5.5 (fuente original)
- Anthropic Releases Claude Sonnet 5.5 at Unchanged Sonnet 5 Pricing
- Anthropic’s Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task
- Anthropic releases Opus 5.5 with lower prices and Fable-level performance
- Anthropic vs OpenAI: The Battle for AI Dominance Heats Up Before Public Market Debut
- Potential Anthropic IPO investors seek detailed revenue metrics ahead of blockbuster listing
- Anthropic IPO valuation hinges on $190B-$200B 2028 revenue forecast: sources
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













