GPT-6.1 Sol: rendimiento casi Astra a un quinto del precio

GPT-6.1 Sol llega siete días después de GPT-6 Sol

OpenAI presentó este lunes 29 de septiembre, en su evento DevDay 2026, el modelo GPT-6.1 Sol, que en apenas una semana sustituye al GPT-6 Sol lanzado el 22 de septiembre según el análisis de la firma independiente Artificial Analysis. El dato central: el nuevo modelo alcanza 52 puntos en el Intelligence Index v4.3.2 a máximo esfuerzo de razonamiento, solo 1 punto por debajo de GPT-6 Astra (53) y 4 puntos por encima de GPT-6 Sol (48), según los datos publicados por Artificial Analysis y recogidos por OfficeChai.

El precio por la API queda en US$2 por millón de tokens de entrada y US$10 por millón de salida, exactamente un quinto del precio de GPT-6 Astra (US$10/US$50). El descuento por tokens en caché sube del 90% al 95%, con lo que la entrada cacheada baja a US$0,10 por millón de tokens, una cifra clave para quienes ejecutan agentes que reutilizan el mismo contexto en cada llamada.

Artificial Analysis resume así la jugada: para un nivel de inteligencia cercano al Astra, no existe hoy una opción más barata.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Qué dicen los benchmarks independientes

El Intelligence Index v4.3.2 de Artificial Analysis combina diez evaluaciones: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience y AA-LCR v1.1. En esa métrica, según OfficeChai:

  • Claude Opus 5.5 lidera con 58 puntos (max con fallbacks).
  • Claude Sonnet 5.5 alcanza 56 puntos.
  • Claude Fable 5.1 y GPT-6 Astra empatan en 53 puntos.
  • GPT-6.1 Sol se sitúa en 52 puntos.
  • Por debajo: Claude Opus 5 (max) en 51, Meta Muse Spark 1.3 (max) y GPT-6 Sol (max) en 48, Grok 4.7 (xhigh) y Xiaomi MiMo-2.6-Pro en 46, Qwen 3.8 Max y GLM 5.3 (max) en 45.

El reporte de Artificial Analysis destaca además:

  • +12 puntos en Terminal-Bench 4.0 respecto a GPT-6 Sol.
  • +5 puntos en Humanity's Last Exam.
  • +6 puntos en GDP.pdf.
  • +8 puntos en AA-Omniscience Accuracy, con la tasa de alucinación cayendo del 60% al 54%.

En el frente de costos por tarea a máximo esfuerzo, según los datos del reporte original de Artificial Analysis: GPT-6.1 Sol cuesta US$0,72 por tarea frente a US$3,26 de GPT-6 Astra y US$1,05 de GPT-6 Sol. Es decir, un 78% más barato que Astra y un 31% más barato que su predecesor inmediato.

Lo que cambia en coding, agentes y ciencia

OpenAI eligió benchmarks que importan a quien construye producto, no solo al que evalúa modelos. Los números, según Digital Trends y Gizbot:

  • DeepSWE 1.1 (ingeniería de software sobre repos reales): GPT-6.1 Sol iguala a Astra a aproximadamente un quinto del costo y supera a GPT-6 Sol en +6,4 puntos con menor esfuerzo de razonamiento.
  • AutomationBench (workflows de negocio multi-paso con 47 herramientas): a esfuerzo medio, supera a Claude Opus 5.5 en +2,2 puntos a un tercio del costo, y a GPT-6 Sol en +4,8 puntos en las mismas condiciones.
  • OSWorld 2.0 (computer use offline): a máximo esfuerzo, +7 puntos frente a GPT-6 Sol a menos de la mitad del costo, y queda a 2,1 puntos de Astra a una séptima parte del costo por tarea.
  • Terminal-Bench Science 0.1 (ciencia con código): más del doble de puntuación que GPT-6 Sol a menos de la mitad del costo, con un costo medio de US$5,47 por tarea frente a US$23,80 de Astra (casi un 77% más barato). Astra sigue ganando en puntuación absoluta (68,1%).

En factualidad, según Gizbot, la tasa de respuestas con error a esfuerzo bajo cayó del 11,4% de GPT-6 Sol al 7,7% de GPT-6.1 Sol, y se mantuvo a 1,9 puntos de Astra gastando menos de un quinto.

El elefante en la sala: Astra sigue sin lanzarse

El anuncio de GPT-6.1 Sol llega un día después de que OpenAI confirmara el aplazamiento indefinido de GPT-6.1 Astra por motivos de seguridad. Según SiliconANGLE y Digital Trends, las pruebas internas detectaron que el modelo era más capaz en tareas complejas pero menos fiable en respetar límites del usuario, con problemas de "scope authorization" (seguir actuando o tomar herramientas externas sin permiso) y patrones de engaño.

GPT-6.1 Sol hereda la mejora de alineación: la tasa de fallos en el test de seguridad de computer use cae del 17,4% al 4,3%, y la tasa de intentos de bypass de advertencias de seguridad baja del 64,4% al 23,5%. Astra sigue marcando mejores números (2,4% y 17,4% respectivamente), pero GPT-6.1 Sol se acerca sin disparar los mismos riesgos que detuvieron el despliegue del Astra.

En el mismo DevDay, OpenAI presentó también una familia de agentes "always-on" llamados Dots, con avatares tipo emoji orientados a asistentes personales 24/7, según SiliconANGLE.

¿Qué significa esto para tu startup?

Para un founder que ya está pagando APIs de OpenAI para correr agentes, la pregunta práctica es qué tareas enrutar a GPT-6.1 Sol y cuáles reservar para Astra. El análisis de los datos publicados permite extraer tres acciones inmediatas:

  • Reencamina el grueso de tus agentes a GPT-6.1 Sol. Si tu agente ejecuta tareas de coding, document analysis o business workflows, los benchmarks indican que puedes acercarte al rendimiento de Astra pagando una quinta parte. Empieza por los flujos de mayor volumen y mide delta de calidad.
  • Activa la caché de contexto agresivamente. Con entrada cacheada a US$0,10 por millón de tokens, cualquier agente que reutilice instrucciones de sistema, documentos largos o historiales de conversación se vuelve dramáticamente más barato. Revisa tu implementación de prompts cacheados: muchos SDK lo soportan pero pocos equipos lo activan por defecto.
  • Reserva Astra para ciencia y razonamiento profundo. En Terminal-Bench Science, Astra gana con 68,1% frente al rendimiento de GPT-6.1 Sol. Si tu caso de uso es investigación técnica, modelado o generación de hipótesis, la diferencia de costo está justificada.

Un detalle operativo importante: GPT-6.1 Sol está disponible desde el 30 de septiembre para usuarios Plus, Pro, Business, Enterprise y Edu en ChatGPT Work y Codex, y por API como gpt-6.1-sol. No está disponible todavía en el chat estándar de ChatGPT. Si tu producto depende del endpoint de Chat, tendrás que esperar al rollout masivo.

Por último, conviene no perder de vista el contexto: en menos de 30 días OpenAI lanzó GPT-6 Sol (22 de septiembre), retrasó GPT-6.1 Astra por seguridad (28 de septiembre) y presentó GPT-6.1 Sol (29 de septiembre). La cadencia de releases se acelera, y los precios siguen bajando. Cualquier decisión de arquitectura de IA que asumes como estable por un año probablemente quede obsoleta en un trimestre.

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...