GPT-6.1 Sol: casi toda la inteligencia de Astra a la quinta parte del precio por token
OpenAI presentó el 29 de septiembre de 2026, en su DevDay anual, GPT-6.1 Sol, una versión mejorada de GPT-6 Sol que, según la compañía, se acerca al rendimiento de su modelo estrella GPT-6 Astra en programación agéntica, uso del computador y trabajo profesional, cobrando una quinta parte por token de entrada y salida estándar. El precio se mantiene en US$2 por millón de tokens de entrada y US$10 por millón de tokens de salida, igual que su predecesor GPT-6 Sol, pero el precio del input en caché cae 50%, de US$0,20 a US$0,10 por millón de tokens (VentureBeat, OpenAI).
Para founders que ya gastan en API cada mes, esa diferencia importa: Astra hoy cuesta US$10/US$50 por millón de tokens de entrada/salida, y el input cacheado está a US$1. Llevar una flota de agentes de Astra a 6.1 Sol recorta cinco veces el costo por token y, según OpenAI, deja un rendimiento muy cercano (VentureBeat). En escenarios donde el agente reusa entre llamadas instrucciones de sistema, contexto del repositorio y políticas internas, el caché se vuelve el componente dominante de la factura.
El anuncio llegó envuelto en una decisión llamativa: según reportó Gizmodo, OpenAI canceló el lanzamiento de GPT-6.1 Astra horas antes del evento por motivos de seguridad, después de que el modelo mostrara regresiones en evaluaciones internas, y usó DevDay para presentar el escalón Sol como sustituto público. Sam Altman dijo a CNBC que Astra se lanzaría más adelante.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadQué dice OpenAI sobre el rendimiento (y por qué importa)
Los benchmarks son de OpenAI, no independientes, así que conviene leerlos con cautela. Aun así, el patrón es consistente: 6.1 Sol reduce la distancia con Astra y supera a su predecesor directo.
- DeepSWE v1.1 (ingeniería de software en repositorios reales): 6.1 Sol iguala a Astra a aproximadamente un quinto del costo y mejora el mejor resultado de GPT-6 Sol por 6,4 puntos porcentuales (OpenAI, Unite.ai).
- GDP.pdf (documentos profesionales con tablas y gráficos): supera a Claude Opus 5.5 con fallbacks a menos de la mitad del costo por tarea y se acerca a Astra a un quinto del costo (OpenAI).
- AutomationBench (47 herramientas en ventas, marketing, operaciones, soporte, finanzas y RR. HH.): 6.1 Sol gana a Opus 5.5 por 2,2 puntos porcentuales a esfuerzo de razonamiento medio, a un tercio del costo, y supera a GPT-6 Sol por 4,8 puntos en la misma configuración (OpenAI, Unite.ai).
- OSWorld 2.0 (uso de computador offline): a esfuerzo máximo, queda a 2,1 puntos de Astra a aproximadamente un séptimo del costo por tarea (OpenAI).
Para agentes de código de larga duración, sistemas de investigación y automatizaciones de procesos de negocio, el resultado útil es que ya no hace falta pagar precio Astra para acercarse a su rendimiento. Astra sigue siendo el techo de capacidad; Sol se consolida como la opción cuando el costo por turno pesa más que el último punto porcentual de benchmark.
Ultrafast: velocidad como producto premium
La otra mitad del anuncio ataca un cuello de botella distinto. OpenAI formalizó Ultrafast, un nivel de inferencia premium que alcanza hasta 300 tokens por segundo, con aceleración de hasta 8X en Codex y hasta 6X en la API. El precio del tier es 6 veces la tarifa estándar del modelo base (OpenAI, VentureBeat).
Para poner el número en contexto, Artificial Analysis mide actualmente a Google Gemini 3.5 Flash en unos 201 tokens/segundo, mientras que modelos especializados en velocidad bruta como Mercury 2 rondan los 769 tokens/segundo y Celeris-1 llega a unos 1.491 tokens/segundo. OpenAI no lidera el ranking absoluto de velocidad, pero sí es la primera vez que esa cifra se ofrece sobre un modelo de frontera GPT-6 (VentureBeat).
El antecedente directo es el preview de GPT-5.6 Sol Ultrafast sobre hardware de Cerebras que OpenAI habilitó en agosto de 2026, donde llegó a 750 tokens/segundo y hasta 14X la velocidad estándar para un grupo limitado de clientes (TechCrunch). En el rollout de DevDay, los modelos GPT-6 intercambian parte de esa velocidad máxima a cambio de acceso a la inteligencia más reciente, y Ultrafast deja de ser experimento para convertirse en nivel de producto con precio explícito.
El multiplicador de 6X implica, según la tabla estándar publicada por OpenAI, US$60 por millón de tokens de entrada y US$300 por millón de tokens de salida para Astra Ultrafast, frente a US$10/US$50 en Standard y US$20/US$100 en Fast mode. Para 6.1 Sol Ultrafast, cuando llegue en los próximos días, el cálculo derivado sería US$12 de entrada y US$60 de salida por millón de tokens (VentureBeat). El Decoder confirmó que GPT-6.1 Sol Ultrafast es esperado en los próximos días y que Astra Ultrafast ya está disponible vía API y en ChatGPT Work y Codex para clientes Pro 500 y Enterprise.
Cómo encaja esto en la estrategia de OpenAI (y en tu pila)
El patrón de fondo es claro: OpenAI está pidiendo a los desarrolladores que optimicen sobre tres variables a la vez — inteligencia, costo y latencia —, no solo sobre el modelo «más inteligente». 6.1 Sol empuja la ejecución capaz de agentes hacia abajo en la curva de costo; Ultrafast empuja en la dirección contraria, cobrando una prima fuerte cuando cada segundo se nota.
Para una startup que construye con LLM, eso habilita un patrón antes difícil de defender económicamente: rutar la mayor parte del trabajo a 6.1 Sol (agentes de back-office, generación de borradores, investigación larga con caché agresivo) y reservar Astra Ultrafast para el tramo interactivo donde un humano está esperando respuesta — coding pair con latencia baja, soporte al cliente, respuesta a incidentes, análisis financiero en tiempo real.
Conviene tener en cuenta tres detalles prácticos:
- El precio del input cacheado suele ser el verdadero protagonista en arquitecturas con agentes. Reusar instrucciones, contexto del repo y políticas entre llamadas es donde 6.1 Sol muestra su ventaja más concreta, no en el precio de entrada estándar.
- Astra Ultrafast está disponible hoy, pero 6.1 Sol Ultrafast aún no: la opción aparece como
service_tier=ultrafasten la referencia de la API, y los modelos compatibles se irán incorporando (OpenAI, The Decoder). - GPT-5.6 Sol mantiene precio promocional de US$4/US$20 por millón de tokens de entrada/salida al menos hasta el 21 de noviembre de 2026, según la documentación de OpenAI citada por VentureBeat. Es un plazo útil para negociar migraciones.
El resto de DevDay 2026 en una línea
GPT-6.1 Sol y Ultrafast fueron solo dos de más de 20 anuncios del DevDay. Los más relevantes para founders, según Mashable, Decrypt y Unite.ai:
- Dots: agentes always-on con su propio computador en la nube, sobre GPT-6 Astra. Incluidos en Pro y Business Premium en mercados elegibles.
- Decisions API: GPT-6 Luna tuneado para preguntas con respuestas cerradas (clasificar, rutear, decidir el siguiente paso de un agente).
- Agents API con Computer Use: los agentes ahora pueden operar software como una persona.
- Codex Security Cloud: escaneo continuo de repos en GitHub, investigación de hallazgos y preparación de fixes, con acceso a Daybreak Blue sin aplicación separada.
- Codex CLI con control por voz, code review en la app de escritorio, y entornos de desarrollo reutilizables en la nube.
- Bedrock Managed Agents con AWS para correr agentes de OpenAI nativamente en infraestructura de Amazon.
- Pro 500 a US$500/mes: 25 veces el allowance de Plus, con Ultrafast incluido. El plan Pro de US$200 baja de 20X a 10X el allowance de Plus, y los mensajes GPT-6 Pro en chat pasan de 200 a 100 por semana (The Decoder).
- OpenAI Marketplace: las empresas pueden redirigir parte de su compromiso de gasto con OpenAI hacia software de partners como Adobe, Figma, Salesforce, HubSpot, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike y Baseten, entre los 32 iniciales.
¿Qué significa esto para tu startup?
Tres movimientos concretos que podés hacer esta semana:
- Reescribe tu tabla de routing de modelos. Si hoy todo tu tráfico va a Astra por defecto, identificá qué porcentaje realmente necesita su inteligencia máxima. Para agentes que ejecutan cientos de turnos con contexto reusado, migrar a 6.1 Sol suele bajar la factura entre 4X y 5X sin perder capacidad percibida por el usuario final.
- Mide el costo del caché, no solo el del input total. Con el corte de 6.1 Sol a US$0,10 por millón de tokens cacheados, reestructurar prompts para maximizar el hit-rate de caché (instrucciones de sistema, contexto de repositorio, plantillas) suele rendir más que renegociar el modelo.
- Reserva Ultrafast para latencias que se sienten. El precio 6X solo cierra cuando cada segundo ahorrado se traduce en valor (cobro por uso, fricción de UX, tiempo del operador humano). Para procesos batch, no lo actives por defecto.
Fuentes
- OpenAI’s GPT-6.1 Sol offers Astra-like performance at 1/5th price (VentureBeat)
- Introducing GPT-6.1 Sol (OpenAI)
- DevDay 2026 recap (OpenAI)
- Artificial Analysis — model speed benchmarks
- With No Astra to Release, OpenAI Pivots to New GPT-6.1 Sol Model (Gizmodo)
- The biggest announcements from OpenAI DevDay (Mashable)
- OpenAI Unveils GPT-6.1 Sol at DevDay (Unite.ai)
- OpenAI expands Codex and its API at DevDay (The Decoder)
- OpenAI introduces ‘Ultrafast’ on GPT-5.6 Sol (TechCrunch)
- OpenAI Gave AI Agents Their Own Computers at DevDay 2026 (Decrypt)
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













