OpenAI lanza GPT-6 Sol y Luna a mitad de precio y errores

OpenAI baja a la mitad el precio y los errores de sus modelos de nivel medio

OpenAI lanzó este 24 de septiembre GPT-6 Sol y GPT-6 Luna, las versiones actualizadas de sus modelos de nivel medio dentro de la familia GPT-6, con una reducción del 50% en el precio de la API y aproximadamente la mitad de errores factuales respecto a sus predecesores GPT-5.6, según confirmó la compañía. El anuncio llega apenas 90 minutos después de que Anthropic presentara Claude Opus 5.5, en una coreografía competitiva que ya se está convirtiendo en patrón entre ambos laboratorios. Para cualquier equipo que construye productos sobre API, el mensaje operativo es claro: el coste por token sigue cayendo y el ciclo de actualización se está comprimiendo.

Qué hace cada modelo: Sol para código, Luna para volumen

OpenAI mantiene la división de tareas que estableció con la generación anterior. GPT-6 Sol está pensado para trabajos complejos con énfasis en código y razonamiento; GPT-6 Luna, para tareas de «volumen alto con objetivo claro» —resumir documentos, extraer información, responder consultas rápidas— en pipelines donde la latencia y el coste por token pesan más que la profundidad de razonamiento.

En la evaluación interna de facticidad de OpenAI —basada en conversaciones reales donde los usuarios marcaron errores—, GPT-6 Sol comete aproximadamente la mitad de errores que GPT-5.6 Sol y se acerca a la fiabilidad del modelo flagship GPT-6 Astra, lanzado a principios de septiembre, pero a un coste significativamente menor. Luna también mejora y se aproxima a la fiabilidad de GPT-5.6 Sol en configuraciones de razonamiento alto, según los datos publicados por OpenAI.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Precios concretos: cuánto cuesta cada modelo

Los nuevos precios son permanentes, no promocionales, según confirmó un portavoz de OpenAI a VentureBeat:

  • GPT-6 Sol: US$2 por millón de tokens de entrada y US$10 por millón de tokens de salida (frente a US$4 y US$20 de GPT-5.6 Sol).
  • GPT-6 Luna: US$0,10 por millón de tokens de entrada y US$0,50 por millón de tokens de salida (frente a US$0,20 y US$1,20).

En paralelo, OpenAI ofrece descuentos de hasta el 90% en lecturas de tokens cacheados, una mejora de infraestructura que, según la compañía, permitió a GitHub reducir en más del 50% la proporción de tokens que requerían procesamiento nuevo a lo largo de miles de millones de solicitudes a modelos de OpenAI en los últimos meses, mejorando los tiempos de respuesta de GitHub Copilot.

Rendimiento en código y agentes: cómo se compara con Anthropic

OpenAI publicó benchmarks internos que enfrentan a Sol y Luna con los modelos de Anthropic:

  • AutomationBench (flujos de trabajo con 47 herramientas en ventas, marketing, operaciones, soporte, finanzas y RR.HH.): GPT-6 Sol alcanza 33,2% en su nivel de razonamiento máximo, con un coste estimado de US$0,27 por tarea. Claude Opus 5 logra 26,9% a un coste por tarea aproximadamente 11 veces mayor.
  • DeepSWE v1.1 (ingeniería de software sobre codebases reales): GPT-6 Sol obtiene 68,8%, cerca del 69,9% reportado por Claude Fable 5, pero a un coste por tarea aproximadamente 80% menor. GPT-6 Luna alcanza 66,6% en la misma evaluación, con un coste por tarea 93% inferior a Opus 5 y 96% inferior a Fable 5.
  • OSWorld 2.0 (uso de computador): GPT-6 Sol logra 60,5% en su nivel de razonamiento máximo frente al 60,3% de Claude Opus 5 en esfuerzo medio, completando las tareas a un coste aproximadamente 80% menor.

Estos resultados provienen de las pruebas internas de OpenAI y de evaluaciones publicadas por la competencia, no de benchmarks independientes sobre casos de uso reales. La propia OpenAI señala que los benchmarks generales y los benchmarks sobre tu caso de uso específico rara vez coinciden.

El lanzamiento simultáneo con Claude Opus 5.5

Noventa minutos antes del anuncio de OpenAI, Anthropic presentó Claude Opus 5.5, primer modelo de su nueva familia 5.5, con un coste un 40% inferior a Opus 5 y un rendimiento equiparable al de Claude Fable 5.1 en la mayoría de tareas, según datos publicados por Anthropic. Opus 5.5 se sitúa en US$4 por millón de tokens de entrada y US$20 por millón de salida, lo que deja a GPT-6 Sol exactamente a la mitad de precio en ambas medidas. Anthropic también redujo el precio de lectura de caché de US$0,50 a US$0,20 por millón.

La coincidencia no parece accidental: ambos laboratorios parecen preferir absorber la cobertura compartida antes que ceder visibilidad al rival. El resultado neto es que en un solo día los precios de los modelos medianos y de gama alta de los dos principales laboratorios cayeron entre 40% y 50%, y los descuentos por caché llegaron hasta el 90%. Los costes de inferencia a escala siguen bajando más rápido de lo que la industria comunica públicamente.

Disponibilidad y próximos pasos

GPT-6 Sol y Luna ya están disponibles en ChatGPT Work y Codex para suscriptores Plus, Pro, Business, Enterprise y Edu, y en la API de OpenAI con los identificadores gpt-6-sol y gpt-6-luna. Los usuarios Free y Go pueden acceder a GPT-6 Luna a través de la aplicación de escritorio de ChatGPT. El despliegue en la app y la web de ChatGPT se completará de forma gradual a lo largo del día.

Sam Altman, CEO de OpenAI, resumió la estrategia en una cita incluida en el anuncio: «Queremos que la API de OpenAI tenga el mejor modelo en cada punto de precio y sea el mejor en cada modalidad (texto, código, imagen, vídeo, etc.). Y luego queremos que se les ocurran grandes ideas, las construyan y disfruten como usuarios». Altman también adelantó que el próximo 29 de septiembre, en el DevDay de San Francisco, OpenAI prepara «una cantidad inusualmente grande de lanzamientos de producto».

Qué significa esto para tu startup

Tres palancas concretas para founders que ya están construyendo sobre API de modelos:

  • Audita tu mix de modelos hoy mismo. Si tu pipeline usa GPT-5.6 Sol o GPT-5.6 Luna para tareas rutinarias (extracción, resumen, clasificación), migrar a GPT-6 Luna o a GPT-6 Sol con cacheo habilitado puede recortar la factura entre 50% y 90% según el patrón de uso. El ahorro no viene solo del menor precio por token: las mejoras de cacheo reportadas por OpenAI (90% de descuento en lecturas repetidas) suelen ser el factor determinante en aplicaciones con prompts largos o agentes.
  • Reprotesta con tus datos, no con benchmarks. Los números que OpenAI publicó —33,2% en AutomationBench, 68,8% en DeepSWE— describen rendimiento medio en tareas genéricas. La recomendación práctica, según la propia OpenAI, es testear con tus propios datos antes de migrar un pipeline en producción. Los benchmarks generales y los benchmarks de tu caso de uso específico rara vez coinciden.
  • No postergues decisiones de arquitectura por esperar el DevDay. El ciclo de actualización de OpenAI pasó de 6-12 meses entre generaciones de GPT a meses entre lanzamientos dentro de la misma familia. Construir asunciones de coste y latencia sobre modelos específicos se ha vuelto un ejercicio con fecha de caducidad corta. Diseña tu stack con un nivel de indirección (model router, abstracción de proveedor) que permita cambiar de modelo sin reescribir el producto.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...