OpenAI lanza GPT-6 Sol y Luna minutos después de que Anthropic presentara Claude Opus 5.5
Puntos clave
- •OpenAI lanzó GPT-6 Sol y GPT-6 Luna el 22 de septiembre de 2026, apenas minutos después de que su competidor Anthropic presentara su modelo insignia Claude Opus 5.5.
- •Los precios de API de ambos nuevos modelos se redujeron a la mitad respecto a las tarifas promocionales de GPT-5.6, con Sol a $2 por millón de tokens de entrada y $10 por millón de tokens de salida, y Luna a $0.10 y $0.50.
- •OpenAI reportó mejoras en sus métricas internas de seguridad, con tasas de engaño en programación que cayeron a 1.3% para Sol y 2.8% para Luna, frente al 10.4% de GPT-5.6 Sol.
- •Según cifras de la propia OpenAI, GPT-6 Sol obtuvo 33.2% en AutomationBench de Zapier a $0.27 por tarea, mientras que Claude Opus 5 obtuvo 26.9% a más de 11 veces el costo, y los resultados de benchmarks independientes aún no se han publicado.
- •GPT-6 Sol y Luna ya están disponibles en ChatGPT Work y Codex para los suscriptores de Plus, Pro, Business, Enterprise y Edu, con Luna también disponible para usuarios gratuitos y de Go a través de la app de escritorio, aunque ninguno ha llegado aún a la app estándar de ChatGPT.

OpenAI lanzó el martes dos nuevos modelos de inteligencia artificial, GPT-6 Sol y GPT-6 Luna, reduciendo a la mitad los precios de API en comparación con las tarifas promocionales de GPT-5.6. El lanzamiento se produjo apenas minutos después de que su competidor Anthropic presentara Claude Opus 5.5, su propio nuevo modelo insignia. Los lanzamientos consecutivos subrayaron la escalada de competencia entre las dos empresas líderes de IA —y ofrecieron a desarrolladores y empresas que pagan por token una comparación directa y poco habitual de precio y rendimiento.
Sol y Luna se sitúan por debajo de GPT-6 Astra, el modelo que OpenAI llamó "el modelo más inteligente y alineado del mundo" cuando se lanzó el 3 de septiembre. Astra sigue siendo la opción principal de OpenAI para las tareas más difíciles; Sol y Luna son las opciones más económicas y rápidas, creadas para el trabajo cotidiano.
La estrategia de niveles refleja de cerca la alineación que ha aplicado Anthropic: Astra es el equivalente de Fable, Sol corresponde a Opus, Terra es paralelo a Sonnet y Luna equivale a Haiku una vez que reciba su propia actualización. La estructura paralela también facilita la comparación de precios nivel por nivel.
Las métricas internas de seguridad también mejoraron, según la empresa: la tasa de engaño en programación cayó a 1.3% para Sol y 2.8% para Luna, ambas muy por debajo del 10.4% de GPT-5.6 Sol.
OpenAI presentó las reducciones de precio como una forma de mantenerse competitivo. Los costos de API de ambos modelos se redujeron 50% frente a las tarifas promocionales por token de GPT-5.6. Los tokens son los fragmentos de texto que un modelo lee y escribe —generalmente un poco menos que una palabra completa— y las empresas pagan por millón, que es como las facturas de IA se acumulan a gran escala.
OpenAI anunció el lanzamiento en una publicación en X:
Please welcome GPT-6 Sol and GPT-6 Luna to the GPT-6 universe. GPT-6 Sol and Luna build on the advances behind GPT-6 Astra, bringing much of its strengths into and more affordable models to support work at scale. We've also made caching and inference more efficient, and… pic.twitter.com/5LiVE4rbFt
— OpenAI (@OpenAI) September 22, 2026
La publicación se realizó en la cuenta oficial de OpenAI en X (@OpenAI) el 22 de septiembre de 2026.
Sol ahora cuesta $2 por millón de tokens de entrada y $10 por millón de tokens de salida, frente a los $4 y $20 anteriores. Luna baja a $0.10 y $0.50, desde $0.20 y $1.20. En general, OpenAI ofrece el precio más bajo por nivel en comparación con Anthropic.
El argumento de rendimiento se apoya en AutomationBench, un benchmark creado por Zapier que evalúa si un agente de IA puede llevar a cabo un flujo de trabajo empresarial completo utilizando 47 herramientas que abarcan ventas, marketing, operaciones, soporte, finanzas y recursos humanos, medido como tasa de aprobación. GPT-6 Sol en su configuración de razonamiento más alta obtuvo 33.2% a $0.27 por tarea, donde las tarifas de token reducidas a la mitad se traducen directamente en ahorros por tarea, ya que las cargas de trabajo de los agentes consumen tokens en cada paso del trabajo.
Claude Opus 5, en su propia configuración máxima, obtuvo 26.9% pero costó más de 11 veces más por tarea, según cifras de la propia OpenAI. GPT-6 Sol también superó a Claude Fable 5.1, la insignia más cara de Anthropic, en la misma prueba. Cabe señalar que las cifras hacen referencia a Claude Opus 5 y no al Opus 5.5 que Anthropic lanzó minutos antes, por lo que el modelo más reciente de Claude aún no aparece en las comparaciones.
En Agents' Last Exam, que evalúa a los agentes de IA en trabajos largos y de valor económico en 55 subsectores y califica los resultados como porcentaje completado, GPT-6 Sol en su esfuerzo máximo obtuvo 56.4%. OpenAI afirma que esto supera el mejor puntaje de Claude Opus 5 con un costo por tarea 60% menor.
El esfuerzo de razonamiento es un control que OpenAI agregó: al aumentarlo, el modelo dedica más tiempo y poder de cómputo a verificarse antes de responder, lo que tiende a elevar la precisión y el costo al mismo tiempo.
En cuanto al uso de computadora —un agente de IA que hace clic, escribe y navega software como lo haría una persona— GPT-6 Sol en OSWorld 2.0 casi igualó el puntaje de esfuerzo medio de Claude Opus 5, 60.5% frente a 60.3%, con alrededor de 80% menos de costo. OSWorld evalúa tareas de computadora largas y realistas, y reporta un puntaje parcial según cuánto del trabajo se completó correctamente. Estas cifras comparativas provienen de los reportes de la propia OpenAI, los resultados de benchmarks independientes aún no se han publicado.
GPT-6 Sol y Luna ya están disponibles en ChatGPT Work y Codex para los suscriptores de Plus, Pro, Business, Enterprise y Edu, y Luna también llega a los usuarios gratuitos y de Go a través de la app de escritorio. Ninguno de los dos modelos está aún en la app estándar de ChatGPT, y OpenAI dice que los implementará gradualmente a lo largo del día para mantener la estabilidad del servicio. De aquí en adelante, los espacios abiertos visibles en esta rivalidad por lo demás espejada son la llegada de los modelos a la app estándar de ChatGPT y el equivalente del nivel Haiku que aún espera su propia actualización del lado de Anthropic.