GPT-6 Sol y Luna: qué cambian y en qué plan los tienes
OpenAI lanza GPT-6 Sol y Luna el 22 de septiembre de 2026: qué traen, en qué planes están y por qué todavía no aparecen en Chat.
El 22 de septiembre de 2026 OpenAI anunció dos modelos nuevos: GPT-6 Sol y GPT-6 Luna.
No son el modelo grande. El modelo grande es GPT-6 Astra, que OpenAI presentó este mismo mes. Sol y Luna son la otra pata: la misma familia, entrenada con métodos parecidos, pero apuntando a hacer el trabajo más barato y más rápido.
Y ojo, porque lo interesante no está en los benchmarks. Está en dónde puedes usarlos y dónde todavía no.
¿Qué son exactamente Sol y Luna?
OpenAI lo explica así: Astra sigue siendo su mejor modelo para todo, y lo eliges cuando quieres el mejor resultado sin concesiones. Sol y Luna llevan los avances de Astra (trabajo profesional, factualidad, código, uso del ordenador, alineamiento) a modelos más rápidos y más asequibles.
La frase que usan es que "el trabajo ocurre a escalas, ritmos y presupuestos distintos". Que es una forma elegante de decir lo que cualquiera que trabaje solo ya sabe: no todas las tareas merecen el modelo caro.
Sol es el de en medio. Se come trabajo difícil, te da más margen para iterar con límites de uso más altos y cuesta menos.
Luna es el pequeño. El barato de verdad.
Y hay un dato de precio que sí está en el anuncio: OpenAI baja los precios de API de Sol y Luna un 50% respecto al precio promocional que tenían sus equivalentes de GPT-5.6. Dicen que las mejoras en caché e inferencia les permiten servirlos más barato y que trasladan ese ahorro directamente.
Dónde los tienes hoy (esto es lo importante)
Aquí es donde mucha gente se va a hacer un lío, así que te lo pongo tal cual lo publican:
- GPT-6 Sol y GPT-6 Luna están disponibles en ChatGPT Work y en Codex desde ese mismo día, para usuarios Plus, Pro, Business, Enterprise y Edu.
- Los usuarios Free y Go pueden acceder a GPT-6 Luna en la app de escritorio.
- Todavía no están en Chat.
Esa última línea es la que te va a joder el plan si esperabas abrir ChatGPT normal y verlos ahí. No están. De momento viven en el entorno de trabajo y en Codex.
Y avisan de otra cosa: el despliegue es gradual a lo largo del día para no reventar el servicio. Si no los ves, no es que te hayan dejado fuera. Es que te toca esperar.
En la API están como gpt-6-sol y gpt-6-luna.
Si esto de "ChatGPT Work" te suena a chino, te vendrá bien la comparativa entre Claude Cowork y ChatGPT Work, porque es justo el sitio donde han aterrizado estos modelos.
Los números que ha publicado OpenAI
Vamos con los datos. Todos salen del anuncio oficial, y todos comparan con un nivel de esfuerzo concreto (OpenAI llama "effort" a cuánto razona el modelo antes de contestar, y va de bajo a máximo).
| Evaluación | Qué mide | El dato |
|---|---|---|
| AutomationBench | Flujos de trabajo de negocio con 47 herramientas (ventas, marketing, operaciones, soporte, finanzas, RRHH) | Sol en esfuerzo xhigh supera a Claude Opus 5 en max, al 9% del coste por tarea de Opus 5 |
| Agents' Last Exam | Tareas profesionales largas en 55 subsectores | Sol en max saca 56,4%, por encima del mejor resultado de Opus 5 en esa evaluación, con un 60% menos de coste por tarea |
| DeepSWE 1.1 | Ingeniería de software en repositorios reales | Sol en max saca 68,8%, a 1,1 puntos de Claude Fable 5 (69,9% en xhigh), con un 80% menos de coste aproximadamente |
| OSWorld 2.0 offline | Uso del ordenador de principio a fin | Sol en xhigh saca 60,5% frente al 60,3% de Opus 5 en medium, con un 80% menos de coste aproximadamente |
Luna, el pequeño, tiene su propia lista. En AutomationBench con esfuerzo alto mejora a su predecesor en 5,4 puntos porcentuales con un 58% menos de coste por tarea. En DeepSWE saca 66,6% en max, comparable a Opus 5 y a Fable 5 en medium, pero costando un 93% menos que Opus 5 y un 96% menos que Fable 5.
Un apunte de honestidad que trae el propio anuncio: el dato de Claude Fable 5.1 en AutomationBench se queda corto en coste porque no incluye las llamadas de respaldo a Opus 5, que ocurrieron en torno al 40% de las tareas. Lo dicen ellos, no yo.
¿Y esto se nota si no picas código?
Dos cosas del anuncio que sí tocan al que solo escribe y trabaja con el chat.
La primera es la factualidad. OpenAI tiene una evaluación interna hecha con conversaciones reales de ChatGPT donde los usuarios marcaron que el modelo se había equivocado. En esa prueba, Sol comete la mitad de errores que su predecesor, acercándose a la fiabilidad de Astra a mucho menos coste. Luna también mejora bastante: con esfuerzos altos iguala a GPT-5.6 Sol a la centésima parte de su coste.
La segunda es cómo escriben. Han traído a Sol y a Luna el estilo de comunicación de Astra, y dicen que se va a notar sobre todo en conversaciones técnicas y de código: más claridad, menos jerga, menos frases raras, menos detalles de relleno y respuestas un poco más cortas sin perder sustancia.
Eso, si llevas meses peleándote con respuestas de tres pantallas para una pregunta de dos líneas, es más noticia que cualquier benchmark.
La parte de desarrolladores, en dos líneas
El mismo día publicaron una mejora del sistema de caché de prompts para GPT-6: mayor tasa de aciertos de caché por defecto, descuentos de hasta el 90% en los tokens de entrada cacheados, un panel de caché, una herramienta de diagnóstico para entender por qué has perdido una caché y puntos de corte explícitos para decidir qué parte del prompt se reutiliza.
Si tú no construyes aplicaciones sobre la API, esto no te afecta en el día a día. Si construyes agentes que corren durante horas, sí: GitHub dice que estas mejoras le han reducido más de un 50% la proporción de tokens de prompt que hay que procesar de cero.
Lo que el anuncio no dice
Y aquí me paro, porque prefiero dejar los huecos marcados a rellenarlos con lo que me parece razonable.
El anuncio no dice cuándo llegan Sol y Luna a Chat. Solo dice que todavía no están.
Tampoco dice qué pasa con los modelos anteriores, ni si los límites de uso concretos de cada plan cambian con esto. Habla de "límites de uso más altos" con Sol, pero no pone números.
Y no da precios absolutos de API. Da una bajada del 50% respecto al precio promocional de GPT-5.6, que no es lo mismo.
Si alguien te cuenta esos datos hoy, se los está inventando o los ha sacado de otro sitio.
Qué haría yo con esto
Si trabajas en ChatGPT Work o en Codex, pruébalos ya. Es gratis probar en el sentido de que ya los tienes en tu plan.
Si solo usas ChatGPT normal, no hay nada que hacer todavía. Espera.
Y si estás en el otro bando, comparando terminales y agentes, mira que aquí la comparación que se repite en todos los benchmarks es contra Claude, que es justo lo que ya hablamos en Claude Code y Codex peleándose en la misma terminal. La guerra de precios por tarea se está poniendo interesante.
Toda la información sale del anuncio oficial de OpenAI.
¿Y tú en qué punto estás con todo esto? Si te pierdes entre modelos, planes y nombres raros, haz el test de nivel de IA y te digo por dónde empezar sin marearte.
Sigue leyendo
Las mejores herramientas para editar vídeo con IA en 2026
Siete editores con IA probados con el mismo material. Cuál acierta, cuál te hace repetir el trabajo y precios reales de cada uno.
Las mejores herramientas no-code gratis para empezar hoy
Con plan gratis se llega más lejos de lo que crees. Seis herramientas sin código para empezar sin pagar, con el techo real de cada una.
Kit MCP: conectar tu newsletter a Claude paso a paso
Kit MCP conecta tu cuenta de Kit con Claude. Qué plan lo incluye, cómo se instala, qué herramientas trae y qué no puede hacer.
La app que le monté a mi hermano para su negocio sin presupuesto
Sin presupuesto, sin equipo técnico y con una necesidad muy concreta. Qué app le monté a mi hermano, qué descarté y qué se rompió después.