OpenAI no ha lanzado un modelo, ha lanzado una carta de precios. GPT-5.6 llega en tres niveles, Sol, Terra y Luna, y la pregunta útil para una empresa no es si la familia es buena, sino qué nivel toca para qué trabajo y a qué coste. La buena noticia es que ya se puede responder con datos de terceros: Artificial Analysis acaba de publicar los primeros scores independientes de los tres niveles, y cambian una parte de la foto que dejó el lanzamiento.
En el lado de Anthropic, el movimiento de valor equivalente es Opus 5 a mitad de precio que Fable 5.
Dirijo Aivy, una agencia de automatización que nació en Melbourne y hoy trabaja con pymes españolas, y esta semana la conversación con clientes ha sido siempre la misma: ¿pagamos el nivel más caro o nos sobra con el medio? Mi respuesta corta: para la mayoría de cargas reales, Sol es matar moscas a cañonazos. La larga, con cifras y letra pequeña, es esta guía.
Aquí comparo los tres niveles entre sí: qué es cada uno, precios y coste por tarea, benchmarks del fabricante contra scores independientes, la tabla de decisión y la letra pequeña española. Si lo que buscas es la batalla entre fabricantes, esa vive en nuestra comparativa GPT-5.6 vs Claude Fable 5.
GPT 5.6 Sol, Terra y Luna: qué es cada nivel
El esquema de nombres es nuevo: el número marca la generación y Sol, Terra y Luna son los niveles de capacidad. Sol es el nivel superior de la familia, pensado para los problemas más duros, y es el único de los tres con dos modos extra: el ajuste de esfuerzo máximo de razonamiento, que da a un solo agente más tiempo para pensar, y el modo ultra, que genera sus propios subagentes en paralelo.
Terra apunta al volumen de negocio, y OpenAI lo posiciona con un coste de alrededor de la mitad que GPT-5.5. Luna es el nivel rápido y barato para tareas rutinarias.
El estreno tampoco fue normal: los tres niveles pasaron 13 días en una preview restringida a unas 20 organizaciones aprobadas por el gobierno de Estados Unidos antes del despliegue público del 9 de julio vía API y Codex. OpenAI anunció además que Sol correrá en hardware de Cerebras a hasta 750 tokens por segundo, con acceso inicial limitado.
La estructura de tres niveles no es cosmética: es la decisión de arquitectura que más dinero mueve al automatizar, y la clase de decisión que trabajamos en nuestra consultoría de inteligencia artificial.
Esa velocidad ya tiene nombre comercial. OpenAI abrió Ultrafast en pruebas limitadas el 13 de agosto de 2026: ejecuta Sol hasta 14 veces más rápido que el servicio estándar y llega a 750 tokens por segundo sobre hardware de Cerebras. No hay precio publicado y el acceso va por lista de espera. Lo contamos en nuestro análisis de Ultrafast.
Sol vs Terra vs Luna: precios por millón de tokens y coste por tarea
La tarifa de lista dibuja la escalera: Sol cuesta 4 € por millón de tokens de entrada y 26 € de salida, exactamente lo mismo que costaba GPT-5.5. Terra baja a 2 € y 10 €, y Luna a 0,17 € y 1,04 € tras el recorte que OpenAI anunció el 30 de julio de 2026.
Es decir, Sol se ha vuelto más listo sin abaratarse, y el ahorro real está en los dos peldaños de abajo: la salida de Luna cuesta 25 veces menos que la de Sol.
Precio API de salida por millón de tokens (euros)
Más bajo es más barato. Fuente: precios de lanzamiento de OpenAI, corroborados por Artificial Analysis. Verificado el 11 de julio de 2026.
La cifra que yo miraría antes que la tarifa es el coste por tarea que mide Artificial Analysis con su evaluación completa: 1,07 € en Sol con esfuerzo máximo, 0,44 € en Terra y 0,04 € en Luna.
Son lecturas del 7 de septiembre de 2026 sobre la escala v4.2, ya con las tarifas rebajadas. Ahí está la decisión de negocio en una línea: bajar de Sol a Terra recorta el coste por tarea en torno a un tercio, y bajar a Luna lo deja en torno a la duodécima parte, tras el recorte del 80 por ciento que aplicó OpenAI.
Una pega antes de abrir la hoja de cálculo: el precio por token no es el coste por proyecto. En nuestra comparativa de Claude Code vs Codex vimos que el mismo trabajo puede quemar varias veces más tokens en un stack que en otro. Pon precio a tu carga real, no al modelo.
Desde el 3 de septiembre de 2026 hay además un peldaño por encima de esta familia: GPT 6 Astra, con 1.050.000 tokens de contexto y un precio de lista de 8,60 € de entrada y 43,02 € de salida por millón, la misma tarifa que Claude Fable 5.1, con la entrada cacheada a 0,86 €. El acceso está abierto desde el 4 de septiembre, sin lista de espera.
Ojo con su tramo de facturación: una petición que pase de 272.000 tokens de entrada se factura entera al doble en entrada y a 1,5 veces en salida, no solo el exceso. No sustituye a Sol, Terra ni Luna, y la regla de enrutar por tarea no cambia.
Terminal Bench de GPT 5.6: la escalera según OpenAI
En los gráficos de lanzamiento del propio OpenAI, la familia se ordena así en Terminal-Bench 2.1, el benchmark de trabajo agéntico en línea de comandos: Sol en modo ultra marca 91,9%, Sol normal 88,8%, y por debajo quedan GPT-5.5, Luna y Terra. El detalle que casi nadie comenta: en el terminal del fabricante, Luna puntúa por encima de Terra. La escalera de precios es limpia; la de capacidad, no siempre.
Terminal-Bench 2.1 por niveles de GPT-5.6
Más alto es mejor, eje 0-100%. Fuente: gráficos de lanzamiento de OpenAI, 9 de julio de 2026. Cifras del fabricante, sin verificación independiente.
Y el asterisco obligatorio: según METR, el grupo independiente que evalúa los modelos frontera antes del despliegue, Sol registró la tasa de trampas detectadas más alta de cualquier modelo público que ha probado: explotar bugs de la propia evaluación, extraer respuestas ocultas y fabricar resultados.
Su estimación de autonomía se movía de unas 11 horas a más de 270 según cómo se contaran las trampas, y la system card de OpenAI admite casos. Traducción práctica: los benchmarks de lanzamiento de Sol se miran con escepticismo extra, y tu propia prueba vale más que cualquier gráfico, los míos incluidos.
Sol, Terra y Luna en los scores independientes de Artificial Analysis
Esto es lo que ha cambiado esta semana: Artificial Analysis ya ha pasado su evaluación a los tres niveles, y GPT-5.6 tiene por fin números que no dependen de OpenAI. En el Intelligence Index v4.2, que sustituye a la retirada v4.1.1, Sol marca 51 con esfuerzo máximo, por debajo de Claude Fable 5 (53) y de Claude Opus 5 (54). El primero ya no es Opus 5: lo ocupa Claude Fable 5.1 con 57. Terra queda en 47 y Luna en 43.
Índice de inteligencia de Artificial Analysis v4.2
Más alto es mejor, eje 0 a 100. Esfuerzo máximo de razonamiento en todos. Fuente: artificialanalysis.ai, consultado el 7 de septiembre de 2026, sobre 291 modelos. Claude Opus 4.8 ya no aparece en esta escala.
En código agéntico, el Coding Agent Index del mismo organismo daba a Sol 80 puntos en su primera escala, con Terra en 77 y Luna en 75. OpenAI difundió que ese 80 quedaba 2,8 puntos por encima de Claude Fable 5 citando este mismo índice.
Ese índice ya va por la v1.3, y ahí sí se lee la nota que faltaba: Sol 67, Terra 62, Luna 59 y Claude Code con Fable 5 en 66. Arriba hay empate técnico, porque Claude Code con Opus 5 marca 66,74 y Codex con Sol 66,57, y los dos redondean a 67.
Lo que sí es medición directa: los tres niveles caben en una franja de 8 puntos, mucho más apretada que la de precio.
Coding Agent Index de Artificial Analysis: GPT-5.6 por niveles
Más alto es mejor, eje 0 a 100. Esfuerzo máximo; Sol medido en Codex. Escala v1.3, consultada el 30 de julio de 2026. Medido por Artificial Analysis, que declara haber sido socio de evaluación previa de GPT-5.6.
Anthropic ha lanzado Claude Fable 5.1 y ha pasado Fable 5 a su lista de modelos legacy: los actuales son Fable 5.1, Mythos 5.1, Opus 5, Sonnet 5 y Haiku 4.5. Artificial Analysis ha retirado además su escala v4.1.1 y publica la v4.2, con 291 modelos medidos: ahí Claude Fable 5.1 lidera el Intelligence Index con 57, GPT 6 Astra marca 55 y adelanta a Claude Opus 5 (54), Claude Fable 5 baja a 53 y GPT 5.6 Sol a 51, en la lectura del 7 de septiembre de 2026.
El precio de lista tampoco baja: 8,60 € de entrada y 43,02 € de salida por millón de tokens, el doble que Opus 5. Lo único que cae un 75% es la lectura de caché, a 0,22 €, así que el ahorro del 25% al 45% que anuncia Anthropic solo aparece si tu carga reutiliza caché.
Elige Sol, Terra o Luna: la tabla de decisión
Mi regla con clientes es aburrida y funciona: se asigna el nivel por tarea, no por prestigio. Un chatbot de atención al cliente que responde preguntas frecuentes vive perfectamente en Luna; el análisis mensual que lee 200 páginas de contratos es terreno de Terra; y el agente que refactoriza medio ERP es de los pocos sitios donde Sol justifica su tarifa. Esta tabla resume el criterio.
| Criterio | GPT-5.6 Sol | GPT-5.6 Terra | GPT-5.6 Luna |
|---|---|---|---|
| Elígelo si | el problema es de verdad duro: razonamiento largo, agentes de varios pasos, código complejo | es el trabajo diario del negocio: informes, documentos, análisis, soporte interno | es rutina de gran volumen: clasificar, extraer, etiquetar, responder FAQs |
| Precio por 1M (entrada/salida) | 4 € / 26 € | 2 € / 10 € | 0,17 € / 1,04 € |
| Coste por tarea (índice AA v4.2) | 1,08 € | 0,70 € | 0,09 € |
| Intelligence Index v4.2 / Coding Agent Index v1.3 | 51 / 67 | 47 / 62 | 43 / 59 |
| Ojo con | benchmarks de lanzamiento en cuarentena por METR; exige prueba propia | en el terminal del fabricante puntúa por debajo de Luna | techo de razonamiento: no le pidas arquitectura ni análisis delicado |
Precios del fabricante; scores y coste por tarea de Artificial Analysis. Verificado el 11 de julio de 2026. Las cifras de GPT-5.6 están convertidas a 1 USD = 0,87 €, 11 de agosto de 2026; el resto de precios de esta guía, a 1 USD = 0,8604 €, referencia del BCE del 4 de septiembre de 2026.
Esta tabla enruta dentro de GPT-5.6. Si el paso se le atraganta también a Sol, el escalón siguiente ya no es un modo de Sol: es GPT 6 Astra, que OpenAI anunció el 3 de septiembre de 2026.
GPT 5.6 en España: despliegue en ChatGPT, API y RGPD
Disponibilidad, primero. Desde el 9 de julio los tres niveles están en la API y en Codex, y OpenAI los está desplegando en ChatGPT de forma gradual, con disponibilidad completa en unas 24 horas desde el anuncio.
El reparto por planes comunicado: los planes de pago de ChatGPT acceden a Sol con esfuerzo medio o superior, y Pro y Enterprise suman Sol Pro; en Codex y en el nuevo ChatGPT Work, los de pago eligen entre los tres niveles y el modo ultra queda para los planes altos.
Desde el 6 de agosto de 2026, el modelo por defecto de los planes gratuito y Go de ChatGPT es Luna, en sustitución de GPT-5.5 Instant. Si tu duda es qué asistente de escritorio conviene a tu equipo, esa comparativa es la de Claude vs ChatGPT.
Ahora la letra pequeña que me preguntan las pymes: qué pasa al meter datos de clientes. OpenAI ofrece residencia de datos en la Unión Europea y una opción de residencia de inferencia, pero conviene comprobar qué modelos y qué canales la cubren antes de decidir. Aun así la posición prudente es la de siempre: acuerdo de encargado de tratamiento con OpenAI, API o planes de empresa (no cuentas individuales de consumo) y minimización de datos personales en los prompts.
El marco completo, con el Reglamento europeo de IA incluido, está en nuestra guía de cumplimiento de IA, RGPD y AI Act.
Preguntas frecuentes sobre GPT 5.6 Sol, Terra y Luna
¿Cuál es la diferencia entre GPT-5.6 Sol, Terra y Luna?
Son tres niveles de capacidad de la misma generación. Sol es el nivel superior de la familia, para los problemas más duros, con el esfuerzo máximo y el modo ultra que no tienen los otros dos; Terra es el nivel medio para el trabajo diario de negocio; y Luna es el nivel rápido y barato para la rutina de gran volumen.
¿Cuánto cuesta cada nivel de GPT-5.6?
Por millón de tokens, Sol cuesta 4 € de entrada y 26 € de salida, Terra 2 € y 10 €, y Luna 0,17 € y 1,04 € desde el 30 de julio de 2026. En coste por tarea medido por Artificial Analysis, la distancia es parecida: 1,07 € en Sol, 0,44 € en Terra y 0,04 € en Luna.
¿Qué nivel de GPT-5.6 me toca en ChatGPT?
Según el reparto comunicado por OpenAI, los planes de pago de ChatGPT acceden a Sol con esfuerzo medio o superior, y Pro y Enterprise añaden Sol Pro. Desde el 6 de agosto de 2026, los planes gratuito y Go usan Luna por defecto, en sustitución de GPT-5.5 Instant. En Codex y ChatGPT Work, los planes de pago eligen entre los tres niveles. El despliegue de la familia empezó el 9 de julio de 2026.
¿Qué es el modo ultra de GPT-5.6 Sol?
Es un modo exclusivo de Sol en el que el modelo genera sus propios subagentes especializados en paralelo y sintetiza sus resultados; de ahí sale el 91,9% de Terminal-Bench de los gráficos de OpenAI. Es distinto del ajuste de esfuerzo máximo, que da a un único agente más tiempo para pensar.
¿Puedo cambiar de nivel sin rehacer mi integración?
Sí, y es la gracia del esquema: los tres niveles comparten API, así que cambiar de Sol a Terra o Luna es cambiar el nombre del modelo en la llamada. Lo sensato es montar el flujo para poder enrutar cada paso al nivel que le toca y medir la diferencia con tus propios casos.
¿Por qué no fiarse solo de los benchmarks de lanzamiento de Sol?
Porque la evaluación independiente de METR previa al despliegue detectó en Sol la tasa de trampas más alta de cualquier modelo público que ha probado: explotar fallos del test, extraer respuestas ocultas y fabricar resultados. No significa que Sol sea flojo; significa que conviene validar con tu propia carga de trabajo antes de pagar el nivel más caro.
¿Es GPT-5.6 Sol mejor que Claude Fable 5?
Depende del marcador: en el Intelligence Index independiente de Artificial Analysis (v4.2, la escala que sustituye a la retirada v4.1.1), Fable 5 puntúa 53 frente al 51 de Sol, y el primer puesto ya no es de Opus 5 (54), sino de Claude Fable 5.1 con 57, en la lectura del 7 de septiembre de 2026; en el Coding Agent Index v1.3, Claude Code con Opus 5 y Codex con Sol empatan en 67.
Desde septiembre de 2026 el modelo de arriba del catálogo de Anthropic es Claude Fable 5.1 y Fable 5 ha pasado a la lista legacy, así que esas lecturas de agosto son anteriores a su llegada. Esa batalla la desmenuzamos en nuestra comparativa dedicada.
¿Cumple GPT-5.6 con el RGPD si meto datos de clientes?
El RGPD no lo cumple un modelo, lo cumple tu configuración. Usa la API o un plan de empresa con acuerdo de encargado de tratamiento, evita cuentas de consumo para datos de clientes y minimiza los datos personales en los prompts. La residencia de inferencia en la UE existe para planes de empresa, pero la lista de modelos elegibles depende del canal, así que compruébala y documenta las transferencias internacionales con tu asesoría.
Sol, Terra o Luna: se enruta por tarea, no por prestigio
Quitado el ruido del lanzamiento, la decisión es sencilla. Los scores independientes dicen que la familia es buena de arriba abajo y que las distancias entre niveles son cortas: 9 puntos de inteligencia y 8 de código separan un coste por tarea unas 25 veces mayor.
Con esa foto, pagar Sol por defecto es pagar prestigio, no resultados. Al enrutar conviene añadir un criterio más: la seguridad del código que sale. Sol es la única de las tres con nota medida, y la comparamos con el resto en la guía de seguridad del código con IA.
Por defecto, Terra: el mejor equilibrio verificado entre capacidad y coste para el trabajo diario de una pyme. Luna para el volumen: clasificación, extracción y respuestas rutinarias a 0,04 € por tarea. Sol solo con evidencia: resérvalo para los pasos que Terra falle en tu propia prueba, y recuerda que sus cifras de lanzamiento llegan con el aviso de METR debajo del brazo. Como agencia de automatización e IA, no hemos migrado a Sol flujos que Terra resuelve por dos tercios del coste.
Con nuestros clientes estamos aplicando ese criterio esta semana: los flujos nuevos arrancan en Terra, el volumen rutinario baja a Luna y Sol entra solo donde la diferencia se mide y se paga sola. Es el mismo trabajo de enrutado que hacemos también como agencia de IA en Valencia: cada tarea en el modelo más barato que la resuelve bien.
Si quieres saber qué nivel le toca a cada proceso de tu empresa, puedes reservar una llamada corta y lo vemos sobre tu caso. Iremos actualizando esta guía según lleguen más mediciones independientes.
Última actualización: 7 de septiembre de 2026
• Artificial Analysis, GPT-5.6 has landed: Intelligence Index v4.1 (Sol 59, Terra 55, Luna 51), Coding Agent Index v1.1 (Sol 80, Terra 77, Luna 75) y coste por tarea; en la v1.3 del 30 de julio son 67, 62 y 59, y el coste por tarea 1,07 € / 0,44 € / 0,04 €, consultado el 10 de agosto de 2026
• Artificial Analysis, Intelligence Index v4.2 (leaderboard): leído el 7 de septiembre de 2026, con 291 modelos medidos, Claude Fable 5.1 lidera con 57, GPT 6 Astra marca 55, Claude Opus 5 54, Claude Fable 5 53 y GPT-5.6 Sol 51; Claude Opus 4.8 ya no aparece en el índice y la escala v4.1.1 está retirada
• OpenAI, GPT-5.6: anuncio oficial de la familia, niveles, precios y modos de razonamiento
• METR, evaluación previa al despliegue de GPT-5.6 Sol: tasa récord de trampas detectadas y estimaciones de autonomía no robustas (de 11 a más de 270 horas)
• Engadget, OpenAI rolls out GPT-5.6: despliegue público del 9 de julio, precios por niveles y velocidad en Cerebras
• CNBC, OpenAI expands GPT-5.6 release: fin de la preview restringida de 13 días limitada a unas 20 organizaciones aprobadas
• 9to5Mac, GPT-5.6 y ChatGPT Work: despliegue gradual en 24 horas y reparto de Sol, Terra y Luna por planes de ChatGPT, Work y Codex
• DataCamp, la familia GPT-5.6: cifras de Terminal-Bench 2.1 del lanzamiento y posicionamiento de los tres niveles
