Actualización del 29 de septiembre de 2026: OpenAI lanzó su sucesor, GPT-6 Astra, el 3 de septiembre de 2026, y GPT-6 Sol y GPT-6 Luna el 22 de septiembre (hora de EE. UU.). Este artículo compara la generación anterior: GPT-5.6 y GPT-5.5. Cuando llama a Sol «buque insignia» o «tope de gama», se refiere a la generación GPT-5.6. Si hoy eliges adónde migrar desde GPT-5.5, empieza por Astra, Sol y Luna de la generación GPT-6: a 30 de septiembre de 2026, la lista de modelos de la API recomienda Astra si no sabes por dónde empezar, GPT-6.1 Sol (publicado el 29 de septiembre; en ChatGPT está en Work y Codex, no en el chat) para equilibrar inteligencia y coste y GPT-6 Luna para cargas de gran volumen en las que prima el coste. GPT-5.5 se retira de ChatGPT, ChatGPT Work y Codex el 14 de octubre de 2026 (la API de OpenAI no se ve afectada), y OpenAI indica como sustituto GPT-6 Sol en los planes de pago y GPT-6 Luna en la aplicación de escritorio en Free y Go (GPT-5.6 Sol, Terra y Luna siguen disponibles durante el periodo de transición). Para el coste, consulta nuestra comparación medida de Astra en low y GPT-5.6 Sol en high.
Índice
- 1. Qué ha cambiado: de un buque insignia a 3 modelos
- 2. Tabla comparativa de especificaciones
- 3. El impacto de Terra: «calidad tipo 5.5 al 40% del precio»
- 4. Benchmarks: cuánto mejoró de una generación a otra
- 5. Novedades añadidas en la 5.6
- 6. Coste real: cómo cambia la factura al actualizar
- 7. ¿Conviene migrar? A qué modelo cambiar
- Conclusión
- FAQ
Apenas dos meses y medio después del lanzamiento de GPT-5.5 el 23 de abril de 2026, OpenAI puso a disposición general GPT-5.6 el 9 de julio. Pero esta actualización no es «una simple mejora de rendimiento». El mayor cambio es la reorganización de «un único buque insignia» a «un esquema de 3 modelos: Luna / Terra / Sol».
Y para muchos usuarios de GPT-5.5, lo más relevante es que el modelo intermedio Terra ofrece «calidad equivalente a GPT-5.5, a un coste mucho menor». En el lanzamiento costaba la mitad y, tras la bajada de precios del 30 de julio de 2026, se quedó en el 40% del precio unitario de GPT-5.5. Para quien quiera más rendimiento está el tope de gama Sol (mejorado al mismo precio que GPT-5.5); para quien quiera reducir costes, está Terra. Así nace la posibilidad de elegir. En este artículo organizamos, basándonos en los anuncios oficiales y análisis independientes, qué ha cambiado de GPT-5.5 a la 5.6 y a qué modelo conviene cambiarse.
De un buque insignia a un esquema de 3 modelos
— Ahora puedes elegir entre «subir el rendimiento» o «bajar la factura»
Terra ofrece «calidad 5.5 al 40% del precio» / Sol ofrece «más rendimiento al mismo precio»
1. Qué ha cambiado: de un buque insignia a 3 modelos
GPT-5.5 tenía una estructura de dos niveles: «la versión estándar ($5/$30) + el caro GPT-5.5 Pro ($30/$180)». GPT-5.6 la ha rediseñado en 3 modelos que puedes elegir según uso y coste.
Para procesamiento masivo, clasificación y chat ligero. Una posición nueva, un escalón más barata que GPT-5.5.
Calidad equivalente a GPT-5.5 al 40% del precio. El sucesor real para «quien tenía suficiente con la 5.5».
El buque insignia de la generación GPT-5.6, que eleva el rendimiento al mismo precio que GPT-5.5. El sucesor puro en rendimiento.
Es decir, el destino de migración de los usuarios de GPT-5.5 se divide según el uso. Si «quieres bajar el coste manteniendo la misma calidad», Terra; si «quieres subir el rendimiento al mismo precio», Sol; si «quieres procesar volumen aún más barato», Luna. Frente a la 5.5, que era un modelo único, la libertad de elección ha aumentado enormemente.
2. Tabla comparativa de especificaciones
| Aspecto | GPT-5.5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|
| Lanzamiento | 23 de abril de 2026 | 9 de julio de 2026 | |
| Posicionamiento | Buque insignia único (+ Pro) | Tope de gama | Equilibrado (calidad 5.5 al 40% del precio) |
| Precio API | $5 / $30 | $5 / $30 | $2 / $12 |
| Contexto | 1,050,000 | 1,050,000 | 1,050,000 |
| Salida máxima | 128,000 | 128,000 | 128,000 |
| Corte de conocimiento | 1 de diciembre de 2025 | 16 de febrero de 2026 (actualizado) | |
| SWE-Bench Pro | 58.6% | 64.6% | 63.4% |
| Eficiencia de razonamiento | Referencia | Según OpenAI, logra resultados iguales o mejores con menos tokens (no ha publicado cifra de reducción frente a GPT-5.5) | |
| Control de razonamiento | effort (none–xhigh) | effort (none–max, se añade max) | |
* Precios y especificaciones según las páginas de modelos de OpenAI (GPT-5.5, GPT-5.6 Sol, GPT-5.6 Terra). Sol tiene un precio promocional de $4/$20 durante 3 meses desde el 21 de agosto de 2026. En SWE-Bench Pro, el 58.6% de GPT-5.5 es la cifra de OpenAI en el lanzamiento de GPT-5.5 (abril de 2026) y el 64.6% de Sol procede de la tabla de evaluación que OpenAI publicó con GPT-5.6 (en esa misma tabla, GPT-5.5 figura con un 59.4%). En TerminalBench, el 82.7% de GPT-5.5 en su lanzamiento corresponde a la 2.0; la tabla de GPT-5.6 mide también GPT-5.5 en la 2.1: 85.6% frente al 88.8% de Sol (véase el capítulo 4).
3. El impacto de Terra: «calidad tipo 5.5 al 40% del precio»
Lo que más impacto tiene en esta actualización no es la mejora de rendimiento del tope de gama Sol, sino más bien la relación precio-rendimiento del intermedio Terra. OpenAI posiciona a Terra como el modelo que «ofrece calidad equivalente a GPT-5.5 a aproximadamente la mitad de precio» (OpenAI).
La misma calidad, un 60% menos de factura
Terra: $2.00
→ un 60% menos
Terra: $12.00
→ un 60% menos
→ sin cifra de reducción publicada; si se cumple, el coste real baja un escalón más
* OpenAI afirma que entrenó GPT-5.6 para «sacar más trabajo útil de cada token», pero no ha publicado una cifra de reducción frente a GPT-5.5. En el lanzamiento el precio unitario era la mitad y, tras la bajada de precios del 30 de julio de 2026, pasó a ser el 40% del de GPT-5.5.
Terra es, por así decirlo, el modelo para el usuario que tenía suficiente con GPT-5.5 pero solo quiere bajar la factura. Si puedes reducir el coste un 60% sin sacrificar calidad, se convierte en el primer destino de migración para muchas cargas de trabajo existentes. La mayoría del trabajo práctico que no persigue el máximo rendimiento se cubre con Terra, no con Sol.
4. Benchmarks: cuánto mejoró de una generación a otra
Al observar la mejora entre generaciones, hay que tener en cuenta que aquello cuya versión de benchmark ha cambiado no admite una comparación directa. Aquí separamos «lo que se puede comparar con la misma versión» de «lo que no».
La codificación real sube +6pt entre generaciones
Capacidad de resolver incidencias reales de GitHub. Sube unos 6 puntos entre generaciones (fuente: OpenAI)
En SWE-Bench Pro, con la misma métrica, sube unos 6 puntos: del 58.6% de GPT-5.5 al 64.6% de Sol. La capacidad de corrección en codificación de nivel producción real ha mejorado de forma constante. No obstante, conviene recordar que ambas cifras proceden de anuncios distintos de OpenAI: en la tabla de evaluación publicada con GPT-5.6, GPT-5.5 figura con un 59.4% (una diferencia de unos 5 puntos).
⚠️ Precauciones al comparar
- TerminalBench: el 82.7% de GPT-5.5 en su lanzamiento es con la versión 2.0, y el 88.8% de GPT-5.6 Sol con la 2.1, así que no se pueden restar directamente. En la tabla de evaluación de GPT-5.6, que mide ambos en la 2.1, GPT-5.5 obtiene 85.6% (unos 3 puntos de diferencia).
- GPQA, FrontierMath: figuran en la tabla de evaluación de GPT-5.6. En GPQA Diamond, Sol obtiene 94.6% frente al 93.6% de GPT-5.5; en FrontierMath Tier 1–3, 89% frente a 85.3%. Están cerca del techo, así que la mejora es pequeña. AIME y MMLU no aparecen.
Esta vez OpenAI puso en primer plano nuevas métricas de agentes (Agents' Last Exam 53.6, Coding Agent Index 80, etc.). En razonamiento general, GPQA Diamond solo varía 1 punto cerca del techo, así que resulta difícil medir «cuánto más inteligente se ha vuelto entre generaciones» con los benchmarks tradicionales.
5. Novedades añadidas en la 5.6
- Esquema de 3 modelos (Luna/Terra/Sol): elegibles según uso y coste. El mayor cambio.
- Programmatic Tool Calling: una nueva función en la que el modelo genera JavaScript para orquestar las llamadas a herramientas (Responses API). Ejecuta agentes complejos con menos idas y vueltas.
- Se añade «max» al effort de razonamiento: además de none/low/medium/high/xhigh, ahora hay 6 niveles con max.
- ChatGPT Work: un agente para el ámbito laboral. La aplicación de Codex se integró en la nueva aplicación de escritorio de ChatGPT.
- GPT-Live (voz full-dúplex): conversación de voz natural interrumpible, sin turnos.
- Compatibilidad con GitHub Copilot: Sol/Terra/Luna pueden seleccionarse en Copilot.
- Actualización del corte de conocimiento: de diciembre de 2025 al 16 de febrero de 2026.
6. Coste real: cómo cambia la factura al actualizar
El impacto en el coste de migrar a Terra es grande. Si comparamos, por ejemplo, una carga de trabajo de 100M de tokens de entrada y 20M de tokens de salida al mes:
Entrada 100M×$5 + salida 20M×$30
Entrada 100M×$2 + salida 20M×$12. Si mejora la eficiencia de tokens, puede bajar aún más
Solo por el precio unitario, la factura se reduce en torno a un 60%. Además, OpenAI afirma que GPT-5.6 termina el trabajo con menos tokens; si es así, el ahorro real puede superar la diferencia de precio unitario (no se ha publicado una cifra de reducción). Para las cargas de trabajo a las que les basta con calidad equivalente a GPT-5.5, migrar a Terra es una reducción de coste casi pura.
* Lo anterior es una estimación basada en el precio unitario. La factura real varía según la longitud del prompt, el uso de caché y el volumen de salida. Se recomienda medirlo con tus propias solicitudes representativas.
7. ¿Conviene migrar? A qué modelo cambiar
| Cómo usas ahora GPT-5.5 | Destino de migración recomendado | Motivo |
|---|---|---|
| La calidad es suficiente, quiero bajar el coste | Terra | Calidad tipo 5.5 al 40% del precio. Reducción de coste pura |
| Quiero subir el rendimiento con el mismo presupuesto | Sol | Al mismo precio $5/$30, mejora en SWE-Bench Pro y otros |
| Procesamiento masivo y trabajo ligero, lo más barato posible | Luna | El nuevo nivel más barato, $0.20/$1.20 |
| Usabas GPT-5.5 Pro ($30/$180) | Sol | Mucho más barato que Pro y a menudo suficiente para razonamiento alto del día a día |
| La calidad de la corrección de código es la máxima prioridad | Sol + comparación externa | Para codificación real, los modelos de Claude también son candidatos |
La migración en sí se resuelve cambiando el ID del modelo, y la API es en general compatible. Para muchos usuarios, la solución óptima es un enfoque de dos pasos: «primero bajar a Terra para reducir la factura un 60% y subir a Sol solo los procesos que necesitan rendimiento». Comparado con la era de la 5.5, que era un modelo único, ahora es más fácil ajustar coste y calidad.
Conclusión
- El mayor cambio es la división en 3 modelos: del buque insignia único de GPT-5.5 a 3 modelos por uso: Luna/Terra/Sol.
- Terra es la protagonista: calidad equivalente a GPT-5.5 al 40% del precio ($2/$12). El sucesor real de las cargas de trabajo existentes.
- Sol mejora el rendimiento al mismo precio: manteniendo $5/$30, SWE-Bench Pro 58.6→64.6% (cifras de OpenAI, +6pt).
- La eficiencia también mejora: según OpenAI, logra resultados iguales o mejores con menos tokens (sin cifra de reducción publicada frente a GPT-5.5).
- Precauciones: la versión de TerminalBench cambia entre anuncios (en la misma 2.1, GPT-5.5 obtiene 85.6% y Sol 88.8%). La mejora en razonamiento general, como GPQA, es pequeña.
- La solución óptima de migración: primero reducir la factura un 60% con Terra y subir a Sol solo los procesos que necesitan rendimiento.
FAQ
Q1. Si me cambio desde GPT-5.5, ¿qué modelo elijo?
Depende del uso. Si quieres bajar el coste manteniendo la calidad, Terra (calidad 5.5 al 40% del precio); si quieres subir el rendimiento al mismo precio, Sol; si quieres procesar volumen lo más barato posible, Luna. Para gran parte del trabajo práctico basta con Terra, y el enfoque de dos pasos —subir a Sol solo los procesos que necesitan rendimiento— es lo óptimo.
Q2. ¿De verdad Terra tiene la misma calidad que GPT-5.5?
OpenAI lo posiciona como «calidad equivalente a GPT-5.5 a aproximadamente la mitad de precio». En la tabla de evaluación de GPT-5.6, Terra supera a GPT-5.5 en SWE-Bench Pro (63.4% frente a 59.4%), pero queda ligeramente por debajo en algunos puntos, como GPQA Diamond (92.9% frente a 93.6%). Por su posicionamiento es «el sucesor de los usos a los que bastaba la 5.5». Si te preocupa, lo más seguro es comparar de forma empírica las salidas de Terra y de la 5.5 con tus tareas representativas antes de migrar.
Q3. ¿Cuánto más inteligente se ha vuelto entre generaciones?
En SWE-Bench Pro, con la misma métrica, sube unos 6 puntos: del 58.6% al 64.6% (Sol; ambas cifras de OpenAI). TerminalBench cambió de la versión 2.0 a la 2.1 entre anuncios, pero en la tabla que mide ambos en la 2.1, GPT-5.5 obtiene 85.6% y Sol 88.8%. GPQA Diamond pasa del 93.6% al 94.6%, cerca del techo, así que la mejora es pequeña. La realidad es: «lo que claramente ha mejorado es la codificación real y el trabajo de agentes; el razonamiento general está casi plano».
Q4. ¿Cuánto baja realmente el coste?
Al migrar a Terra, el precio unitario queda en torno al 40% del de GPT-5.5. Con 100M de entrada y 20M de salida al mes, la estimación pasa de $1,100 a $440 (tras la bajada de precios del 30 de julio de 2026). OpenAI afirma además que GPT-5.6 termina el trabajo con menos tokens; si es así, el ahorro real puede superar la diferencia de precio unitario (no se ha publicado una cifra de reducción).
Q5. Usaba GPT-5.5 Pro. ¿Cuál es el sucesor?
Para muchos usos basta con Sol ($5/$30; $4/$20 con el precio promocional de tres meses desde el 21 de agosto de 2026). GPT-5.5 Pro costaba $30/$180, una cifra alta, mientras que Sol es mucho más barato y resuelve razonamiento alto. Conviene comprobar con tareas reales si de verdad necesitas algo equivalente a Pro solo para razonamiento de dificultad extrema.
Q6. ¿Mis aplicaciones actuales de GPT-5.5 siguen funcionando tal cual?
La API es en general compatible y puedes migrar cambiando el ID del modelo. Pero, al haber pasado a 3 modelos, si rediseñas qué procesos asignas a Luna/Terra/Sol puedes optimizar coste y calidad. En muchos casos es eficaz partir de Terra.
Q7. ¿En qué se diferencian GPT-5.6 y los modelos de otras empresas (Claude)?
En codificación real (SWE-Bench Pro), los modelos de Claude tienden a ser fuertes (incluso en la tabla de evaluación de OpenAI, Claude Fable 5 obtiene 80% frente al 64.6% de Sol). Para más detalle, consulta las comparativas GPT-5.6 Sol vs Claude Opus 4.8 y vs Claude Fable 5.
Artículos relacionados
- Guía completa del lanzamiento de GPT-5.6 — detalle de los 3 modelos Luna/Terra/Sol
- Guía completa del lanzamiento de GPT-5.5 — detalle del modelo de la generación anterior
- GPT-5.6 Sol vs Claude Opus 4.8: comparativa a fondo — comparación con el buque insignia de otra empresa en aquel momento
- GPT-5.6 Sol vs Claude Fable 5: comparativa a fondo — duelo de topes de gama