Índice
- 1. El planteamiento: 2.5 veces el precio unitario, un tercio de los tokens
- 2. ¿Quién dijo en realidad que con low basta?
- 3. Las cifras medidas, esfuerzo por esfuerzo
- 4. Por qué los totales acaban igualados
- 5. Velocidad: una cuarta parte de la espera
- 6. El día en que cambia la premisa: el precio promocional de Sol
- 7. En programación la diferencia se estrecha
- 8. Mídelo en tu propio trabajo
- Preguntas frecuentes
Un modelo más nuevo es más listo pero más caro: así solemos razonarlo. Con GPT-6 Astra y GPT-5.6 Sol, sin embargo, comparar precios unitarios no resuelve nada, porque Astra termina el mismo trabajo con menos tokens.
Empezamos por la conclusión. En las mediciones de Artificial Analysis, una firma independiente de evaluación, ejecutar Astra en su ajuste más flojo, low, cuesta por tarea casi exactamente lo mismo que Sol en high ($0.82 frente a $0.81), y además puntúa más alto (46 frente a 42). Gasta un tercio de los tokens de salida y la espera hasta que arranca la respuesta es una cuarta parte.
Ahora bien, ese «casi exactamente» se apoya en una premisa con fecha de caducidad. Sol está ahora mismo en precio promocional y, si se cumple lo anunciado, ese precio termina a finales de noviembre de 2026 y puede volver a subir. Partiendo de las mediciones de Artificial Analysis y de la información oficial de OpenAI a 18 de septiembre de 2026, en este artículo repasamos el coste, los tokens y la velocidad en cada nivel de esfuerzo de razonamiento, qué pinta tienen las cifras cuando cambie la premisa y cómo se comporta la diferencia en programación.
Astra (low) y Sol (high) medidos con la misma vara
Artificial Analysis Intelligence Index, por tarea (a 18 de septiembre de 2026)
Coste
$0.82 frente a $0.81
Empate. El precio unitario es 2.5 veces mayor y aun así los totales se igualan
Tokens de salida
4,000 frente a 13,000
Astra llega a la respuesta con alrededor de un tercio
Espera hasta que arranca la respuesta
2.7 s frente a 11.9 s
Menos tiempo dándole vueltas. Esto es lo que se nota
Intelligence Index
46 frente a 42
Astra en su ajuste más flojo supera a Sol en uno fuerte
Fuente: Artificial Analysis, «GPT-6 Astra (low) vs GPT-5.6 Sol (high)». Los costes están calculados con el precio promocional de Sol ($4/$20)
1. El planteamiento: 2.5 veces el precio unitario, un tercio de los tokens
Si te quedas en el precio unitario, Astra es sin duda el modelo caro.
| Modelo | Entrada (por millón de tokens) | Entrada en caché | Salida (por millón de tokens) |
|---|---|---|---|
| GPT-6 Astra | $10.00 | $1.00 | $50.00 |
| GPT-5.6 Sol (precio promocional, 3 meses desde el 21 de agosto de 2026) | $4.00 | $0.40 | $20.00 |
| GPT-5.6 Sol (precio anterior a la promoción) | $5.00 | $0.50 | $30.00 |
Fuentes: documentación para desarrolladores de OpenAI, «GPT-6 Astra», anuncio de la bajada de precios en la comunidad de desarrolladores de OpenAI (21 de agosto de 2026)
Frente al precio promocional, el precio unitario de Astra es 2.5 veces mayor en entrada y 2.5 veces mayor también en salida. Si juzgas solo por ahí, el asunto se cierra con un «demasiado caro para molestarse».
Lo que se te factura, en cambio, es el precio unitario multiplicado por los tokens realmente gastados. Un modelo de razonamiento piensa antes de responder, y ese pensamiento también se factura como tokens de salida, así que un modelo que llega a la respuesta correcta pensando menos puede salir más barato en total aunque su precio unitario sea más alto. Esa es la pregunta que se propone responder este artículo.
2. ¿Quién dijo en realidad que con low basta?
Todo empezó con una afirmación: Astra en low es mejor que Sol en high. Veamos de dónde salió.
El origen es una publicación que un empleado de OpenAI (Tibo) hizo en X (antes Twitter) el 6 de septiembre de 2026. En la comunidad de desarrolladores de OpenAI, alguien del lado de OpenAI lo repite también y escribe que la recomendación de OpenAI es tratar GPT-6-Astra con razonamiento low como el sustituto de GPT-5.6-Sol en esfuerzo alto.
🟡 Dicho eso, esto es una orientación dada en una publicación, no algo garantizado como especificación. La documentación para desarrolladores de OpenAI no contiene ninguna comparación entre un esfuerzo y otro ni afirmación alguna sobre eficiencia en tokens (lo hemos comprobado). Lo que sí indica es que hay cinco niveles de esfuerzo de razonamiento (low / medium / high / xhigh / max), además de los precios y los límites. Tómatelo como una regla aproximada y compruébalo en tu propio trabajo.
Es decir, respaldar el «con low basta» exige una medición independiente.
3. Las cifras medidas, esfuerzo por esfuerzo
Artificial Analysis ejecuta su Intelligence Index, un paquete de varios benchmarks, en cada nivel de esfuerzo de razonamiento, y publica el coste por tarea y el número de tokens de salida junto con la puntuación. Estas son las cifras a 18 de septiembre de 2026.
| Modelo y esfuerzo | Intelligence Index | Coste por tarea | Tokens de salida | Tiempo hasta el primer token | Velocidad de generación |
|---|---|---|---|---|---|
| Astra low | 46 | $0.82 | 4,000 | 2.74 segundos | 49 tok/s |
| Astra medium | 50 | $1.54 | 10,000 | 4.46 segundos | 46 tok/s |
| Astra high | 51 | $1.72 | 12,000 | 47.76 segundos | 46 tok/s |
| Astra xhigh | 53 | $2.31 | 17,000 | 154.86 segundos | 49 tok/s |
| Astra max | 53 | $3.26 | 27,000 | 300.45 segundos | 52.6 tok/s |
| Sol medium | 39 | $0.50 | 8,000 | 4.74 segundos | 60 tok/s |
| Sol high | 42 | $0.81 | 13,000 | 11.91 segundos | 60 tok/s |
| Sol xhigh | 44 | $1.18 | 20,000 | 40.15 segundos | 66 tok/s |
| Sol max | 47 | $1.99 | — | 129.63 segundos | 61.7 tok/s |
Fuentes: las páginas de comparación de modelos de Artificial Analysis (low frente a high, medium frente a high, high frente a high, xhigh frente a xhigh, low frente a medium) y la página del modelo Sol. Los costes están calculados con el precio promocional de Sol. Las cifras de tokens de salida son los valores mostrados redondeados a millares, y engloban la respuesta y el razonamiento juntos. La cifra de tokens de salida de Sol max se omite porque no hemos podido fijar su valor en el gráfico
De aquí salen tres cosas.
- Astra en low se impone tanto a Sol high como a Sol xhigh. Cuesta más o menos lo mismo que Sol high (42 puntos, $0.81) y puntúa 4 puntos más, y puntúa 2 puntos por encima de Sol xhigh (44 puntos, $1.18) costando un 30 por ciento menos. Eso sí, no es más barato que Sol medium (39 puntos, $0.50), de modo que esa comparación se reduce a si 7 puntos más valen $0.32
- Astra se encarece deprisa a medida que sube el esfuerzo. $1.54 en medium (unas 1.9 veces Sol high) y $3.26 en max (unas 4 veces). La puntuación solo sube 7 puntos, de 46 a 53
- El único ajuste de Sol que puntúa por encima del low de Astra es max. Por esos 47 puntos cuesta $1.99, es decir, 2.4 veces más
4. Por qué los totales acaban igualados
La razón de que un precio unitario 2.5 veces mayor acabe en el mismo total es que gasta un tercio de los tokens. Basta una multiplicación sencilla para comprobarlo.
| Desglose | Astra low | Sol high |
|---|---|---|
| Tokens de salida (por tarea) | 4,000 | 13,000 |
| Precio unitario de salida (por millón de tokens) | $50.00 | $20.00 |
| Coste de la parte de salida (a partir de los valores mostrados) | unos $0.20 | unos $0.26 |
| Total por tarea (entrada y caché incluidas) | $0.82 | $0.81 |
Fuentes: el coste de la parte de salida es un cálculo propio a partir de los recuentos de tokens de arriba y de los precios unitarios oficiales (4,000 x $50 / 1,000,000 = $0.20). Los recuentos de tokens están redondeados a millares, así que este cálculo también es aproximado. Artificial Analysis publica además un gráfico que reparte el coste por tipo de token (respuesta, razonamiento, caché, entrada), pero los valores que conseguimos leer variaban, de modo que aquí la comparación se hace con los totales y con las cifras de tokens mostradas. Los totales son las cifras que publica Artificial Analysis
Si miras solo la salida, la cosa se da la vuelta: incluso con un precio unitario 2.5 veces mayor, Astra paga menos ($0.20 frente a $0.26). Los totales quedan igualados porque el precio unitario más alto de Astra muerde después en la entrada y la caché restantes.
De ahí sale una regla práctica. Cuanto más corta sea la entrada y más domine el trabajo la parte de pensar, mejor le va a Astra en low; cuanto más contexto le hagas leer en cada ocasión, peor. Cómo se comporta el contexto lo tratamos en ¿Qué es el contexto de la IA? La realidad de «lee, pero no lee» en la era del millón de tokens.
5. Velocidad: una cuarta parte de la espera
Si el coste está empatado, lo siguiente es la velocidad. Sol genera más rápido por token (60 frente a 49 tok/s) y, sin embargo, el tiempo hasta tener la respuesta completa es menor con Astra low. El motivo es el tiempo de pensar (la espera hasta el primer token) y la diferencia en cuántos tokens se emiten.
| Modelo y esfuerzo | Tiempo hasta el primer token | Tiempo de generación (medido) | Total |
|---|---|---|---|
| Astra low | 2.74 segundos | 91.69 segundos | unos 94 segundos |
| Astra medium | 4.46 segundos | 209.95 segundos | unos 214 segundos |
| Sol high | 11.91 segundos | 219.90 segundos | unos 232 segundos |
| Sol xhigh | 40.15 segundos | 296.86 segundos | unos 337 segundos |
| Astra max | 300.45 segundos | 522.00 segundos | unos 822 segundos |
Fuente: mediciones de Artificial Analysis (el tiempo hasta el primer token y el tiempo de generación por tarea). Los totales son una suma propia. La métrica de tiempo de generación está definida de forma que excluye la espera hasta el primer token, y por eso se pueden sumar sin más. Conviene tener en cuenta, eso sí, que el tiempo de espera y la velocidad proceden de una prueba aparte que emite 500 tokens, mientras que el tiempo de generación es la media por tarea del índice, así que las dos mediciones tienen orígenes distintos
Astra low termina en torno a 1/2.5 del tiempo que necesita Sol high. Si en cambio lo subes a max, esperarás cinco minutos a que aparezca el primer carácter (300.45 segundos). En uso conversacional, esa diferencia de espera se nota más que el coste.
6. El día en que cambia la premisa: el precio promocional de Sol
La «casi paridad» de todo lo anterior solo se sostiene con el precio promocional de Sol. El 21 de agosto de 2026 OpenAI anunció que «bajaba más de un 20% el precio de la API y de los créditos de GPT-5.6 Sol durante los próximos 3 meses» (entrada de $5 a $4, entrada en caché de $0.50 a $0.40, salida de $30 a $20; se aplica también a los créditos de ChatGPT Work y de Codex). Si se cumple lo anunciado, es un precio por tiempo limitado que llega hasta finales de noviembre de 2026.
🟡 De OpenAI no ha salido ni una declaración que nombre la fecha de finalización ni el precio que vendrá después. En ese mismo hilo, un usuario escribe «al menos hasta el 21 de noviembre de 2026» y afirma que las bajadas de Terra y Luna (Terra de $2.50 a $2.00 y de $15 a $12, Luna de $1.00 a $0.20 y de $6.00 a $1.20, en vigor desde el 30 de julio de 2026) son permanentes, pero eso es la publicación de un usuario, no el anuncio de OpenAI.
Supongamos que vuelve a los $5/$30 originales: la entrada y la caché suben 1.25 veces y la salida sube 1.5 veces. De una tarea de Sol high ($0.81), unos $0.26 son la parte de salida, así que con el resto a 1.25 veces y la salida a 1.5 veces el total sale en torno a $1.08. Si tomas los dos extremos, todo cargado a la entrada o todo a la salida, se queda dentro de una franja de $1.01 a $1.22. En cualquier caso, Astra low ($0.82) resulta entre un 20 y un 30 por ciento más barato.
Ahora mismo (promoción en marcha)
El coste está empatado
Astra low $0.82 / Sol high $0.81. En puntuación y velocidad, Astra low lleva ventaja.
Cuando acabe la promoción (si vuelve al precio anterior)
Astra low es entre un 20 y un 30 por ciento más barato
Sol high sube a unos $1.08 ($1.01 a $1.22 si tomas los extremos). Astra low se queda en $0.82.
La decisión
Cambiarse ahora difícilmente sale mal
Los precios se mueven a favor de Astra. Aun así, mídelo en tu propio trabajo antes de decidir.
7. En programación la diferencia se estrecha
Todo lo anterior se refiere al Intelligence Index, la puntuación global. En el índice que mide el trabajo de agentes de programación, la diferencia de precio se estrecha.
En el índice global, con el esfuerzo máximo por ambas partes, Astra ($3.26) es alrededor de un 60 por ciento más caro que Sol ($1.99). En el índice de agentes de programación, en cambio, Astra sale a $7.09 por tarea, solo un 15 por ciento más que Sol. Las puntuaciones son 62 frente a 55, con Astra 7 puntos por delante, y los tokens son un tercio. La programación, dicho de otro modo, es un terreno relativamente favorable para Astra.
Eso sí, 🟡 el índice de programación no publica los costes en los esfuerzos más bajos. La pregunta misma de la que trata este artículo, si con low basta, está sin verificar en programación. Quédate con la regla aproximada que sí respalda el índice global, «una ganga si basta con un esfuerzo flojo, un sobreprecio en cuanto lo subes al máximo», y mídelo en tu propio agente.
Fuente: Artificial Analysis, «Benchmarking GPT-6 Astra» (Coding Agent Index, comparado en esfuerzo max. Publicado el 9 de septiembre de 2026)
Por cierto, hay otras dos condiciones que disparan la factura de Astra. Por encima de 272,000 tokens de entrada, la entrada y la caché se duplican y la salida sube 1.5 veces. En sentido contrario, Batch y Flex cuestan la mitad, y Fast el doble. Si tu patrón consiste en entregar entero un documento largo cada vez, ese recargo es el que te va a golpear.
8. Mídelo en tu propio trabajo
Todas las cifras de arriba se han medido sobre un surtido de benchmarks. Tu trabajo está hecho de otra cosa. Decide solo después de medir con tareas que representen lo que de verdad haces. Tres pasos.
- Pasa la misma petición por los dos ajustes: pon Astra en
lowy Sol enhigh, y envía las mismas entradas de 5 a 10 veces cada una. Con una sola ejecución, una petición que casualmente estuvo pensando mucho rato te arrastra el resultado - Mira las cifras de la respuesta, no la factura: registra los recuentos de tokens que trae la respuesta (entrada, salida, razonamiento). Multiplica por el precio unitario y tienes el coste por petición. Lo básico de los precios de las API está recogido en ¿Qué es una API de IA? Guía para principiantes sobre precios, tokens y elección de modelo
- Cuenta también los reintentos: si el modelo barato no termina a la primera y lo lanzas dos veces, el coste real es el doble. Compara el coste como «el total hasta terminar el trabajo», no como «el precio de una llamada»
Preguntas frecuentes
Q1. ¿El low de Astra equivale en fuerza al low de Sol?
No. Los nombres de los esfuerzos son ajustes propios de cada modelo, no una escala compartida. En las mediciones, Astra low (46 puntos) queda por encima del segundo ajuste más alto de Sol, xhigh (44 puntos). Compara por puntuación y coste, no por el nombre.
Q2. ¿Por qué esfuerzo debería empezar?
Empezar por low e ir subiendo es la opción segura. El coste de Astra sube de forma pronunciada con el esfuerzo: unas 1.9 veces Sol high en medium y unas 4 veces en max. La puntuación solo se mueve 7 puntos, de 46 a 53, así que cuanto más lo subes, menos compensa.
Q3. ¿Debería cambiarme cuando acabe el precio promocional?
Los precios se mueven a favor de Astra. Si vuelven los $5/$30 originales, Sol high se sitúa entre $1.01 y $1.22 y Astra low ($0.82) sale entre un 20 y un 30 por ciento más barato. Dicho esto, 🟡 el precio posterior a la promoción no se ha publicado.
Q4. Si gasta un tercio de los tokens, ¿ayuda eso en los planes con límites de uso?
En la facturación por consumo de la API, sí. Pero no hay nada publicado que diga que el límite de uso de una suscripción se consuma en proporción al número de tokens. Comprueba cómo lo trata tu plan al margen de la cuestión de los precios.
Q5. ¿A qué fecha corresponden estas cifras?
Las mediciones de este artículo son las que Artificial Analysis publicaba a 18 de septiembre de 2026. Tanto los precios como los resultados por esfuerzo se actualizan, así que consulta los valores actuales en las páginas de las fuentes antes de decidir.
Fuentes
- Artificial Analysis — GPT-6 Astra (low) vs GPT-5.6 Sol (high) (coste, tokens, velocidad, tiempo de espera)
- Del mismo sitio — Astra (medium) vs Sol (high), Astra (high) vs Sol (high), Astra (xhigh) vs Sol (xhigh), Astra (low) vs Sol (medium)
- Artificial Analysis — GPT-5.6 Sol (coste y velocidad en max)
- Artificial Analysis, «Benchmarking GPT-6 Astra» (Coding Agent Index, cómo se alinean los costes entre esfuerzos)
- Documentación para desarrolladores de OpenAI — GPT-6 Astra (precios unitarios, los cinco niveles de esfuerzo de razonamiento, el recargo por encima de 272K, Batch/Flex/Fast, contexto)
- Comunidad de desarrolladores de OpenAI — la bajada del 20% de GPT-5.6 Sol (21 de agosto de 2026) (el precio promocional y su plazo, las bajadas permanentes de Terra y Luna)
- Comunidad de desarrolladores de OpenAI — Astra low/medium como sustituto de Sol high (la recomendación, presentada como declaración de un empleado)
Artículos relacionados
- Lanzamiento de GPT-6 Astra: la guía completa — qué ha cambiado y qué planes pueden usarlo
- Lanzamiento de GPT-5.6: la guía completa (Luna/Terra/Sol) — dónde se sitúan los tres modelos
- Claude Opus 5: en qué se diferencia de Opus 4.8 y Fable 5 — la otra opción sobre la mesa
- ¿Qué es una API de IA? — lo básico de precios y tokens
- ¿Qué es el contexto de la IA? — el coste que muerde más cuanto más larga es la entrada