OpenAI abarata GPT-5.6 Luna un 80 % y acelera Sol hasta 2,5 veces en la API

OpenAI ha anunciado una importante actualización de la familia GPT-5.6 centrada en mejorar la relación entre rendimiento y coste. La compañía reduce un 80 % el precio de GPT-5.6 Luna, rebaja un 20 % el de GPT-5.6 Terra e introduce un nuevo Fast mode para GPT-5.6 Sol, que promete hasta 2,5 veces más velocidad que el procesamiento estándar en la API. Según OpenAI, estos cambios son posibles gracias a mejoras internas que han reducido el coste de ejecutar sus modelos.

Las claves de GPT-5.6 en 20 segundos

  • OpenAI reduce un 80 % el precio de GPT-5.6 Luna y un 20 % el de GPT-5.6 Terra.
  • GPT-5.6 Sol incorpora un nuevo modo Fast que acelera la respuesta hasta 2,5 veces.
  • Los precios de las suscripciones a ChatGPT y Codex no cambian.
  • OpenAI atribuye la mejora a avances en inferencia, optimización de modelos y gestión del contexto.
  • La compañía afirma que GPT-5.6 Sol ha contribuido a optimizar parte de la infraestructura que ejecuta los propios modelos.

La actualización refleja un cambio cada vez más evidente en el mercado de la inteligencia artificial generativa. Si durante los últimos años la competencia se centró principalmente en mejorar las capacidades de los modelos, ahora también lo hace en reducir el coste por tarea y aumentar la velocidad de respuesta.

Para empresas que ejecutan millones de consultas diarias, una rebaja de este tipo puede tener un impacto económico mucho mayor que una pequeña mejora en precisión.

Luna y Terra reducen su precio para facilitar despliegues a gran escala

La mayor reducción afecta a GPT-5.6 Luna, el modelo más rápido y económico de la familia, cuyo precio baja un 80 %.

Desde el 30 de julio, el precio en la API pasa a ser de:

ModeloEntradaSalida
GPT-5.6 Luna0,20 dólares por millón de tokens1,20 dólares por millón de tokens
GPT-5.6 Terra2 dólares por millón de tokens12 dólares por millón de tokens

En el caso de GPT-5.6 Terra, OpenAI aplica una reducción del 20 %, manteniéndolo como el modelo orientado a tareas generales y flujos de trabajo cotidianos.

La compañía también ha actualizado el consumo de créditos en ChatGPT Work y Codex, de forma que Luna y Terra utilizan menos cuota dentro de las suscripciones de pago, aunque el precio mensual de estos planes permanece sin cambios.

OpenAI considera que esta rebaja permitirá utilizar inteligencia artificial en procesos donde hasta ahora el coste era un factor limitante, como la clasificación masiva de documentos, la automatización de tareas repetitivas o el análisis de grandes volúmenes de información.

GPT-5.6 Sol incorpora un nuevo modo Fast

La otra gran novedad afecta al modelo más avanzado de la familia.

OpenAI sustituye Priority Processing por Fast mode, una modalidad disponible en la API que ofrece hasta 2,5 veces más velocidad que el procesamiento estándar.

La empresa explica que el nuevo modo mantiene el mismo nivel de inteligencia y calidad de respuesta. La diferencia está en el tiempo necesario para generar el resultado.

El servicio tiene un coste equivalente al doble del procesamiento estándar y está pensado para aplicaciones donde la latencia sea un factor crítico, como asistentes en tiempo real, automatización empresarial o agentes de software.

Los clientes que ya utilizaban Priority Processing no tendrán que modificar sus aplicaciones. Las solicitudes marcadas con esa opción pasarán automáticamente a utilizar Fast mode.

OpenAI atribuye las mejoras a una IA que ayuda a optimizar otra IA

Uno de los aspectos más llamativos del anuncio es la explicación de cómo se han conseguido estas mejoras.

Según OpenAI, parte del trabajo de optimización ha sido realizado utilizando GPT-5.6 Sol dentro de procesos supervisados por ingenieros.

La compañía afirma que el modelo ha participado en tareas como:

  • Reescribir y optimizar kernels de producción.
  • Diseñar y ejecutar cientos de experimentos relacionados con la generación de tokens.
  • Supervisar entrenamientos e intervenir cuando detectaba incidencias.

De acuerdo con OpenAI, estos trabajos permitieron reducir aproximadamente un 20 % el coste de servir GPT-5.6 Sol y aumentar en más de un 15 % la eficiencia en la generación de tokens.

No significa que el modelo haya desarrollado toda la infraestructura de forma autónoma. OpenAI indica expresamente que estas tareas se realizaron dentro de un proceso dirigido por personas.

La compañía considera que este mecanismo crea un ciclo de mejora continua: modelos más capaces ayudan a optimizar la infraestructura que ejecutará las siguientes generaciones de modelos.

Más eficiencia para reducir el coste por tarea

OpenAI insiste en que el objetivo no es únicamente reducir el precio por millón de tokens, sino disminuir el coste real de completar una tarea.

En muchos flujos de trabajo complejos intervienen varios modelos con funciones diferentes. Un ejemplo planteado por la empresa consiste en utilizar GPT-5.6 Sol para analizar un problema, definir una estrategia y resolver las partes más difíciles, mientras GPT-5.6 Luna ejecuta los cambios de código, lanza pruebas automáticas y valida los resultados.

Según OpenAI, esta combinación permite obtener una calidad similar con un coste inferior al de ejecutar todo el proceso utilizando el modelo más avanzado.

La empresa también destaca mejoras internas en el sistema de inferencia, el enrutamiento de peticiones, la gestión del contexto y la utilización del hardware, lo que permitiría generar más resultados útiles utilizando la misma capacidad de cálculo.

La competencia también se traslada al precio

El anuncio llega en un momento en el que prácticamente todos los grandes desarrolladores de modelos fundacionales están reduciendo el coste de sus servicios.

Google, Anthropic, Moonshot AI, DeepSeek y otros proveedores han presentado durante los últimos meses modelos cada vez más económicos o con una mejor relación entre rendimiento y precio.

La reducción del coste de inferencia se está convirtiendo en un factor tan importante como los propios resultados de los benchmarks. Para muchas empresas, el ahorro obtenido al ejecutar millones de consultas puede resultar más determinante que pequeñas diferencias de rendimiento entre modelos de última generación.

Con estas rebajas, OpenAI busca ampliar el número de casos de uso donde resulta rentable incorporar inteligencia artificial, especialmente en procesos empresariales automatizados y aplicaciones que requieren grandes volúmenes de consultas diarias.

Preguntas frecuentes

¿Qué modelos bajan de precio?

OpenAI reduce un 80 % el precio de GPT-5.6 Luna y un 20 % el de GPT-5.6 Terra en la API.

¿Qué es Fast mode?

Es un nuevo modo de procesamiento para GPT-5.6 Sol que sustituye a Priority Processing y ofrece hasta 2,5 veces más velocidad, manteniendo el mismo nivel de inteligencia según OpenAI.

¿Cambian los precios de ChatGPT?

No. OpenAI indica que las suscripciones de ChatGPT y Codex mantienen el mismo precio, aunque Luna y Terra consumen menos créditos dentro de determinados planes.

¿Cómo consiguió OpenAI reducir los costes?

La compañía atribuye la mejora a optimizaciones en sus modelos, en la infraestructura de inferencia y en la gestión del contexto. Además, asegura que GPT-5.6 Sol participó, bajo supervisión humana, en parte del proceso de optimización de los sistemas que ejecutan los propios modelos.

vía: openai

Scroll al inicio