OpenAI baja 80% el precio de GPT-5.6 Luna y 20% el de Terra, y estrena Fast mode en la API
Desde el 30 de julio, GPT-5.6 Luna cuesta 0,20 dólares por millón de tokens de entrada y GPT-5.6 Terra baja a 2 dólares. OpenAI además reemplazó Priority Processing por Fast mode, hasta 2,5 veces más rápido.

La noticia en 30 segundos
El 30 de julio de 2026 OpenAI redujo 80% el precio de GPT-5.6 Luna, que queda en 0,20 dólares por millón de tokens de entrada y 1,20 dólares por millón de salida, y 20% el de GPT-5.6 Terra, ahora en 2 y 12 dólares. También estrenó Fast mode en la API para GPT-5.6 Sol, hasta 2,5 veces más rápido al doble de precio y sin cambio de inteligencia. El precio de Sol no varía. Para equipos comerciales en Chile y Latinoamérica, el costo por tarea deja de ser el freno principal para automatizar trabajo de alto volumen.
OpenAI anunció el jueves 30 de julio de 2026 una baja de precios en dos de los tres modelos de la familia GPT-5.6. La compañía explicó que traspasa a sus clientes las ganancias de eficiencia que obtuvo al hacer más barato servir sus propios modelos.
¿Qué bajó exactamente de precio?
GPT-5.6 Luna, el modelo más rápido y económico de la familia, baja 80% y queda en 0,20 dólares por millón de tokens de entrada y 1,20 dólares por millón de tokens de salida. GPT-5.6 Terra, el modelo equilibrado para trabajo cotidiano, baja 20% y queda en 2 dólares por millón de entrada y 12 por millón de salida. El precio de GPT-5.6 Sol, el modelo de mayor capacidad, no cambia.
Los nuevos precios también se reflejan en cómo se consume la cuota de las suscripciones pagadas en Codex y ChatGPT Work: el valor de los planes no cambia, pero el uso de Terra y Luna descuenta menos créditos. En ChatGPT Work y Codex, los usuarios Free y Go acceden a Terra, mientras que Plus, Pro, Business y Enterprise pueden elegir entre Terra y Luna. OpenAI indicó que el cambio de precios comenzaría a desplegarse en AWS el mismo día.
¿Qué es el Fast mode y a quién le sirve?
OpenAI introdujo Fast mode en la API, que reemplaza a la oferta anterior de Priority Processing. Para GPT-5.6 Sol, Fast mode entrega hasta 2,5 veces más velocidad que el procesamiento estándar al doble de precio, sin cambio en la inteligencia del modelo. Es retrocompatible: las solicitudes etiquetadas como priority pasan automáticamente a Fast mode.
La lectura práctica es de arquitectura de costos: los flujos de alto volumen y baja complejidad se van a Luna, el trabajo cotidiano a Terra, y Sol se reserva para los pasos donde el error es caro, con Fast mode cuando el tiempo de respuesta importa.
¿Por qué OpenAI pudo bajar los precios?
Según la compañía, la eficiencia viene de tres capas: los modelos, los sistemas de inferencia que los ejecutan y el andamiaje agéntico que los conecta con herramientas y contexto. OpenAI detalló que GPT-5.6 Sol, dentro de un proceso liderado por humanos, reescribió y optimizó kernels de producción de forma autónoma y corrió cientos de experimentos: ese trabajo redujo 20% el costo extremo a extremo de servir el modelo y elevó más de 15% la eficiencia de generación de tokens.
La compañía sostiene que Luna entrega un desempeño comparable al de modelos que hace un año eran de frontera, a cerca de 6 centavos por dólar de costo por tarea y a casi nueve veces la velocidad.
¿Qué dicen las empresas que ya lo usan?
OpenAI publicó testimonios de clientes con cifras concretas. Hoda Noorian, de producto de IA en Notion, señaló que Terra «entregó calidad comparable a GPT-5.5 a la mitad del costo por tarea y en 60% menos tiempo». Sid Pardeshi, CTO y cofundador de Blitzy, indicó que con Luna la reutilización de caché de prompts subió de 24% a 90% y que el modelo «maneja 2,2 veces más contexto con 8,5 veces menos tokens de salida, a un costo 87% menor que GPT-5.4 mini». Stanislas Polu, cofundador y CTO de Dust, reportó que ante las mismas tareas agénticas Luna resulta «40% más rápido y 40% más barato» que su modelo por defecto anterior.
Análisis de Revenue Hub
Para un líder comercial en Chile o Latinoamérica, la noticia no es el precio en sí, es que se cae la última excusa técnica para no automatizar. Durante dos años el argumento contra desplegar IA en enriquecimiento de leads, clasificación de conversaciones, resúmenes de llamadas o control de calidad de datos del CRM fue el costo por transacción a escala. Con Luna a 0,20 dólares por millón de tokens de entrada, procesar decenas de miles de registros al mes deja de ser una decisión de presupuesto y pasa a ser una decisión de diseño de proceso.
El riesgo es el opuesto y ya lo estamos viendo en operaciones B2B de la región: cuando el costo se acerca a cero, los equipos automatizan tareas que nunca debieron existir. Antes de mover volumen a un modelo más barato conviene preguntarse qué decisión de negocio mejora ese output y quién la toma. La disciplina que rinde no es elegir el modelo correcto, es enrutar cada paso del flujo al nivel de inteligencia que la tarea realmente necesita, con evaluaciones que midan calidad y no solo ahorro.
La recomendación concreta para quienes ya operan agentes sobre su CRM: revisar el enrutamiento de modelos esta semana, no el próximo trimestre. Un flujo que hoy usa un modelo caro para tareas rutinarias probablemente puede bajar su costo un orden de magnitud sin perder calidad, y ese ahorro financia los casos donde sí se necesita el modelo grande. Si quieres profundizar en cómo estructurar esa capa, revisa nuestras noticias de IA aplicada a ventas y el blog de Revenue Hub.
Fuente y criterio editorial
Revenue Hub resume, contextualiza y analiza esta información para equipos B2B de Chile y Latinoamérica. La publicación original pertenece a OpenAI.
Leer la fuente originalPara profundizar
Preguntas frecuentes
¿Cuánto cuesta GPT-5.6 Luna después de la baja?
Desde el 30 de julio de 2026, GPT-5.6 Luna cuesta 0,20 dólares por millón de tokens de entrada y 1,20 dólares por millón de tokens de salida en la API de OpenAI, un 80% menos que antes.
¿Cuánto cuesta GPT-5.6 Terra ahora?
GPT-5.6 Terra bajó 20% y quedó en 2 dólares por millón de tokens de entrada y 12 dólares por millón de tokens de salida.
¿Bajó también el precio de GPT-5.6 Sol?
No. OpenAI confirmó que el precio de GPT-5.6 Sol permanece sin cambios. Lo que cambió para Sol es la disponibilidad de Fast mode en la API.
¿Qué es Fast mode en la API de OpenAI?
Fast mode reemplaza la oferta de Priority Processing. Para GPT-5.6 Sol entrega hasta 2,5 veces más velocidad que el procesamiento estándar, al doble de precio y sin cambio en la inteligencia del modelo. Es retrocompatible con las solicitudes etiquetadas como priority.
¿Cambia el precio de las suscripciones de ChatGPT o Codex?
No. Los precios de las suscripciones y los presupuestos de cuota se mantienen. Lo que cambia es que el uso de Terra y Luna consume menos créditos dentro de esos planes.
¿Luna o Terra: cuál conviene para un equipo comercial?
Luna conviene para trabajo de alto volumen y baja complejidad, como clasificación de conversaciones, enriquecimiento de registros o generación de resúmenes masivos. Terra conviene para trabajo cotidiano que exige más razonamiento, como redacción de propuestas o análisis de cuentas. La práctica recomendada es enrutar cada paso del flujo al modelo que la tarea realmente necesita.
¿Cómo afecta esta baja de precios a empresas B2B en Chile y Latinoamérica?
Reduce de forma significativa el costo de operar agentes de IA sobre volúmenes grandes de datos comerciales, lo que hace económicamente viables casos de uso que antes no lo eran, como control de calidad continuo del CRM o análisis de todas las conversaciones de venta en lugar de una muestra.
¿Por qué OpenAI pudo reducir tanto los precios?
La compañía atribuye la baja a mejoras de eficiencia en los modelos, en los sistemas de inferencia y en el andamiaje agéntico. Detalló que GPT-5.6 Sol optimizó kernels de producción de forma autónoma, reduciendo 20% el costo extremo a extremo de servir el modelo y elevando más de 15% la eficiencia de generación de tokens.



