Diario TI

OpenAI recorta hasta 80% los precios de GPT-5.6 Luna y Terra

OpenAI redujo 80% el precio de GPT-5.6 Luna y 20% el de Terra en su API. La empresa también sustituyó Priority Processing por una modalidad más rápida para GPT-5.6 Sol.

OpenAI anunció el 30 de julio de 2026 una reducción de las tarifas de dos modelos de la familia GPT-5.6. La rebaja alcanza 80% para Luna, orientado a cargas de gran volumen y sensibles al costo, y 20% para Terra, presentado como una alternativa intermedia entre capacidad y precio.

GPT-5.6 Luna pasa de 1 dólar a 0,20 dólares por millón de tokens de entrada y de 6 dólares a 1,20 dólares por millón de tokens de salida. La entrada almacenada en caché cuesta ahora 0,02 dólares por millón de tokens.

    En el caso de GPT-5.6 Terra, la tarifa de entrada baja de 2,50 a 2 dólares por millón de tokens. La salida pasa de 15 a 12 dólares y la entrada almacenada en caché queda en 0,20 dólares.

    Condiciones que afectan el costo final

    Las tarifas básicas no cubren necesariamente todo el costo de una aplicación. La documentación de OpenAI indica que las solicitudes con más de 272.000 tokens de entrada se facturan al doble de la tarifa de entrada y a 1,5 veces la tarifa de salida. Las escrituras en caché se cobran a 1,25 veces el precio de entrada sin caché. El uso de determinadas herramientas también puede generar cargos por llamada.

    Por ello, la reducción nominal debe evaluarse junto con la longitud de los contextos, la cantidad de tokens generados, el aprovechamiento de la caché y el número de llamadas necesarias para completar cada tarea. En una aplicación empresarial, el indicador más útil sigue siendo el costo de obtener un resultado aceptable, no solo el precio unitario de los tokens.

    Una modalidad más rápida para GPT-5.6 Sol

    OpenAI también introdujo Fast mode para GPT-5.6 Sol en la API. Esta modalidad reemplaza a Priority Processing y, según la compañía, puede entregar respuestas hasta 2,5 veces más rápido que el procesamiento estándar, a cambio de duplicar el precio. Las solicitudes existentes identificadas como priority serán dirigidas automáticamente a Fast mode.

    El precio base de GPT-5.6 Sol no cambia. La modalidad rápida está pensada para cargas en las que la latencia tiene mayor importancia que el costo, mientras que Luna y Terra cubren escenarios donde se prioriza el procesamiento económico de un mayor volumen de trabajo.

    Efectos en ChatGPT Work y Codex

    Terra y Luna continúan disponibles en ChatGPT Work, Codex y la API de OpenAI. La compañía mantuvo sin cambios los precios de las suscripciones y sus presupuestos de uso, pero indicó que las operaciones realizadas con estos dos modelos consumirán menos créditos.

    OpenAI atribuye las rebajas a mejoras en los modelos, el software de inferencia, la gestión del contexto y la infraestructura. La empresa afirma que trabajos realizados con GPT-5.6 Sol redujeron 20% el costo integral de servir el modelo y elevaron en más de 15% la eficiencia de generación de tokens. Estas cifras proceden de mediciones internas de OpenAI y no equivalen a una auditoría independiente.

    Fuentes

    📬 Newsletter gratuito

    Últimos artículos