Modelos y plataformas de IA
OpenAI reduce los precios de la API en sus dos niveles más asequibles de GPT-5.6

OpenAI redujo el precio de la API de sus dos modelos GPT-5.6 de menor costo el 30 de julio de 2026, reduciendo el nivel más barato en un 80% y el nivel medio en un 20%, mientras que dejó sin cambios su modelo insignia. El cambio se registra en el registro de cambios de la API de la empresa y ya está disponible en la tarjeta de precios publicada.
Por millón de tokens de entrada y salida, las tarifas estándar ahora son:
- GPT-5.6 Luna: 20 centavos y $1.20, reducidos desde $1 y $6
- GPT-5.6 Terra: $2 y $12, reducidos desde $2.50 y $15
- GPT-5.6 Sol: $5 y $30, sin cambios, igualando la tarifa que su predecesor GPT-5.5 aún mantiene
Los tres niveles alcanzaron la disponibilidad general el 9 de julio de 2026 a los precios más altos, lo que sitúa el recorte de precios tres semanas después de la vida comercial de la familia.
Los recortes se aplican a todos los niveles de servicio en la hoja, no solo a la tarifa principal. El procesamiento por lotes y Flex, ambos a la mitad del precio estándar, ahora sitúan a Luna en 10 centavos de entrada y 60 centavos de salida. Las lecturas de entrada en caché, con un descuento del 90%, bajan a dos centavos por millón de tokens en Luna y 20 centavos en Terra. Las solicitudes de contexto largo, que se facturan al doble de la tarifa de entrada y 1,5 veces la tarifa de salida, llegan a 40 centavos y $1.80 para Luna. Los compradores que pasan por Amazon Bedrock son facturados por AWS, y OpenAI señala que esas tarifas pueden diferir de las suyas.
Los niveles más baratos son donde viven los tráficos de producción de alto volumen: clasificación, extracción, enrutamiento de solicitudes, borrador de primer paso y los bucles de agente largos donde una instrucción del usuario puede desencadenar docenas de llamadas al modelo antes de que se devuelva una respuesta. Un recorte de cinco veces en el nivel que absorbe ese volumen cambia la aritmética sobre qué cargas de trabajo vale la pena automatizar.
Dónde se sitúan los niveles más baratos en comparación con Claude
A 20 centavos de entrada y $1.20 de salida, Luna supera al modelo más barato publicado de Anthropic, Haiku 4.5, por un factor de cinco en la entrada y aproximadamente cuatro en la salida, según la página de precios de Anthropic. La nueva tarifa de Terra se sitúa por debajo de los $3 y $15 que Claude Sonnet 5 está programado para cobrar una vez que su tarifa de introducción de $2 y $10 expire el 31 de agosto de 2026. En la parte superior de ambas líneas, Sol todavía cuesta más en salida que Opus 5, que Anthropic factura a $5 y $25.
El procesamiento de prioridad se convierte en modo rápido
La misma entrada de registro de cambios retira el procesamiento de prioridad y lo reemplaza con el modo rápido. Para Sol, OpenAI dice que el modo rápido se ejecuta hasta 2,5 veces más rápido que la velocidad estándar al doble del precio, y el cambio es compatible con versiones anteriores: las solicitudes ya etiquetadas para prioridad se enrutan al modo rápido sin un cambio de código. Las tarifas del modo rápido son $10 y $60 para Sol, $4 y $24 para Terra, y 40 centavos y $2.40 para Luna.
Anthropic vende el mismo producto con el mismo nombre y los mismos términos — modo rápido para Opus 5, hasta 2,5 veces más rápido al doble del precio estándar. Las dos tarjetas de precios ahora convergen en la inferencia fijada a la región. OpenAI cobra un aumento del 10% en los modelos lanzados el 5 de marzo de 2026 o posteriormente cuando un cliente requiere residencia de datos; Anthropic factura la inferencia solo en EE. UU. a 1,1 veces su tarifa estándar.
Qué hizo que los niveles más baratos fueran más baratos
OpenAI publicó su contabilidad un día antes del recorte. En una publicación de ingeniería del 29 de julio de 2026, cinco miembros de su personal técnico describieron optimizaciones en la inferencia y el arnés de agente detrás de Codex y ChatGPT Work. Sol, que se ejecuta dentro de Codex, reescribió los kernels de GPU de producción de la empresa; combinado con un trabajo de kernel más amplio, OpenAI dice que eso redujo los costos de servicio de extremo a extremo en un 20%. Sol también rediseñó su propio modelo de borrador de decodificación especulativa a través de cientos de experimentos, lo que la empresa atribuye a una mayor eficiencia en la generación de tokens del 15%.
Esas son las cifras propias de OpenAI para su propia pila. La publicación concluyó con un compromiso de transmitir “mejoras bajo el capó a nuestros usuarios y clientes en forma de inteligencia más accesible y rentable”. La tarjeta de precios siguió al día siguiente.
El trabajo del arnés apunta al mismo centro de costo que el recorte de precios. OpenAI limita la salida de herramientas a 10,000 tokens por defecto y mantiene la historia del modelo visible de solo anexión, por lo que un bucle de agente que vuelve a enviar sus instrucciones y definiciones de herramientas en cada paso golpea la caché de prompts en lugar de pagar las tarifas de entrada completas. En una tarea que requiere 30 solicitudes de modelo, eso son 30 oportunidades para evitar volver a calcular el mismo prefijo.
Los recortes llegan mientras los compradores están auditando el gasto de inferencia y ampliando qué equipos tocan los modelos: la propia investigación de OpenAI encontró que el personal usa ChatGPT más allá de sus títulos de trabajo. La organización de ingeniería de Amazon se movió para limitar el gasto en IA después de desbordamientos de costos el mismo día, y OpenAI envió límites de gasto duros para organizaciones y proyectos de API el 22 de julio de 2026, lo que permite a los administradores establecer un techo mensual que comienza a devolver errores una vez que se alcanza el gasto rastreado.
Para un equipo que ya está enrutando trabajo a granel a Luna, las mismas llamadas ahora cuestan una quinta parte de lo que costaban, con un techo que pueden establecer en el panel de control. Con el precio de Sol sin cambios, la decisión en vivo permanece donde OpenAI lo ha puesto desde que la familia se envió: qué nivel requiere cada solicitud.












