OpenAI baja el precio de GPT-5.6 Sol por tiempo limitado, el output cae un tercio

El 21 de agosto, OpenAI bajó los precios de llamada de la API de GPT-5.6 Sol: el input pasó de 5 a 4 dólares por millón de tokens, el output de 30 a 20 dólares, y el input en caché de 0,5 a 0,4 dólares. El nuevo precio rige durante tres meses, hasta el 21 de noviembre.

El alcance quedó bien definido. Las llamadas a la API se cobran al nuevo precio, y los créditos consumidos en ChatGPT Work y Codex también bajan junto con ellas. Las cuotas mensuales de los planes Pro, Plus y Business no cambian. La razón que da OpenAI es que la capacidad de los modelos sigue avanzando al tiempo que mejora la eficiencia, y parte de ese ahorro se traslada al usuario.

Haciendo cuentas con el uso real

El discurso oficial habla de "más del 20%", pero la rebaja no es igual en las tres franjas de precio: el input baja 20%, el input en caché baja 20%, y el output baja un tercio. La franja más castigada es la del output, y cuánto se ahorra realmente depende de la forma de la carga de trabajo.

Un cálculo rápido para un agente de programación. Este tipo de tarea suele tener mucho input y poco output, y como se relee repetidamente el mismo contexto de código, la tasa de acierto de caché es alta. Supongamos una tarea que consume 1 millón de tokens de input y 100 mil de output, con un 80% del input viniendo de caché: al precio antiguo eso da 0,2×5 + 0,8×0,5 + 0,1×30 = 4,4 dólares; al precio nuevo, 0,8 + 0,32 + 2 = 3,12 dólares, un ahorro de aproximadamente 29%.

En cargas con mayor proporción de output, como conversaciones o generación de textos largos, el ahorro sube todavía más, acercándose al tercio de rebaja del output. En cambio, en consultas cortas de tipo búsqueda pura, con un output de apenas unos cientos de tokens, el ahorro queda prácticamente limitado al 20% del input. El mismo anuncio puede traducirse en diferencias de más de diez puntos porcentuales según el producto.

Posición ahora por debajo de Opus 5

Tras la rebaja, la posición de Sol en la tabla de precios cambió. Claude Fable 5, de Anthropic, cobra 10 dólares de input y 50 de output por millón de tokens, mientras que Opus 5 cobra 5 y 25 dólares. El antiguo precio de Sol, 5/30, quedaba un poco por encima de Opus 5; el nuevo, 4/20, ahora cae en conjunto por debajo.

La disputa en este segmento es directa. Los desarrolladores dispuestos a pagar por un modelo insignia suelen ser quienes integran el modelo en asistentes de programación, sistemas de atención al cliente o pipelines de agentes que ejecutan tareas largas; la factura se acumula mes a mes, y el incentivo para cambiar depende únicamente del costo por unidad. La presencia de Anthropic en el terreno de la programación, sumada a la presión constante de precios de los modelos chinos en la misma franja, recae sobre este grupo que paga por consumo.

Más allá del precio unitario, hay una cuenta fácil de pasar por alto: el valor absoluto del input en caché. Al bajar a 0,4 dólares, la parte que acierta en caché resulta diez veces más barata que la que no acierta; en escenarios de llamadas repetidas con contexto largo, esa proporción pesa más en la factura mensual que el propio precio de lista. Los equipos que logran mantener bajas sus facturas suelen estar optimizando la tasa de acierto de caché, y el precio de lista queda en segundo plano.

Por qué solo tres meses

Tres meses es una ventana muy corta. La serie GPT-5.6 lanzó tres niveles de una vez a inicios de julio, y a finales de mes Luna y Terra ya habían recibido una rebaja de precio: Luna bajó un 80% y Terra un 20%. Ahora le toca al modelo insignia, y OpenAI ofrece un precio por tiempo limitado, sin modificar la tabla de precios original.

La ventaja de un plazo limitado es dejar una salida: después del 21 de noviembre el precio vuelve automáticamente a 5/30, sin necesidad de anunciar una nueva "subida" y sin tener que contabilizar este descuento como un compromiso financiero de largo plazo. El costo es que los desarrolladores también lo saben, así que cuánta lógica de llamadas reescribirán o cuánto tráfico existente migrarán por un precio con cuenta regresiva sigue siendo una incógnita. Quienes realmente se muden por este precio suelen ser, en su mayoría, los que ya venían comparando precios entre ambos proveedores.

"As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and credit pricing of GPT-5.6 Sol by over 20% for the next 3 months."

Que el precio de las suscripciones no se mueva ni un milímetro también es revelador. La suscripción mensual es un ingreso fijo y predecible, mientras que el lado del consumo es el campo de batalla donde chocan de frente con la competencia. Este descuento cae exactamente sobre la API y los créditos de Codex, es decir, sobre las cuentas capaces de gastar varios miles de dólares al mes y de cambiar la base_url en cualquier momento.

Para los desarrolladores en China, el impacto real depende del canal que usen. Quien accede directamente a la API paga ya el nuevo precio; quien pasa por revendedores o proxies debe esperar a que estos se ajusten, y esa diferencia de precio suele ser justamente el margen de ganancia durante los próximos meses. Solo cuando el precio vuelva a su nivel original tras los tres meses se sabrá si ese mismo volumen de llamadas se traslada junto con él.

Fuentes: comunicado oficial de OpenAI, CocoLoop, aviso de la comunidad de desarrolladores de OpenAI, Reuters; los tres precios de input, output e input en caché de Sol, así como el período de tres meses, se verificaron en la página oficial de precios de OpenAI.