GPT-6.1 Sol debuta con un precio de API de una quinta parte del de Astra

OpenAI presentó GPT-6.1 Sol en el DevDay del 29 de septiembre, orientado a agentes de programación, manejo de computadoras y tareas de oficina profesionales. El precio estándar de la API es de 2 dólares por millón de tokens de entrada, 0,10 dólares por tokens de entrada en caché y 10 dólares por tokens de salida, igual que GPT-6 Sol; frente al modelo insignia GPT-6 Astra, con 10, 0,20 y 50 dólares, tanto la entrada como la salida cuestan una quinta parte.

El ritmo de lanzamientos es intenso. GPT-6 Astra salió hace 26 días, y GPT-6 Sol llevaba solo 7 días disponible cuando fue reemplazado por la versión 6.1. Según OpenAI, el nuevo modelo está "cerca de Astra" en programación y manejo de computadoras.

Resultados cercanos al modelo insignia, aunque persiste distancia en algunos rubros

En las cifras publicadas por OpenAI, GPT-6.1 Sol obtuvo 75,2% en DeepSWE v1.1 con el nivel de razonamiento más alto, empatando con Astra pero a una quinta parte del costo. En OSWorld 2.0, con el nivel de razonamiento máximo, logró 71,4%, 2,1 puntos porcentuales por debajo de Astra, con un costo por tarea de aproximadamente una séptima parte. En Terminal-Bench Science 0.1, que evalúa flujos de investigación por línea de comandos, el costo promedio por tarea fue de 5,47 dólares, frente a 23,21 dólares de Claude Opus 5.5 y 23,80 dólares de Astra.

La prueba independiente de Artificial Analysis, un evaluador externo, llegó a conclusiones similares: el índice de inteligencia quedó 4 puntos por encima de GPT-6 Sol y 1 punto por debajo de GPT-6 Astra; en las pruebas de precisión de conocimiento, la tasa de alucinaciones bajó de 60% a 54%. El costo de esto es que el modelo "habla más": para completar la misma tarea usa entre 10% y 30% más tokens de salida. El descuento por lectura en caché subió de 90% a 95%, lo que compensa parte de ese gasto adicional.

No todos los rubros quedan tan cerca. Según los datos que la propia OpenAI publicó, en el ExploitBench interno, Sol obtuvo 21,5% frente a 31,5% de Astra; en TroubleshootingBench, centrado en resolución de fallos, fue 47,96% frente a 63,46%. En escenarios que requieren cadenas largas de diagnóstico, el modelo insignia todavía mantiene una ventaja clara.

Umbral de acceso y algunas restricciones

GPT-6.1 Sol ya está disponible en ChatGPT Work y Codex para usuarios de los planes Plus, Pro, Business, Enterprise y Edu; los usuarios del plan gratuito y de Go todavía no tienen acceso, y tampoco se ha integrado en la interfaz de chat habitual. Los desarrolladores lo invocan como gpt-6.1-sol, con una ventana de contexto de alrededor de 1,05 millones de tokens y una salida máxima de 128 000 tokens por llamada.

Hay varios detalles a tener en cuenta:

  • La parte de un mismo prompt que supere los 272 000 tokens se cobra al doble en la entrada y 1,5 veces en la salida;
  • No admite los niveles de razonamiento none ni minimal;
  • Al usar la interfaz Chat Completions no se pueden invocar herramientas; hay que cambiar a la Responses API.

El segundo punto afecta especialmente a los equipos que trabajan con interacción en tiempo real. La práctica anterior de desactivar el razonamiento para reducir la latencia ya no funciona en 6.1 Sol.

Por dónde pueden acceder los desarrolladores en China

La API oficial de OpenAI no da servicio a China continental desde julio de 2024, y eso no ha cambiado. En esta lista de lanzamiento, los canales de terceros se ajustan más a la realidad de los desarrolladores chinos: OpenRouter y Vercel AI Gateway ya están disponibles al mismo tiempo, y los planes Pro+, Max, Business y Enterprise de GitHub Copilot también se pueden elegir.

Para los equipos en China, la referencia más directa es la franja de precios de los modelos nacionales. GLM-5.3 había anunciado antes un precio de API de 4,4 dólares por millón de tokens de salida, menos de la mitad de GPT-6.1 Sol. Esta vez Sol ha llevado la capacidad de programación de nivel insignia a una franja de 10 dólares, con lo que la ventaja de precio de los modelos nacionales en escenarios de programación se ha reducido un poco; queda por ver si los demás actores ajustan sus precios en respuesta.

Otra variable está en la propia OpenAI. Un día antes, la empresa retiró GPT-6.1 Astra, previsto originalmente para octubre, alegando que no cumplía los estándares de seguridad, y todavía no hay fecha para la próxima actualización de la línea insignia. Hasta entonces, es probable que 6.1 Sol sea el modelo que OpenAI priorice para los desarrolladores.

Fuentes: página oficial de lanzamiento y resumen del DevDay de OpenAI, evaluación independiente de Artificial Analysis, CocoLoop, recopilaciones de pruebas de DataCamp y Vellum; los precios de cada nivel de la API, la longitud de contexto y el multiplicador de facturación para prompts largos siguen las cifras publicadas por OpenAI.