OpenAI presentó GPT-6.1 Sol, una actualización de su modelo GPT-6 Sol orientada a la programación con agentes, el uso de la computadora y el trabajo profesional. La compañía sostiene que el modelo ofrece un nivel de inteligencia casi igual al de GPT-6 Astra en esas áreas, a una quinta parte de los precios estándar por tokens de entrada y salida. El anuncio se hizo en el DevDay de la empresa, el 29 de septiembre de 2026, una semana después del lanzamiento de GPT-6 Sol.
En la API, el costo estándar es de 2 dólares por millón de tokens de entrada y 10 dólares por millón de salida, frente a los 10 y 50 dólares de Astra. La entrada en caché cuesta 0,10 dólares por millón, un descuento de 95 % sobre la tarifa de entrada estándar. El modelo está disponible para usuarios de los planes Plus, Pro, Business, Enterprise y Edu en ChatGPT Work y Codex, y para desarrolladores como gpt-6.1-sol. Todavía no llega a Chat. OpenAI también informó de versiones Ultrafast de Astra y de Sol, con hasta ocho veces más velocidad, y de un nuevo nivel Pro de 500 dólares mensuales.
La empresa respalda su planteamiento con pruebas de referencia. En DeepSWE v1.1, dedicada a tareas de ingeniería de software en bases de código reales, GPT-6.1 Sol iguala a Astra a cerca de una quinta parte del costo y supera en 6,4 puntos porcentuales la mejor marca de GPT-6 Sol. Un análisis independiente de Handy AI sitúa esa puntuación en 75,2 %. En OSWorld 2.0, sobre uso de la computadora, queda a 2,1 puntos de Astra con aproximadamente una séptima parte del costo por tarea. En AutomationBench supera a Opus 5.5 por 2,2 puntos porcentuales a cerca de un tercio del costo. En Terminal-Bench Science, el costo medio por tarea es de 5,47 dólares, frente a 23,21 de Opus 5.5 y 23,80 de Astra, aunque OpenAI reconoce que Astra conserva la puntuación más alta, con 68,1 %. La compañía aclara que evaluó a los modelos de la competencia a partir de informes públicos.
En precisión factual, la tasa de errores en prompts difíciles con esfuerzo de razonamiento muy alto es de 4,1 %, frente a 4,5 % de GPT-6 Sol y 4,0 % de Astra. OpenAI advierte que esas conversaciones se eligieron para provocar fallas y no reflejan el uso habitual. Con esfuerzo bajo, el porcentaje de respuestas con algún error bajó de 11,4 % a 7,7 %.
Mediciones externas muestran una diferencia menor con Astra. En el Intelligence Index de Artificial Analysis, GPT-6.1 Sol en su configuración máxima obtuvo 52 puntos, frente a 53 de Astra y 48 de GPT-6 Sol. Según esa misma fuente, muchos desarrolladores lo consideran más conveniente que GPT-6 Sol para el trabajo diario de programación, aunque algunos reportan que Astra es más confiable en tareas muy complejas.
El lanzamiento ocurre en un contexto particular. El 28 de septiembre, The Wall Street Journal informó de que OpenAI cancelaba GPT-6.1 Astra, previsto para octubre, por inquietudes de seguridad surgidas en pruebas internas. Saachi Jain, responsable de sistemas de seguridad de la empresa, dijo que el modelo mejoró en aspectos como la «pereza», pero no cumplió el estándar en permanecer dentro de lo autorizado ni en informar al usuario sobre el trabajo realizado. OpenAI no lanzó GPT-6.1 Astra, que se esperaba.
En ese marco, OpenAI afirma que GPT-6.1 Sol mejora en sus evaluaciones de alineación respecto de GPT-6 Sol. En una prueba sobre si el agente avisa cuando su herramienta de búsqueda falla, no informó del problema en 2,1 % de los casos, frente a 4,9 % de GPT-6 Sol, 1,5 % de Astra y 28,7 % de GPT-6 Luna. La empresa indicó que no observó intentos de evadir al revisor de seguridad automatizado. También precisó que las pruebas plantean escenarios deliberadamente difíciles y no miden las fallas del uso cotidiano.
Fuente: OpenAI | Editado por CDOL

































