OpenAI presenta GPT-6.1 Sol: rinde casi como Astra y cuesta cinco veces menos

OpenAI ha estrenado su evento anual con GPT-6.1 Sol, un modelo que sitúa la capacidad de su IA más potente a una fracción del coste. La compañía, que canceló el lanzamiento de su modelo insignia, apuesta ahora por un equilibrio entre rendimiento y precio por token, en línea con la estrategia que ha marcado Anthropic con Claude Sonnet 5.5. El nuevo modelo ya está disponible para los suscriptores de pago en ChatGPT Work y Codex.
Un modelo más barato sin renunciar al rendimiento
GPT-6.1 Sol llega con la promesa de acercar la inteligencia de Astra, el modelo más potente de OpenAI, a una quinta parte de su coste. La compañía ha optado por presentar una alternativa que destaca en desarrollo de software y tareas de agentes, justo cuando la industria gira hacia el precio por token como factor decisivo.
La llegada de agentes autónomos que programan, revisan documentos o controlan el ordenador ha disparado el consumo de tokens, y los usuarios valoran cada vez más modelos que ofrezcan un buen equilibrio entre capacidad y coste. Con este lanzamiento, OpenAI sigue la misma senda que Anthropic, que ya marcó el camino con Claude Sonnet 5.5: un rendimiento cercano al tope de gama a un precio sensiblemente menor.
El modelo se posiciona como el más equilibrado de la compañía y presenta mejoras notables frente a su predecesor, GPT-6 Sol. Entre ellas destacan la capacidad para escribir y depurar código, comprender documentos complejos y ejecutar flujos de trabajo de varios pasos.
Resultados en benchmarks: código, agentes y documentos
En el terreno de la programación, GPT-6.1 Sol está casi al mismo nivel que Astra. Según la prueba DeepSWE v1.1, que evalúa a los agentes de IA en tareas reales de ingeniería de software, el nuevo modelo logra una puntuación que iguala a su hermano más poderoso.
En control de ordenador, la prueba OSWorld 2.0, que mide si la IA puede manejar un PC como un humano, deja a GPT-6.1 Sol ligeramente por debajo de Astra usando el máximo razonamiento, pero con un coste por tarea de solo una séptima parte respecto a esa IA.
Frente a Claude Opus 5.5 de Anthropic, el modelo de OpenAI supera a su competidor en benchmarks como el que mide la respuesta a preguntas a partir de un documento PDF complejo. También le gana en AutomationBench, una prueba que evalúa si los agentes completan flujos de trabajo empresariales de varios pasos, aunque en este caso el margen es menor. La diferencia de precio resulta notable: usar GPT-6.1 Sol cuesta aproximadamente un tercio de lo que habría que pagar a Anthropic.
Investigación científica y menos errores
OpenAI ha trabajado también en el desempeño científico, dado que estos modelos ya se emplean en investigación para análisis de datos, simulación o demostración de teoremas. En la prueba Terminal-Bench Science 0.1, GPT-6.1 Sol obtiene más del doble de puntuación que su predecesor. Astra sigue liderando, pero la diferencia se ha reducido de forma sustancial.
En cuanto a fiabilidad, la compañía afirma que su nueva IA reduce la tasa de errores frente a GPT-6 Sol. Con un esfuerzo de razonamiento muy alto, la tasa de errores factuales es del 4,1%, frente al 4,0% de Astra. Además, el modelo es más transparente con sus limitaciones y respeta mejor las restricciones, algo relevante después de que los agentes de OpenAI comprometieran sistemas como Hugging Face sin autorización. En las evaluaciones de seguridad relacionadas con agentes y uso de herramientas, GPT-6.1 Sol presenta menos fallos.
Disponibilidad y precios
GPT-6.1 Sol ya está disponible para los usuarios con suscripción a ChatGPT Plus, Pro, Business, Enterprise y Edu. Por el momento no se puede usar en el chat, pero sí en Codex o ChatGPT Work.
En la API, el precio es de 2 dólares por millón de tokens de entrada, 0,10 dólares por millón de tokens de entrada en caché y 10 dólares por millón de tokens de salida. Unas cifras que confirman la estrategia de OpenAI de competir no solo en capacidades, sino también en coste por token.



