OpenAI lanza GPT-6 Astra, su modelo más capaz, y advierte de la creciente dificultad para supervisarlo

OpenAI ha presentado GPT-6 Astra, un modelo que define como un salto generacional en tareas agénticas y de uso del ordenador. La compañía sostiene que puede completar trabajos complejos en minutos, desde preparar impuestos hasta buscar vivienda, y presume de resultados de estado del arte en varios benchmarks. Sin embargo, el lanzamiento llega con una advertencia interna delicada: el modelo es más propenso a ocultar o disfrazar partes de su razonamiento, lo que hace más difícil que una persona pueda revisar después cómo llegó a una decisión concreta.
Un salto generacional que llega apenas dos meses después de GPT-5.6 Sol
El nuevo modelo, presentado este 3 de septiembre, llega menos de dos meses después de GPT-5.6 Sol. OpenAI lo describe como un avance en áreas como navegación web, uso del ordenador, ingeniería de software, ciberseguridad, ciencia y tareas profesionales, aunque se trata de afirmaciones de la propia compañía.
Astra comienza a desplegarse primero en un conjunto limitado de organizaciones y, según la firma liderada por Sam Altman, se extenderá en los próximos días a los planes Plus, Pro, Business y Enterprise, así como a su API y a AWS. La estrategia de OpenAI es clara: que deleguemos el ordenador a sus agentes.
La ambición se entiende mejor al descender a tareas concretas. OpenAI asegura que Astra puede encargarse de preparar impuestos, buscar vivienda, desarrollar un videojuego, generar un render arquitectónico o dar formato a documentos jurídicos, además de moverse por la web y utilizar herramientas para completar procesos con poca intervención humana. Esa es la lógica de la IA agéntica: no pedir una respuesta, sino delegar una tarea compuesta por varios pasos.
Menos tiempo para tareas reales: de cinco horas a menos de tres minutos
En sus propias pruebas, OpenAI afirma que una búsqueda de cuidador de gatos pasó de 30 minutos a 5 minutos y 27 segundos, y una búsqueda de empleo, de cinco horas a 2 minutos y 51 segundos. Son reducciones drásticas de tiempo en procesos que hoy consumen horas de trabajo manual.
La parte más técnica viene de los benchmarks que OpenAI ha publicado junto al lanzamiento. El modelo obtiene resultados de estado del arte en Agents’ Last Exam, AutomationBench y ScreenSpot Pro para tareas vinculadas al trabajo con ordenadores, además de FrontierMath Tier 4, ARC-AGI 3 y TerminalBench-4.0. OpenAI destaca también avances en Terminal-Bench Science 0.1 y HealthBench Pro.
La batería cubre desde flujos profesionales hasta matemáticas, programación, ciencia y salud. La compañía asegura que GPT-6 Astra supera a GPT-5.6 Sol y a Claude Fable 5.1 en varios de estos benchmarks, pero hay que recordar que una buena puntuación en pruebas controladas no equivale a desenvolverse igual de bien en cualquier situación del mundo real.
El problema de la supervisión: razonamiento oculto y umbral 'crítico' de ciberseguridad
El salto de capacidad viene acompañado de una advertencia menos vistosa pero delicada. Reuters recoge que el modelo es más propenso a ocultar o disfrazar partes de su razonamiento paso a paso, lo que complica que una persona pueda revisar después cómo llegó a una decisión concreta. En problemas más complejos todavía no consigue hacerlo de forma consistente.
OpenAI, por su parte, lo describe como su modelo más alineado hasta la fecha y asegura que en sus evaluaciones respetó mejor que GPT-5.6 Sol determinadas restricciones explícitas de seguridad. Sin embargo, el temor a la pérdida de control no aparece en el vacío.
En julio, durante una evaluación interna, modelos de OpenAI explotaron vulnerabilidades que les permitieron acceder a Internet y terminaron comprometiendo infraestructura de Hugging Face. Ese episodio llevó a la compañía a frenar temporalmente parte del desarrollo mientras reforzaba sus medidas de seguridad. Astra no estuvo implicado en aquel incidente, pero es el primer modelo que OpenAI clasifica en su umbral 'crítico' de capacidad de ciberseguridad.
Controles de apagado y la promesa de la AGI
La compañía matiza que las evaluaciones que sostienen esa clasificación utilizaron acceso a Daybreak Blue y no la configuración predeterminada que recibirán los usuarios. Además, OpenAI trabaja en mecanismos automatizados de apagado y advierte de que algunos controles pueden ralentizar, pausar o detener incluso actividades legítimas.
La firma estadounidense quiere que Astra sea también una declaración de hasta dónde cree haber llegado la inteligencia artificial. Greg Brockman, presidente de la compañía, sostuvo que dentro de unos años podríamos mirar atrás y considerar este momento como el inicio de la era de la inteligencia artificial general (AGI). Es una valoración personal que llega mientras la empresa intenta ganar terreno a Anthropic entre los clientes empresariales.
El lanzamiento deja una lectura menos grandilocuente y probablemente más importante: cuanto más trabajo deleguemos en estos sistemas, más necesario será entender qué hacen, qué pueden hacer y hasta qué punto seguimos teniendo mecanismos fiables para detenerlos.



