inteligencia-artificial

OpenAI lanza un modo Ultrafast para GPT-5.6 Sol que multiplica por 14 la velocidad de respuesta

Fotografía que ilustra la noticia: OpenAI lanza un modo Ultrafast para GPT-5.6 Sol que multiplica por 14 la velocidad de respuesta
(hipertextual.com)

OpenAI ha lanzado una versión de ChatGPT que ejecuta su modelo más potente a una velocidad nunca antes vista. Conocido como Ultrafast, este modo permite correr GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar, según ha anunciado la compañía.

Velocidad sin precedentes gracias a Cerebras

El modo Ultrafast de GPT-5.6 Sol alcanza hasta 750 tokens por segundo, frente a los 50-55 tokens por segundo del modo de razonamiento estándar. Esta mejora es posible gracias a una colaboración con Cerebras, una empresa de semiconductores que ya ha fabricado un chip diseñado para acelerar modelos de IA.

OpenAI explica que, tradicionalmente, obtener respuestas rápidas en tiempo real implicaba sacrificar inteligencia, por lo que muchos optaban por modelos más pequeños o especializados. Con Ultrafast, la infraestructura de cómputo de Cerebras permite mantener la capacidad de razonamiento de GPT-5.6 Sol sin esperar segundos en cada respuesta.

El salto de velocidad no es menor: pasar de unos 50 tokens por segundo a 750 supone un incremento de 14 veces, lo que marca una diferencia sustancial para aplicaciones que requieren interacción en tiempo real. La compañía destaca que esta nueva capacidad no compromete el razonamiento, que suele ser el primer sacrificio cuando se busca rapidez.

Casos de uso: incidentes, soporte, finanzas y comercio electrónico

OpenAI ha detallado varios escenarios en los que Ultrafast resulta especialmente útil. En respuesta a incidentes, la IA puede analizar registros de aplicaciones, cambios en el código y reportes de ingenieros para determinar por qué se cayó un servicio. Este tipo de diagnóstico, que normalmente requiere tiempo y múltiples herramientas, se acelera de forma notable.

También es aplicable al soporte al cliente y a aplicaciones de voz, donde la IA responde a dudas complejas sin interrumpir la conversación, incluso si el modelo necesita consultar varios sistemas. En investigación financiera, el modo Ultrafast examina transacciones o señales de mercado para detectar actividad sospechosa en tiempo real. En comercio electrónico, la IA responde preguntas sobre productos, revisa inventario y resuelve problemas de pago antes de que se complete la compra.

Uso interno y disponibilidad limitada

OpenAI ya utiliza Ultrafast en sus propios equipos de investigación, donde se emplea para consultar fuentes, cruzar datos y organizar información de todas las herramientas conectadas. La compañía señala que antes era habitual lanzar un lote de experimentos durante la noche para revisar los resultados a la mañana siguiente; con Ultrafast, los científicos pueden realizar varias iteraciones a lo largo de un solo día de trabajo.

También se usa en la respuesta a incidentes técnicos internos, donde los ingenieros leen registros, resumen conversaciones y validan soluciones en una fracción del tiempo habitual. Por ahora, el modo Ultrafast está disponible en versión preliminar para un número reducido de usuarios, y OpenAI ha indicado que ampliará el acceso conforme crezca su capacidad de infraestructura. La compañía advierte que, cuando esté disponible para todos, no será barato.