OpenAI lanza el modo Ultrafast para GPT-5.6 Sol: 14 veces más rápido

El salto se apoya en chips de Cerebras y promete mantener el razonamiento sin sacrificar velocidad. De momento, solo está disponible en versión preliminar para unos pocos.

El modo Ultrafast de GPT-5.6 Sol ya está aquí. Genera hasta 750 tokens por segundo, y eso ya no es velocidad, es otra conversación.

OpenAI ha presentado una función que dispara las posibilidades de su modelo más potente. 750 tokens por segundo, unas 14 veces más rápido que el modo estándar, que se queda en unos 50-55. La clave no es solo ir rápido, sino seguir siendo inteligente.

14 veces más rápido sin sacrificar razonamiento

El salto se apoya en una infraestructura de cómputo de Cerebras, la empresa de semiconductores que fabrica chips para acelerar modelos de IA. Antes, para obtener respuestas en tiempo real había que tirar de modelos más pequeños o especializados. Ahora no.

Publicidad

OpenAI insiste en que no se sacrifica la capacidad de razonamiento del modelo. Eso es lo que lo separa de otros modos rápidos que parecen un loro con prisa. El razonamiento se mantiene, con la ventaja de no tener que esperar segundos valiosos en cada respuesta.

Los casos de uso son variados: respuesta a incidentes, soporte al cliente, y aplicaciones de voz. La IA puede leer registros, resumir conversaciones, detectar actividad sospechosa o resolver dudas sobre productos al momento, algo que con el modo estándar resultaba demasiado lento para ciertos escenarios.

Para qué demonios queremos tanta velocidad

OpenAI ya usa el modo Ultrafast internamente. En sus equipos de investigación han pasado de lanzar experimentos por la noche y revisar resultados por la mañana a iterar varias veces en un solo día. El modo Ultrafast permite ciclos de prueba mucho más cortos y una respuesta a incidentes técnicos en una fracción del tiempo habitual.

750 tokens por segundo no es solo velocidad: es la diferencia entre leer un análisis y verlo nacer delante de ti, con toda la inteligencia intacta.

El salto no es solo para los laboratorios. En soporte al cliente y aplicaciones de voz, la IA puede dar respuestas complejas sin cortar la conversación, incluso consultando varios sistemas a la vez. En investigación financiera, examina transacciones y señales de mercado para detectar actividad sospechosa en tiempo real. Y en comercio electrónico, resuelve dudas sobre productos, revisa inventario y ataja problemas de pago antes de que el usuario se vaya.

Eso sí, no te emociones demasiado. GPT-5.6 Sol en modo Ultrafast solo está disponible en versión preliminar para un número reducido de usuarios, y de momento a través de la API. OpenAI ha dicho que ampliará el acceso conforme crezca su capacidad de infraestructura. Y cuando llegue para todos, no esperes que sea barato.

El precedente: la obsesión por la latencia cero

Esta no es la primera vez que OpenAI se alía con un fabricante de chips para arañar velocidad. La apuesta por hardware especializado recuerda a los movimientos de Nvidia y AMD en la carrera por la inferencia. La diferencia aquí es que Cerebras fabrica chips gigantes, literalmente del tamaño de una oblea de silicio, diseñados para mantener todo el modelo en memoria y evitar cuellos de botella.

La pregunta es si necesitamos tanta velocidad en el día a día. Para la mayoría de tareas editoriales o de análisis, los 50 tokens por segundo del modo estándar siguen sobrando. Pero si trabajas en soporte en tiempo real, investigación financiera o tienes un bot de voz interactivo, la cosa cambia. Y mucho.

Publicidad

Por ahora, la versión preliminar de Ultrafast ya está disponible a través de la API de OpenAI, y la propia compañía ha confirmado que ampliará el acceso conforme crezca la infraestructura. Así que, si no estás en el grupo reducido, te toca esperar. O llorar.

Hype-O-Meter

Nivel de hype: 8,5/10. OpenAI sube la apuesta con un salto real en velocidad respaldado por hardware especializado. La nota no es un 10 porque el acceso es limitado y el precio promete doler, pero la demo con Cerebras pinta muy bien — y la pinta no suele engañar cuando hay silicio de por medio.

El resumen para vagos (TL;DR)

  • 🎯 ¿Qué ha pasado? OpenAI lanza el modo Ultrafast de GPT-5.6 Sol, 14 veces más rápido.
  • 🔥 ¿Por qué importa? Mantiene el razonamiento sin sacrificar velocidad, y usa chips de Cerebras.
  • 🤔 ¿Nos afecta o es solo un meme? Solo si trabajas con respuestas en tiempo real; para el resto es un lujo.