GPT-5.6 Sol acelera hasta 14 veces con Ultrafast: OpenAI alcanza 750 tokens por segundo sin recurrir a un modelo más pequeño

Wait 5 sec.

OpenAI ha estrenado Ultrafast, un modo que acelera GPT-5.6 Sol hasta 14 veces frente al procesamiento estándar y alcanza hasta 750 tokens por segundo. La diferencia está en que no recurre a una versión más pequeña para ganar velocidad, sino que mantiene el modelo de mayores capacidades de la familia mientras reduce de forma drástica el tiempo de respuesta.Según recoge TechCrunch, Ultrafast está disponible por ahora para un grupo muy reducido de clientes y funciona gracias a una colaboración con Cerebras. OpenAI lo ha lanzado en fase de vista previa y asegura que ampliará el acceso conforme aumente su capacidad, así que de momento no es una opción que cualquier usuario pueda activar en ChatGPT.La velocidad ya no obliga a rebajar el modelo Hasta ahora, ganar mucha velocidad solía implicar cambiar a un modelo más pequeño o especializado, justo la concesión que OpenAI dice haber evitado aquí. La compañía lo explica así: “Hasta ahora, conseguir velocidad en tiempo real solía significar elegir un modelo más pequeño o especializado”. Ultrafast mantiene GPT-5.6 Sol y acelera su generación de respuestas.El dato que permite medir el salto es una velocidad de hasta 750 tokens de salida por segundo. Los tokens son las unidades en las que el modelo divide y genera el texto, de modo que una cifra mayor se traduce en respuestas que aparecen mucho antes, algo visible cuando la salida es larga o la consulta exige mucho texto.Eso coloca la mejora sobre el mismo GPT-5.6 Sol presentado en junio, sin sustituirlo por Terra o Luna. OpenAI está acelerando su modelo de mayores capacidades, no creando una variante recortada para responder deprisa. Si utilizas la API para tareas donde cada segundo cuenta, esa diferencia es precisamente la que da sentido a Ultrafast.Cerebras pone la infraestructura detrás de Ultrafast Cerebras es el fabricante de chips que hace que Ultrafast funcioneLa otra pieza de la ecuación es Cerebras, responsable de la infraestructura que hace posible Ultrafast. OpenAI atribuye el nuevo modo a su colaboración con el fabricante de chips, aunque no detalla en el material disponible cómo se reparte exactamente el trabajo entre su propia infraestructura y la de su socio para alcanzar esas cifras de rendimiento.OpenAI menciona como ejemplos la respuesta ante incidencias, la atención al cliente y el análisis financiero, además del comercio electrónico. Son casos en los que esperar menos entre una petición y su respuesta puede tener una utilidad inmediata, sobre todo cuando varias consultas se encadenan y el tiempo acumulado empieza a importar más que unos pocos segundos aislados.La compañía ya lanzó GPT-5.6 al gran público con Sol como versión de máximas capacidades, y ahora añade un modo acelerado que conserva ese mismo modelo. Anthropic dispone de Claude Fast Mode, pero según se recoge no alcanza las velocidades anunciadas aquí. Por ahora, en cualquier caso, Ultrafast sigue limitado a pocos clientes.