OpenAI presentó el modo Ultrarrápido, una nueva modalidad de servicio para ejecutar GPT-5.6 Sol en la API con una velocidad de hasta 14 veces superior al procesamiento Standard. La vista previa arranca solo para un grupo seleccionado de clientes y emplea infraestructura de Cerebras.
Según OpenAI, el nuevo modo puede generar hasta 750 tokens de salida por segundo. La empresa lo plantea para trabajos donde la latencia pesa tanto como la calidad de la respuesta, como programación, voz, soporte y flujos interactivos.
El anuncio se centra en GPT-5.6 Sol, el modelo más capaz de esta familia. OpenAI también indicó que ya prueba esta modalidad en comercio, investigación financiera y tareas internas de respuesta a incidentes e investigación con herramientas y fuentes conectadas.
Hasta ahora, la compañía no publicó precio, términos de uso ni fecha de disponibilidad general para el modo Ultrarrápido. Tampoco lo presentó como un reemplazo del modo Fast ya existente, que en GPT-5.6 Sol ofrece hasta 2,5 veces la velocidad del modo Standard y se cobra a una tarifa superior.
Cómo funciona el modo Ultrarrápido para GPT-5.6 Sol
OpenAI describe el modo Ultrarrápido como un nuevo nivel de servicio dentro de su API. La diferencia central no está en un modelo nuevo, sino en la forma de ejecutar GPT-5.6 Sol para reducir el tiempo de respuesta en aplicaciones donde unos segundos cambian la experiencia o el resultado operativo.
La infraestructura corre sobre Cerebras, empresa especializada en cómputo para cargas de Inteligencia Artificial. En su publicación, Cerebras confirmó que impulsa esta vista previa de OpenAI y que el despliegue inicial está limitado a clientes seleccionados mientras aumenta la capacidad disponible.

Las cifras de hasta 14 veces más velocidad y hasta 750 tokens por segundo son máximos comunicados por OpenAI y Cerebras, no una garantía uniforme para cada solicitud. El rendimiento puede variar según la tarea, la configuración y el volumen de salida que pida cada aplicación.
OpenAI también aclaró que el nuevo modo no debe confundirse con el modo de razonamiento ultra de GPT-5.6 Sol. Aquí el cambio confirmado está en la capa de servicio y en la velocidad de inferencia, no en una versión distinta del modelo ni en una política nueva de acceso general.
Acceso inicial, diferencias con Fast y límites del anuncio
El contraste más claro hoy es con Fast. OpenAI explicó semanas antes que ese modo entrega hasta 2,5 veces la velocidad del procesamiento Standard en GPT-5.6 Sol y mantiene el mismo nivel de capacidad del modelo, pero con un precio equivalente al doble de Standard.
En el modo Ultrarrápido, OpenAI todavía no detalló el esquema comercial. Como se mencionó antes, no hay precio público, tampoco unos términos de uso establecidos anunciado ni una lista completa de empresas elegibles. Eso deja pendiente una parte importante para equipos que quieran calcular costos, tiempos de adopción o compromisos de disponibilidad.
El lanzamiento inicial en clientes escogidos sugiere que OpenAI está tratando el modo Ultrarrápido como una capacidad aún acotada por infraestructura. La empresa dijo que ampliará el acceso a medida que crezca la capacidad, pero no fijó un calendario concreto para esa expansión.
En sus ejemplos de uso, OpenAI menciona programación, comercio, finanzas, soporte y voz. También señaló que, en tareas internas de respuesta a incidentes, las personas siguen siendo responsables del juicio y del despliegue, una precisión relevante en un servicio pensado para acelerar decisiones y automatizaciones.


