OpenAI abre una nueva batalla: no solo tener el mejor modelo, sino ejecutarlo casi en tiempo real con Ultrafast
La carrera de la inteligencia artificial está incorporando una nueva variable competitiva. Durante los últimos años, OpenAI, Anthropic, Google y el resto de grandes laboratorios han competido principalmente por demostrar quién tenía el modelo más capaz. Ahora aparece una pregunta mucho más empresarial: ¿de qué sirve disponer de una inteligencia extraordinaria si tarda demasiado en responder para integrarla en procesos que funcionan prácticamente en tiempo real? OpenAI acaba de responder con Ultrafast, una nueva modalidad de GPT-5.6 Sol que puede ejecutarse hasta 14 veces más rápido que el procesamiento Standard y alcanzar hasta 750 tokens de salida por segundo. La tecnología está impulsada por Cerebras y comienza mediante una disponibilidad limitada en la API de OpenAI.
La cifra de 750 tokens por segundo puede parecer un dato puramente técnico, pero cambia considerablemente los posibles usos empresariales. Hasta ahora, muchas aplicaciones tenían que elegir entre modelos pequeños capaces de responder rápidamente y modelos de frontera con mayor capacidad de razonamiento pero tiempos de respuesta superiores. Ultrafast intenta combinar ambos mundos: mantener las capacidades de GPT-5.6 Sol y reducir drásticamente la latencia. Esto puede resultar especialmente importante en ciberseguridad, programación, operaciones financieras, monitorización de infraestructuras, atención al cliente y agentes autónomos, donde unos segundos adicionales repetidos cientos de veces pueden determinar si una automatización resulta realmente útil.
De responder preguntas a tomar decisiones mientras ocurre el problema
El verdadero mercado potencial de Ultrafast probablemente no sean las conversaciones tradicionales con un chatbot, sino los agentes de IA. Un usuario realiza una pregunta y espera una respuesta; un agente puede necesitar decenas o cientos de interacciones con el modelo, APIs, bases de datos y otras herramientas para completar una única misión. Cada segundo de latencia se acumula durante ese proceso.
Imaginemos un agente empresarial que debe analizar una incidencia, consultar documentación interna, revisar registros, identificar posibles causas, comparar soluciones, generar código correctivo y solicitar autorización antes de ejecutarlo. Si cada paso necesita varios segundos, completar el proceso puede requerir minutos. Si la inferencia se acerca al tiempo real, toda la economía de ese agente cambia.
Algo similar puede ocurrir en desarrollo de software. El programador podría recibir generación, revisión y corrección de código prácticamente mientras trabaja. En ciberseguridad, los sistemas podrían analizar incidencias y proponer respuestas mucho más rápidamente. En atención al cliente, un agente podría consultar simultáneamente CRM, historial de compras, documentación y políticas comerciales antes de responder sin introducir pausas perceptibles para el consumidor.
La velocidad se convierte en una nueva ventaja competitiva
La comparación entre modelos empieza así a necesitar nuevas métricas. Ya no será suficiente con preguntar cuál obtiene mejores resultados en razonamiento. Las empresas tendrán que analizar simultáneamente capacidad, velocidad, coste y fiabilidad.
Un modelo extremadamente potente pero caro puede tener sentido para planificación estratégica, investigación científica o problemas complejos. Un agente que ejecuta millones de operaciones rutinarias necesitará probablemente otra combinación de prestaciones. Y determinados procesos críticos pueden justificar pagar más precisamente para obtener inteligencia de frontera con latencia mínima.
Esto conducirá hacia arquitecturas donde una misma empresa utilice diferentes modelos y modos de procesamiento dependiendo de la tarea. La inteligencia artificial dejará de contratarse como una herramienta uniforme y empezará a gestionarse como una verdadera infraestructura productiva.
De coste por token a coste y tiempo por tarea completada
La siguiente generación de métricas empresariales probablemente tendrá poco que ver con los rankings actuales. Un CFO no necesita saber únicamente cuántos puntos obtiene GPT-5.6 Sol en un benchmark. Necesita saber cuánto cuesta completar una operación, cuánto tarda, qué porcentaje termina correctamente y cuánto trabajo humano evita.
Ahí puede encontrarse la verdadera importancia de Ultrafast. OpenAI está empujando el mercado hacia una IA evaluada por su capacidad para producir resultados económicos. Si un agente puede ejecutar muchas más operaciones durante una jornada gracias a una reducción radical de latencia, la velocidad pasa a convertirse directamente en productividad.
La batalla entre OpenAI, Anthropic, Google y el resto de proveedores ya no consistirá únicamente en construir la inteligencia artificial más inteligente. Consistirá en producir inteligencia suficientemente avanzada, fiable y económica a la velocidad necesaria para integrarla dentro de las operaciones reales de una empresa.
La inteligencia artificial de frontera empieza así a acercarse a un nuevo territorio: la inteligencia casi en tiempo real.
La velocidad de la IA será también una decisión directiva
Los directivos tendrán que comprender progresivamente por qué latencia, modelos, agentes, infraestructura y coste de inferencia pueden modificar la economía de sus procesos empresariales.
El Curso Superior en Inteligencia Artificial para Directivos (CSIAD) de THE INTELLIGENCE Institute prepara a presidentes, CEOs, directores generales y altos ejecutivos para entender estas tecnologías desde una perspectiva estratégica y convertirlas en ventajas competitivas reales.
Descubre el CSIAD – Curso Superior en Inteligencia Artificial para Directivos
Share/Compártelo
- Compartir en LinkedIn (Se abre en una ventana nueva) LinkedIn
- Compartir en WhatsApp (Se abre en una ventana nueva) WhatsApp
- Comparte en Facebook (Se abre en una ventana nueva) Facebook
- Compartir en X (Se abre en una ventana nueva) X
- Compartir en Threads (Se abre en una ventana nueva) Threads
- Enviar un enlace a un amigo por correo electrónico (Se abre en una ventana nueva) Correo electrónico
- Imprimir (Se abre en una ventana nueva) Imprimir
- Más
Relacionado
Descubre más desde THE INTELLIGENCE
Suscríbete y recibe las últimas entradas en tu correo electrónico.














