← Noticias IA

14 de agosto de 2026 · OpenAI

OpenAI estrena Ultrafast: GPT-5.6 Sol a hasta 750 tokens por segundo con Cerebras

Mi opinión: La velocidad siempre fue la restricción que separaba a los modelos más inteligentes de los que se podían usar de verdad en tiempo real. OpenAI acaba de presentar Ultrafast, un nuevo nivel de servicio en su API que corre GPT-5.6 Sol en hardware de Cerebras a hasta 750 tokens por segundo, lo que equivale a hasta 14 veces más rápido que el procesamiento estándar. En la práctica, eso colapsa el tiempo de espera de varios segundos a fracciones de segundo.

Para cualquier persona que construye productos donde el modelo tiene que responder mientras el usuario todavía espera, esto cambia las posibilidades: soporte al cliente en vivo, aplicaciones de voz, análisis financiero en tiempo real, o cualquier flujo que no puede permitirse latencia. No es una mejora de uso personal; es lo que habilita que el modelo más inteligente sea también el más rápido.

El acceso arranca como vista previa limitada para un grupo selecto de clientes de la API, con expansión gradual. Si estás construyendo algo donde la latencia del modelo todavía bloquea la experiencia del usuario, este es el momento de solicitar acceso.

Leer en la fuente: OpenAI ↗

¿Quieres usar estas herramientas? Mira las reseñas sin filtro o vuelve a las noticias.