OpenAI lanza Ultrafast: GPT-5.6 Sol responde hasta 14 veces más rápido
OpenAI anunció el 13 de agosto de 2026 un nuevo nivel de API llamado Ultrafast, que ejecuta GPT-5.6 Sol sobre chips wafer-scale de Cerebras y alcanza hasta 750 tokens por segundo.
Ilustracion contextual ViaMind · no es fotografia del hecho
Lo reportado
Velocidad y hardware
La métrica clave es la velocidad: hasta 750 tokens de salida por segundo, frente a los 50-60 tokens por segundo del modo estándar. Esto representa una mejora de hasta 14 veces. La diferencia radica en la arquitectura de los chips de Cerebras, que son obleas de silicio completas con interconexiones de alto ancho de banda, lo que reduce los cuellos de botella típicos de las GPUs convencionales.
Estado de evidencia: Las afirmaciones materiales incluidas fueron contrastadas con la evidencia enlazada.
Qué seguir
Habrá que observar si OpenAI publica métricas de adopción de Ultrafast y si otros proveedores de modelos anuncian mejoras similares de velocidad en los próximos meses.