Cerebras acelera el modelo más potente de OpenAI hasta 14 veces

Cerebras anuncia que impulsa el modo Ultrafast de GPT-5.6 Sol, alcanzando hasta 750 tokens por segundo y abriendo una nueva frontera de velocidad para la IA de vanguardia.
Cerebras Systems, la compañía de infraestructura de IA conocida por sus chips gigantes, ha anunciado que está detrás del modo Ultrafast de GPT-5.6 Sol, el modelo más capaz de OpenAI. Este nuevo servicio, disponible inicialmente en vista previa limitada para clientes de la API de OpenAI, promete velocidades de hasta 750 tokens de salida por segundo, lo que supone hasta 14 veces más rápido que el procesamiento estándar.
La clave de esta velocidad está en la arquitectura de Cerebras: sus chips del tamaño de una oblea mantienen los pesos del modelo en la propia memoria del chip (44 GB de SRAM), evitando el cuello de botella de ancho de banda que sufren las GPU tradicionales. Esto permite que GPT-5.6 Sol Ultrafast ofrezca la misma inteligencia que la versión estándar, pero con una latencia mínima.
Según benchmarks citados por la compañía, este modo es 5 veces más rápido que Claude Opus 4.8 en modo rápido y 11 veces más veloz que Claude Fable 5 de Anthropic. En la prueba 'Humanity's Last Exam', un conjunto de 2.500 preguntas de nivel de posgrado, Ultrafast completó el test en poco más de 11 horas, frente a más de tres días de cómputo continuo para Claude Fable 5, con una precisión comparable.
Andrew Feldman, CEO de Cerebras, destaca que "la velocidad y la inteligencia ya no son mutuamente excluyentes". Por su parte, Sachin Katti, VP de Estrategia de Computación en OpenAI, explica que están explorando cómo los clientes pueden beneficiarse de una latencia significativamente menor, comenzando con un grupo reducido para aprender dónde esa velocidad crea valor real.
Este anuncio refuerza la posición de Cerebras en el competitivo mercado de la inferencia de IA, donde la velocidad se está convirtiendo en el nuevo campo de batalla. La compañía, que cotiza en el Nasdaq bajo el ticker CBRS, busca demostrar que su arquitectura única puede ofrecer ventajas tangibles frente a los gigantes de las GPU.
El análisis de Salseo
- Cerebras no solo vende hardware, sino que se posiciona como el socio de inferencia para los modelos más avanzados. Este acuerdo con OpenAI valida su tecnología a escala comercial y podría abrir la puerta a más contratos con grandes laboratorios de IA.
- La velocidad de inferencia se está convirtiendo en un diferenciador clave. Hasta ahora, los usuarios debían elegir entre modelos grandes y lentos o pequeños y rápidos. Cerebras rompe ese compromiso, lo que podría acelerar la adopción de IA en aplicaciones en tiempo real.
- El anuncio es una clara señal de que la competencia en el silicio para IA se intensifica. Mientras Nvidia domina el entrenamiento, la inferencia emerge como un nuevo campo de batalla donde arquitecturas alternativas como la de Cerebras pueden ganar terreno.
- Aunque el modo Ultrafast está en vista previa limitada, su expansión será un indicador clave a vigilar. Si OpenAI amplía el acceso y los clientes lo adoptan masivamente, podría tener un impacto material en los ingresos de Cerebras.