Alianzas

AMD se alía con Cerebras para desafiar a Nvidia en la nueva era de la IA

·PositivoImpacto medio
AMD se alía con Cerebras para desafiar a Nvidia en la nueva era de la IA

AMD apuesta por la 'inferencia desagregada' junto a la startup Cerebras, buscando eficiencia y menores costes frente al dominio de Nvidia en chips de IA.

AMD está convencida de que el futuro de la inteligencia artificial no puede depender de un solo tipo de chip. Su CEO, Lisa Su, anunció una alianza con la startup Cerebras para abordar la inferencia de IA de una forma radicalmente distinta: dividiendo el trabajo entre distintos tipos de hardware, lo que se conoce como 'inferencia desagregada'.

Hasta ahora, los mismos chips se encargaban tanto de procesar las peticiones de los usuarios como de generar las respuestas. AMD sostiene que son tareas muy diferentes y que merecen un tratamiento especializado. Por un lado, su nuevo sistema Helios está diseñado para gestionar volúmenes masivos de solicitudes, mientras que los chips gigantes de Cerebras, del tamaño de una oblea, se especializan en producir respuestas casi instantáneas. La colaboración llevará los servidores Helios a los centros de datos de Cerebras a finales de este año.

La demanda de chips para IA se ha disparado y Nvidia domina el diseño de semiconductores para el entrenamiento de modelos. Pero a medida que las empresas de IA pasan de entrenar modelos a ponerlos a trabajar, la competencia se intensifica. AMD busca aprovechar este cambio con una apuesta que, según analistas de UBS, ya está en marcha en toda la industria: las limitaciones de las arquitecturas actuales están empujando hacia la inferencia desagregada.

En su evento Advancing AI, AMD no dudó en apuntar directamente a Nvidia, afirmando que Helios ofrece hasta un 30% más de tokens de inferencia por dólar que el rack Vera Rubin NVL72 de su rival. Lisa Su destacó que cada Helios puede ofrecer más rendimiento para los modelos más grandes, más capacidad para contextos extensos y el ancho de banda necesario para escalar a miles de racks. Grandes laboratorios de IA y gigantes de la nube como OpenAI, Meta, Microsoft, Oracle y Anthropic ya utilizan la infraestructura de AMD, con quien Anthropic acaba de cerrar un acuerdo de infraestructura multimillonario.

UBS también señala que Nvidia, a través de su integración con la startup de hardware Groq, y Amazon Web Services están explorando configuraciones similares para mejorar la eficiencia y reducir costes. Sin embargo, advierten que la inferencia desagregada plantea nuevos desafíos de 'orquestación', es decir, conseguir que chips tan distintos trabajen juntos sin fricciones.

El análisis de Salseo

  • La jugada de AMD no es solo tecnológica: es un intento de romper el ecosistema cerrado de Nvidia ofreciendo a los clientes una alternativa modular y, sobre todo, más barata por token generado. Si la promesa del 30% más de eficiencia se cumple, podría acelerar la adopción de hardware no-Nvidia en inferencia.
  • El movimiento refleja una tensión de fondo en la industria: el cuello de botella ya no es solo entrenar modelos, sino servirlos de forma rentable. La inferencia desagregada es la respuesta natural a la especialización de cargas de trabajo, pero el verdadero reto estará en la 'orquestación', es decir, en el software que coordine chips tan dispares sin perder rendimiento.
  • Para el inversor, la señal clave será la adopción real de Helios por parte de los grandes clientes mencionados (OpenAI, Meta, etc.) y los primeros benchmarks independientes que comparen su rendimiento y coste frente a las soluciones de Nvidia. Si AMD logra demostrar ventajas tangibles, podría ganar cuota en un mercado de inferencia que no deja de crecer.

Empresas mencionadas