16
Views

AMD anunció una alianza estratégica con Cerebras para integrar su plataforma de IA a escala de rack Helios con el Wafer-Scale Engine (WSE) de la compañía. Con este movimiento, AMD busca responder a la estrategia de NVIDIA, que recientemente incorporó la tecnología LPU de Groq, reforzando la competencia por liderar el mercado de la inferencia de inteligencia artificial.

La tecnología LPU (Language Processing Unit) de Groq está diseñada específicamente para tareas de inferencia. Su arquitectura reúne cientos o miles de chips especializados con grandes bloques de procesamiento matricial y memoria SRAM de alta velocidad, donde los modelos de IA se almacenan directamente para eliminar la necesidad de cachés tradicionales y reducir al mínimo la latencia.

Por su parte, Cerebras apuesta por un enfoque diferente con su Wafer-Scale Engine, un gigantesco chip que integra cientos de miles de núcleos de cómputo y decenas de GB de memoria SRAM sobre una sola oblea de silicio. Esta arquitectura permite mantener modelos completos o grandes fragmentos de ellos dentro del mismo chip, reduciendo los cuellos de botella de comunicación y ofreciendo soporte tanto para entrenamiento como para inferencia.

Gracias a esta colaboración, Helios se encargará de procesar grandes volúmenes de datos y contextos extensos, mientras que el Wafer-Scale Engine acelerará la generación de tokens con una latencia extremadamente baja. AMD asegura que esta combinación permitirá alcanzar hasta cinco veces más tokens por segundo por vatio, mejorando tanto el rendimiento como la eficiencia energética.

La empresa explicó que esta arquitectura híbrida busca equilibrar el alto rendimiento necesario para cargas masivas de IA con tiempos de respuesta mucho más rápidos en tareas como programación, asistentes inteligentes y aplicaciones basadas en agentes. El objetivo es ofrecer una plataforma capaz de mantener un elevado nivel de procesamiento sin sacrificar la velocidad de respuesta.

Aunque NVIDIA ya comercializa su solución Groq 3 LPX, equipada con 256 aceleradores LPU y refrigeración líquida, AMD sostiene que la integración con Cerebras ofrece una plataforma más flexible y versátil, capaz de adaptarse a un mayor número de cargas de trabajo de inteligencia artificial, fortaleciendo así su posición en la creciente competencia por dominar la infraestructura para IA.

Etiquetas de artículos:
Categorías de artículos:
Noticias · PC
Redacción Gamecored http://www.gamecored.com

Mantente actualizado con las últimas noticias.