AMD presenta la plataforma Helios, las GPU Instinct MI400 y las CPU EPYC para la era de la inferencia y los agentes
MADRID, 24 Jul. –
AMD ha presentado el portfolio de soluciones con el que dará respueta a la demanda de la inteligencia artificial (IA), que incluye la plataforma de IA a escala de rack abierto Helios, las GPU AMD Instinct MI400 Series y la sexta generación de las CPU EPYC.
El uso de la inteligencia artificial no hace más de crecer, como ha dejado claro la directora ejecutiva de AMD, Lisa Su, en el evento ‘Advancing AI’, donde ha destacado que en los últimos dos años el uso de tokens mensuales ha aumentado 158 veces, y hoy se ven más de 35.000 billones de tokens se que se consumen cada año.
En este contexto, Su también ha destacado la demanda de computación, con los agentes como el siguiente gran paso para la inteligencia artificial. Esto exige una mayor cantidad de GPU, en tanto que el mercado de los aceleradores también está creciendo y se espera que para 2030 el mercado llegue a los 1.400 millones de dólares; pero también de CPU para servidores, con una estimación de crecimiento para 2030 de más 200.000 millones de dólares.
Para dar respuesta a las necesidades de la inteligencia artificial, la firma de semiconductores ha presentado una amplia gama de soluciones integrales de IA y para la computación de alto rendimiento que abarcan desde el silicio hasta el ‘software’, dirigas a la inferencia y los agentes.
Una de ellas es la plataforma de IA a escala de rack abierto Helios, diseñada para admitir inferencia a gran escala, entrenamiento de modelos de avanzados y ajuste fino, que ofrece un rendimiento de IA de clase exaflop.
La arquitectura unificada integra las GPU AMD Instinct de 5ª generación, las CPU de servidor AMD EPYC de 6ª generación, la red AMD Pensando y el software AMD ROCm. Con ello, proporciona en un solo rack hasta 2,9 exaflops de pico en FP4, 1,4 exaflops de pico en FP8, 31 terabytes de memoria HBM4 y 1,7 petabytes/segundo de ancho de banda de memoria.
Cada rack integra 18 bandejas de computación de cuatro GPU alineadas en ancho, de tal forma que admite 72 GPU en total. A escala de clúster, las NIC de IA AMD Pensando Vulcano 800 ofrecen la conectividad de alto ancho de banda y baja latencia necesaria para admitir la inferencia distribuida, el entrenamiento de modelos de vanguardia y el rápido crecimiento a hiperescala.
Este anuncio se acompaña del lanzamiento de las GPU AMD Instinct MI400 Series y la 6ª Generación de las CPU EPYC, ambos componentes dirigidos a centros de datos, fábricas de inteligencia artificial y computación de alto rendimiento.
Instinct MI400 Series combina ‘hardware’ diseñado específicamente, ‘software’ de código abierto y un diseño de sistema escalable. Toda la gama ofrece un alto ancho de banda de memoria para soportar lo modelos de IA más grandes y mejorar la eficiencia a escala, y destaca el modelo Instinct MI430X, que ofrece hasta 288 TFLOPS de rendimiento FP64.
En lo que respecta a las CPU EPYC, la sexta generación está dirigida a cargas de trabajo de IA de alto rendimiento y pone el enfoque en tres tareas concretas: ejecutar agentes, alimentar aceleradores y potenciar los servicios empresariales que utilizan los agentes.
Y para el desarrollo de inteligencia artificial en plataformas AMD, la compañía ha anunciado ROCm.ai, una plataforma de desarrollo nativa que combina desarrollo asistido por IA, despliegue inteligente y optimización de ‘software’ para pasar rápidamente de la idea a la producción. Puede integrarse en los principales asistentes de codificación de IA, como Claude, Cursor y Codex.
CL24
