AMD dio a conocer Helios, su nueva plataforma de inteligencia artificial a escala de rack, una solución diseñada para afrontar cargas de trabajo de entrenamiento e inferencia de modelos de gran tamaño y competir directamente con las plataformas NVIDIA Vera Rubin NVL72.
La propuesta representa la primera solución rack-scale completamente integrada de AMD y combina tres de sus tecnologías más recientes: aceleradores AMD Instinct MI455X, procesadores AMD EPYC de sexta generación «Venice» basados en la arquitectura Zen 6, y la infraestructura de red AMD Pensando, conformando una plataforma optimizada para centros de datos y supercomputación.

El corazón de Helios está compuesto por 72 GPU Instinct MI455X, basadas en la arquitectura CDNA 5, capaces de ofrecer hasta 2,9 exaflops en precisión FP4 y 1,4 exaflops en FP8 a nivel de rack. Cada acelerador incorpora 432 GB de memoria HBM4 con un ancho de banda de 19,6 TB/s, un aumento significativo frente a la generación anterior y una de las principales ventajas de la plataforma para ejecutar modelos de IA de gran tamaño.

En el apartado de procesamiento, Helios incorpora los nuevos AMD EPYC Venice, fabricados con el proceso de 2 nanómetros de TSMC, convirtiéndose en los primeros procesadores para centros de datos basados en esta tecnología. AMD promete importantes mejoras en rendimiento y eficiencia, además de configuraciones de hasta 256 núcleos por procesador para responder a las crecientes exigencias de la denominada IA agéntica.
La plataforma también integra los nuevos componentes de red AMD Pensando Vulcano 800 AI NIC y Salina DPU, que proporcionan conectividad Ethernet de 800 Gbps, mayor ancho de banda entre GPU y aceleración para tareas de red, almacenamiento y seguridad, todo bajo estándares abiertos.

Uno de los aspectos que AMD busca diferenciar frente a NVIDIA es el uso de un ecosistema abierto. Helios se basa en el estándar Open Rack Wide del Open Compute Project y utiliza el software ROCm, compatible de forma nativa con frameworks como PyTorch, TensorFlow, JAX, Hugging Face, ONNX, Triton y vLLM, entre otros.
Cada rack Helios está refrigerado completamente por líquido, pesa cerca de 2,3 toneladas, consume entre 225 y 245 kW y ofrece una capacidad total de 31 TB de memoria HBM4, además de más de 1,4 PB/s de ancho de banda agregado de memoria.
AMD confirmó además que Microsoft Azure será uno de los primeros proveedores de nube en ofrecer instancias basadas en Helios, mientras que empresas como OpenAI, Meta, Oracle, HPE, Nutanix, TCS, Celestica y el Departamento de Energía de Estados Unidos ya figuran entre los primeros clientes o socios de la plataforma.
Fuente: CNBC

