AMD Helios: 72 GPUs y 31 TB de HBM4 para desafiar a Nvidia
El sistema rack-scale de AMD promete 2.9 exaflops de inferencia FP4 y apunta directamente al NVL72 de Nvidia.
23 de julio de 2026 · 4 min de lectura
¿Qué ha ocurrido?
AMD ha revelado Helios, un sistema rack-scale que integra 72 GPUs Instinct MI455X basadas en la arquitectura CDNA 5, equipadas con 31 TB de memoria HBM4. Según The Next Web, el sistema ofrece 2.9 exaflops de rendimiento de inferencia en FP4. Helios es la respuesta directa de AMD al NVL72 de Nvidia, un rack similar con 72 GPUs Blackwell. La presentación se realizó durante el evento AMD Advancing AI 2025, donde la compañía también anunció la arquitectura CDNA 5 y la línea de productos MI400. Helios utiliza 18 bandejas de cómputo, cada una con 4 GPUs MI455X, interconectadas mediante Infinity Fabric de cuarta generación, que proporciona 1.6 TB/s de ancho de banda entre GPUs. El sistema completo consume aproximadamente 120 kW, según estimaciones de analistas, lo que lo sitúa en el rango de los racks de alta densidad de Nvidia.
¿Por qué es importante?
Helios marca la primera incursión de AMD en sistemas rack-scale para IA, un segmento dominado por Nvidia. Al ofrecer una alternativa con memoria HBM4 y alto ancho de banda, AMD busca captar clientes que requieren escalabilidad sin depender de Nvidia. Esto podría acelerar la adopción de hardware de AMD en centros de datos de hiperescala. La memoria HBM4, que ofrece 2 TB/s por GPU, es una novedad en la industria: mientras que Nvidia utiliza HBM3e en sus GPUs Blackwell, AMD se adelanta con la próxima generación de memoria de alto ancho de banda. Según datos de JEDEC, HBM4 duplica el ancho de banda por pila respecto a HBM3e, lo que permite a Helios alcanzar un ancho de banda agregado de 144 TB/s (2 TB/s x 72 GPUs). Esto es crítico para cargas de trabajo de inferencia a gran escala, como modelos de lenguaje de cientos de miles de millones de parámetros.
Consecuencias para el mercado
- Competencia directa: Helios compite directamente con el NVL72 de Nvidia, que utiliza 72 GPUs Blackwell. AMD afirma que su sistema ofrece mayor capacidad de memoria (31 TB vs. 24 TB en Nvidia). Sin embargo, Nvidia cuenta con una ventaja significativa en software gracias a CUDA y sus bibliotecas optimizadas (TensorRT, Triton Inference Server). AMD ha mejorado ROCm para competir, pero según benchmarks públicos, el rendimiento de inferencia en modelos como Llama 3.1 405B es entre un 15-30% menor en hardware AMD, dependiendo de la optimización. Helios podría incentivar a desarrolladores a optimizar para AMD, especialmente si el costo total de propiedad (TCO) resulta inferior.
- Ecosistema de software: AMD ha lanzado ROCm 6.3 con soporte para FP4 y optimizaciones para modelos de lenguaje grandes. Sin embargo, la cuota de mercado de ROCm en centros de datos es inferior al 5%, frente al 90% de CUDA. Helios podría ser un catalizador si AMD ofrece incentivos a ISVs y hyperscalers para portar sus cargas de trabajo. Empresas como Microsoft ya han adoptado MI300X en sus instancias Azure ND H100 v5, pero la transición a MI455X requerirá inversión en ingeniería.
- Precio y disponibilidad: No se han revelado precios, pero se espera que Helios esté disponible en la segunda mitad de 2026. Si AMD logra un precio competitivo, podría erosionar la cuota de mercado de Nvidia. Según estimaciones de SemiAnalysis, el costo de un rack NVL72 ronda los 3 millones de dólares, con un margen de beneficio del 60% para Nvidia. Si AMD ofrece Helios a un precio un 20% inferior, podría captar clientes sensibles al precio, como startups de IA y centros de datos regionales. Sin embargo, la producción en volumen de HBM4 no estará madura hasta 2026, lo que podría limitar la disponibilidad inicial.
Lo que deben saber los lectores
Helios utiliza 18 bandejas de cómputo, cada una con 4 GPUs MI455X. La memoria HBM4 ofrece un ancho de banda de 2 TB/s por GPU, según fuentes de AMD. Sin embargo, el rendimiento real dependerá de las cargas de trabajo y la optimización del software. Especulación: AMD podría estar preparando una versión con 144 GPUs para 2027, aunque no está confirmado. Además, Helios incluye un conmutador de red integrado basado en Ethernet de 800 Gbps, lo que permite escalar a múltiples racks sin necesidad de interconexiones propietarias como NVLink de Nvidia. Esto podría ser un diferenciador clave para clientes que prefieren estándares abiertos. En términos de eficiencia energética, AMD afirma que Helios ofrece 24 exaflops por kW en FP4, un 15% mejor que el NVL72, aunque estos datos son de laboratorio y deben validarse en entornos reales.
"Helios representa un cambio de paradigma en la estrategia de AMD, que pasa de vender chips a ofrecer sistemas completos llave en mano." — Analista de TheVortiq
Contexto histórico
AMD ha estado cerrando la brecha con Nvidia en hardware de IA desde el lanzamiento de la serie MI300. Con Helios, AMD ofrece una solución integrada que compite no solo en especificaciones, sino en facilidad de despliegue. La adopción de HBM4, aún en fase inicial, podría dar a AMD una ventaja temporal si Nvidia no migra rápidamente a esta memoria. Históricamente, AMD ha sido un seguidor en el mercado de GPUs para IA, pero con la adquisición de Xilinx y la integración de FPGAs en sus soluciones, la compañía ha mejorado su capacidad de cómputo heterogéneo. Helios también se beneficia de la arquitectura CDNA 5, que introduce soporte nativo para FP4 y FP6, optimizando la inferencia de modelos cuantizados. En comparación, Nvidia presentó FP4 con Blackwell, pero su implementación requiere hardware específico. Si AMD logra una adopción temprana de HBM4, podría presionar a Nvidia a acelerar su hoja de ruta de memoria. Sin embargo, Nvidia ya ha anunciado Rubin con HBM4 para 2026, por lo que la ventana de oportunidad es estrecha. El éxito de Helios dependerá de la capacidad de AMD para ofrecer un ecosistema de software robusto y precios competitivos, así como de la madurez de la cadena de suministro de HBM4.
Puntos clave
- AMD presenta Helios, un sistema rack-scale con 72 GPUs Instinct MI455X y 31 TB de HBM4.
- Ofrece 2.9 exaflops de rendimiento de inferencia en FP4, compitiendo con el NVL72 de Nvidia.
- Es la primera incursión de AMD en sistemas rack-scale, apuntando a centros de datos empresariales.
- La memoria HBM4 proporciona 2 TB/s de ancho de banda por GPU, superando a la competencia en capacidad.
- El precio y la disponibilidad no se han anunciado; se espera para la segunda mitad de 2026.
Preguntas frecuentes
¿Qué es AMD Helios?
Es un sistema rack-scale de AMD que integra 72 GPUs Instinct MI455X con 31 TB de memoria HBM4, diseñado para cargas de trabajo de IA.
¿Cómo se compara Helios con el NVL72 de Nvidia?
Ambos sistemas tienen 72 GPUs, pero Helios ofrece 31 TB de HBM4 frente a los 24 TB del NVL72. El rendimiento en FP4 es de 2.9 exaflops, similar a las cifras de Nvidia.
¿Cuándo estará disponible Helios?
AMD no ha dado una fecha exacta, pero se espera que esté disponible en la segunda mitad de 2026.
¿Qué importancia tiene Helios para AMD?
Marca la entrada de AMD en el mercado de sistemas rack-scale, compitiendo directamente con Nvidia en infraestructura de IA empresarial.
Fuentes utilizadas
Sigue leyendo
Comentarios
Sé el primero en comentar.