AMD prepara el sistema Instinct MI450X IF128 a escala de bastidor con 128 GPUs
Masterbitz
16 may 2025
2 min de lectura
Según SemiAnalysis, AMD ha planeado su primer clúster de GPU a escala de bastidor para la segunda mitad de 2026, cuando muestre su primer acelerador a escala de bastidor, el Instinct MI450X IF128. Cada tarjeta MI450X IF128, fabricada en lo que se espera que sea un proceso TSMC de 3 nm y empaquetada con CoWoS-L, incluirá al menos 288 GB de memoria HBM4. Esta memoria soportará un ancho de banda de hasta 18 TB/s y proporcionará unos 50 PetaFLOPS de cálculo FP4 con un consumo energético de entre 1,6 y 2,0 kW. En nuestro reciente artículo, destacábamos que AMD había dividido la serie Instinct MI400 en MI430X para HPC y MI450X para IA. Ahora, para la MI450X centrada en la IA, la empresa ha creado una placa base «IF64» para instalaciones más sencillas en un solo bastidor y la «IF128» para máxima densidad. La versión IF128 enlaza 128 GPU a través de una red Infinity Fabric basada en Ethernet y utiliza UALink en lugar de PCIe para conectar cada GPU a tres NIC Pensando 800 GbE integradas. Este diseño proporciona aproximadamente 1,8 TB/s de ancho de banda unidireccional por GPU y un total de 2.304 TB/s en todo el rack.
Con 128 GPU que ofrecen cada una 50 PetaFLOPS de cálculo FP4 y 288 GB de memoria HBM4, el sistema MI450X IF128 proporciona una combinación de 6.400 PetaFLOPS y 36,9 TB de memoria de gran ancho de banda, y MI450X IF64 proporciona aproximadamente la mitad de esa cifra. Dado que las implantaciones de IA requieren una densidad masiva de sistemas en bastidor, AMD planea superar posiblemente al próximo sistema de NVIDIA conocido como «Vera Rubin» VR200 NVL144 (144 chips de cálculo, 72 GPU), que alcanza un máximo de 3.600 PetaFLOPS y 936 TB/s de ancho de banda de memoria, aproximadamente la mitad de lo que promete el enfoque IF128 de AMD. AMD dispondrá de una arquitectura de sistema posiblemente más potente que NVIDIA hasta el lanzamiento de VR300 «Ultra» NVL576, que cuenta con 144 GPU, cada una de ellas con cuatro chips de cálculo, lo que suma un total de 576 chiplets de cálculo.
Huawei también participa en la carrera a escala de bastidor con CloudMatrix 384, que combina 384 chips Ascend 910C en 16 bastidores mediante enlaces ópticos personalizados. Ofrece unos 300 PetaFLOPS de cálculo BF16 con un consumo aproximado de 560 kW, pero depende de ópticas restringidas a la exportación y de una estrategia de cadena de suministro nacional. A medida que aumenta la demanda de clústeres de entrenamiento de IA masivos, el MI450X IF128 de AMD será una prueba clave para comprobar si los tejidos de GPU a escala de bastidor basados en Ethernet pueden ofrecer resultados en los centros de datos del mundo real. Su preparación para la producción y su rendimiento real serán observados de cerca por los operadores de IA a hiperescala de todo el mundo. Con la próxima generación de aceleradores Ascend en preparación, sin plazos exactos, podemos esperar que la guerra de sistemas a escala de bastidor sea bastante intensa en los próximos meses.
Comentarios