- Helios de AMD supera al Vera Rubin NVL72 en memoria a nivel de rack, con 31 TB del HBM4 frente a aproximadamente 20,7 TB.
- AMD también afirma que supera a la competencia en computación FP4 en un 15% “por GPU”, e incluso sale adelante en las cifras “por rack” publicadas por Nvidia.
- AMD afirma que Helios también ofrece un 30% más de tokens por dólar gastado que la competencia
AMD lanzó su oferta Helios rackscale y describió cinco comparaciones en las que afirmó ser la “solución competitiva líder”.
Si bien la compañía evita la nomenclatura de Nvidia, la solución de escala en rack NVL72 basada en Vera Rubin del líder del mercado es el único competidor real de Helios y con el que continúa comparándose.
Si bien sus afirmaciones de memoria se mantienen, sus afirmaciones de GPU FP4 pueden ser menores al comparar bastidor con bastidor, y muchos de sus cálculos se basan en el rendimiento máximo en lugar de los números publicados por Nvidia, lo que hace que Helios sea una “victoria” interesante pero alienta a los posibles adoptantes a mirar más de cerca.
Último vídeo deTecnologíaRadar
Un juego de números que sigue complicándose incluso cuando AMD logra algunas victorias
Si bien AMD reclama una victoria del 15% sobre Ruby de Nvidia por GPU para el cómputo FP4, su solución de escala de rack de 72 GPU no alcanza los números de nivel de rack publicados por Nvidia: 2,9 exaflops frente a 3,6. AMD no especifica si está contando las muertes individuales de Nvidia o sus paquetes de dos matrices, y la diferencia es significativa: la brecha contra las matrices es más del 15% a favor de AMD, mientras que está a favor de AMD contra los paquetes.
Las dos cifras también utilizan un formato diferente, MXFP4 de AMD en contraposición al NVFP4 de Nvidia, por lo que no miden una aritmética idéntica.
Sin embargo, esto puede ser indicativo de una situación muy real que obstaculiza las cifras principales de ambos proveedores: las cargas de trabajo del FP4 en el mundo real rara vez alcanzan las clasificaciones máximas de hardware debido a las limitaciones de movimiento de la memoria, la sobrecarga de programación y la eficiencia del kernel del software. Como admitió AMD en su propio evento, el rendimiento medido en el FP4 fue aproximadamente la mitad de la calificación máxima.
Gracias a su CPU Vera personalizada, una pila de software NVLink 6 madura y un grupo más grande de lo que Nvidia llama memoria más rápida, 20,7 TB de HBM4 cuentan con 54 TB de LPDDR5X con 75 TB por bastidor. Los 31 TB de AMD son todos HBM, que son más adecuados para modelos que deberían residir completamente en memoria de gran ancho de banda, y Helios ofrece mayor capacidad y ancho de banda por acelerador a 432 GB y 23,3 TB/s.
En la estructura escalable sin procesar, ambos son planos y ambos ofrecen 3,6 TB/s por acelerador y 260 TB/s por rack.
A pesar de esto, Helios es un producto excepcionalmente sólido sobre el papel, y es la primera vez que AMD crea una respuesta creíble a escala de rack para Nvidia desde que comenzó la carrera de la IA. Setenta aceleradores MI455X, 18 CPU EPYC Venice, 31 TB de HBM4, UALink sobre Ethernet dentro del rack y Ultra Ethernet fuera, en un chasis OCP de rack abierto con silicio de conmutador Broadcom comercial, es una respuesta seria que se produjo dos años después de la puesta en marcha de la empresa.
Más importante aún, las especificaciones de su tejido están disponibles públicamente, lo que permite a los hiperescaladores crear variantes personalizadas que satisfagan sus necesidades. La plataforma de Nvidia no ofrece una latitud equivalente.
AMD enmarcó la apertura como un beneficio central de la plataforma, y Vamsi Boppana, vicepresidente senior de IA de AMD, dijo que Helios “reúne informática líder en la industria, redes de alto rendimiento y software abierto en una plataforma unificada a escala de rack”.
Sin embargo, la cuestión más importante para AMD puede ser el suministro de memoria. Nvidia tiene a Vera Rubin en plena producción desde el primer trimestre con la disponibilidad de la mitad de estos socios, mientras que la primera implementación de Helios de AMD no es hasta el cuarto trimestre. AMD puede verse aún más afectado por el suministro de HBM4, gran parte del cual ya se sabe que está comprometido con el hiperescalador, lo que podría mantener su volumen de implementación por debajo de Nvidia este año.
Siga TechRadar en Google News Y Agréguenos como fuente preferida Recibe noticias, reseñas y opiniones de nuestros expertos en tu feed.