L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD all'NVL72 di Nvidia.

L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD all'NVL72 di Nvidia.

      TL;DRAMD Helios racchiude 72 GPU MI455X, 31TB di HBM4 e 2,9 exaflops di inferenza in un solo rack. Costruito su standard aperti. Campioni ingegneristici H2 2026, produzione di massa Q2 2027.

      Helios di AMD è un rack singolo che contiene 72 GPU Instinct MI455X, 31 terabyte di memoria HBM4 e 2,9 exaflops di calcolo inferenziale FP4. È il primo sistema AI su scala rack di AMD e la sua risposta diretta al NVL72 di Nvidia. Il sistema utilizza 18 vassoi di calcolo, ciascuno contenente quattro acceleratori MI455X sulla nuova architettura CDNA 5 e una CPU EPYC “Venice” di sesta generazione. I campioni ingegneristici saranno spediti nella seconda metà del 2026. La produzione di massa inizia nel Q2 2027.

      La scommessa architettonica è sugli standard aperti. Helios utilizza UALink per l'interconnessione scalabile tra le GPU all'interno del rack, le specifiche del Consorzio Ultra Ethernet per il networking scalabile tra i rack e il fattore di forma OCP Open Rack Wide. Il concorrente NVL72 di Nvidia utilizza NVLink proprietario. AMD scommette che gli operatori di data center che non vogliono essere bloccati nell'interconnessione di un singolo fornitore pagheranno per la flessibilità. Le schede di rete AI AMD Pensando gestiscono il networking con hardware programmabile e RDMA pronto per UEC.

      I numeri sono progettati per competere sulla memoria, non solo sul calcolo. Ogni GPU MI455X porta HBM4 con 19,6 TB/s di larghezza di banda. L'intero rack offre 260 TB/s di larghezza di banda scalabile e 43 TB/s di larghezza di banda scalabile. Questa capacità di memoria è importante per l'addestramento di modelli di frontiera e inferenza a lungo contesto, dove il collo di bottiglia è passato dal calcolo grezzo a quanto dato il sistema può contenere e muovere. La crisi della memoria guidata dall'AI ha fatto salire bruscamente i prezzi dell'HBM, e 31TB di HBM4 in un singolo rack rappresentano un enorme costo dei materiali che solo i budget di hyperscaler e di calcolo sovrano possono assorbire.

      Il 💜 della tecnologia dell'UELe ultime novità dalla scena tecnologica dell'UE, una storia dal nostro saggio fondatore Boris e alcune opere d'arte AI discutibili. È gratuito, ogni settimana, nella tua casella di posta. Iscriviti ora!Supermicro ha mostrato l'hardware Helios al Computex a giugno. AMD ha impegnato miliardi per l'infrastruttura AI nel Regno Unito durante la London Tech Week, e Helios è l'hardware su cui si baseranno quegli impegni. Il stack software ROCm supporta PyTorch, TensorFlow e JAX, il che significa che gli sviluppatori non devono riscrivere il codice per passare dall'ecosistema CUDA di Nvidia, almeno in teoria. Se AMD può colmare il divario software che l'ha tenuta indietro rispetto a Nvidia nel calcolo AI è la domanda che Helios è progettato per forzare. Le specifiche hardware sono competitive. L'ecosistema è la prova.

      

      

      

       Ricevi la newsletter TNW

       Ricevi le notizie tecnologiche più importanti nella tua casella di posta ogni settimana.

Altri articoli

Un mini laboratorio delle dimensioni di AirPods potrebbe aiutare a rilevare i marcatori di malattia in pochi minuti. Un mini laboratorio delle dimensioni di AirPods potrebbe aiutare a rilevare i marcatori di malattia in pochi minuti. Il VPodDuo delle dimensioni di una custodia per AirPods si collega a uno smartphone e legge i test molecolari per virus, batteri e biomarcatori associati al cancro in circa 10 minuti. Chip congelato di Google: Gemini integrato nel silicio Chip congelato di Google: Gemini integrato nel silicio Un rapporto afferma che il chip Google Frozen integrerebbe Gemini nel silicio per un'efficienza fino a 10 volte entro il 2028. Cosa significa per l'IA. OneDrive bloccherà gli screenshot di documenti sensibili, ma solo nel browser di Microsoft. OneDrive e SharePoint bloccheranno le catture dello schermo di PDF con etichetta di sensibilità in Edge a partire da agosto. Chrome, Firefox e Safari non riceveranno la funzionalità. I single stanno usando ChatGPT e Claude per scrivere i loro messaggi di appuntamenti. Le app non hanno intenzione di fermarlo. I single stanno usando ChatGPT e Claude per scrivere i loro messaggi di appuntamenti. Le app non hanno intenzione di fermarlo. Il 26% degli adulti statunitensi ha utilizzato l'IA per ricevere aiuto negli appuntamenti. Match, Hinge e Bumble affermano di non filtrare i messaggi scritti dall'IA. Il fenomeno è chiamato chatfishing. Z.AI ha costruito un gigantesco centro dati AI su chip prodotti in Cina. Z.AI ha costruito un gigantesco centro dati AI su chip prodotti in Cina. Il laboratorio cinese Z.AI ha completato un centro dati da 1GW che utilizza solo chip prodotti in Cina per addestrare i suoi modelli GLM, senza Nvidia all'interno. Cosa significa per l'IA. L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD all'Nvidia NVL72. L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD all'Nvidia NVL72. AMD Helios include 72 GPU MI455X, 31TB di HBM4 e 2,9 exaflop di calcolo per inferenza in un singolo rack. I campioni ingegneristici saranno spediti nel secondo semestre del 2026. La produzione di massa inizierà nel secondo trimestre del 2027.

L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD all'NVL72 di Nvidia.

AMD Helios include 72 GPU MI455X, 31TB di HBM4 e 2,9 exaflops di calcolo per inferenza in un singolo rack. I campioni ingegneristici saranno spediti nel secondo semestre del 2026. La produzione di massa inizierà nel secondo trimestre del 2027.