L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD al NVL72 di Nvidia.

L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD al NVL72 di Nvidia.

      TL;DRAMD Helios racchiude 72 GPU MI455X, 31TB di HBM4 e 2,9 exaflops di inferenza in un unico rack. Costruito su standard aperti. Campioni ingegneristici H2 2026, produzione di massa Q2 2027.

      Helios di AMD è un rack singolo contenente 72 GPU Instinct MI455X, 31 terabyte di memoria HBM4 e 2,9 exaflops di calcolo inferenziale FP4. È il primo sistema AI su scala rack di AMD e la sua risposta diretta al NVL72 di Nvidia. Il sistema utilizza 18 vassoi di calcolo, ciascuno contenente quattro acceleratori MI455X sulla nuova architettura CDNA 5 e una CPU EPYC “Venice” di sesta generazione. I campioni ingegneristici saranno spediti nella seconda metà del 2026. La produzione di massa inizia nel Q2 2027.

      La scommessa architettonica è sugli standard aperti. Helios utilizza UALink per l'interconnessione scalabile tra GPU all'interno del rack, le specifiche del Consorzio Ultra Ethernet per il networking scalabile tra rack e il fattore di forma OCP Open Rack Wide. Il concorrente NVL72 di Nvidia utilizza NVLink proprietario. AMD scommette che gli operatori di data center che non vogliono essere bloccati nell'interconnessione di un singolo fornitore pagheranno per la flessibilità. Le schede di rete AI AMD Pensando gestiscono il networking con hardware programmabile e RDMA pronto per UEC.

      I numeri sono progettati per competere sulla memoria, non solo sul calcolo. Ogni GPU MI455X porta HBM4 con 19,6 TB/s di larghezza di banda. L'intero rack offre 260 TB/s di larghezza di banda scalabile e 43 TB/s di larghezza di banda scalabile. Questa capacità di memoria è importante per l'addestramento di modelli di frontiera e inferenza a lungo contesto, dove il collo di bottiglia è passato dal calcolo grezzo a quanto dati il sistema può contenere e muovere. La crisi della memoria guidata dall'AI ha fatto aumentare drasticamente i prezzi dell'HBM, e 31TB di HBM4 in un unico rack rappresentano un enorme costo di materiali che solo i budget di hyperscaler e di calcolo sovrano possono assorbire.

      Il 💜 della tecnologia UELe ultime novità dalla scena tecnologica dell'UE, una storia dal nostro saggio fondatore Boris e alcune opere d'arte AI discutibili. È gratuito, ogni settimana, nella tua casella di posta. Iscriviti ora!Supermicro ha mostrato l'hardware Helios a Computex a giugno. AMD ha impegnato miliardi per l'infrastruttura AI nel Regno Unito durante la London Tech Week, e Helios è l'hardware su cui si baseranno quegli impegni. Lo stack software ROCm supporta PyTorch, TensorFlow e JAX, il che significa che gli sviluppatori non devono riscrivere il codice per passare dall'ecosistema CUDA di Nvidia, almeno in teoria. Se AMD può colmare il divario software che l'ha tenuta indietro rispetto a Nvidia nel calcolo AI è la domanda a cui Helios è progettato per rispondere. Le specifiche hardware sono competitive. L'ecosistema è la prova.

      

      

      

       Ricevi la newsletter TNW

       Ricevi le notizie tecnologiche più importanti nella tua casella di posta ogni settimana.

Altri articoli

Le panoramiche sull'IA di Google si basano su Facebook, secondo una ricerca. Le panoramiche sull'IA di Google si basano su Facebook, secondo una ricerca. La ricerca di BrightEdge afferma che le panoramiche di Google AI hanno citato Facebook 19,5 milioni di volte e trattano ogni piattaforma sociale come un esperto. Cosa significa per i marchi. Microsoft vuole fermare le perdite di screenshot, una scheda Edge alla volta Microsoft vuole fermare le perdite di screenshot, una scheda Edge alla volta Microsoft sta chiudendo una falla di sicurezza che consentiva di catturare PDF sensibili all'interno dei browser web. Anche se la protezione richiede inizialmente Edge e un account aziendale. Chip congelato di Google: Gemini integrato nel silicio Chip congelato di Google: Gemini integrato nel silicio Un rapporto afferma che il chip Google Frozen integrerebbe Gemini nel silicio per un'efficienza fino a 10 volte entro il 2028. Cosa significa per l'IA. La fusione tra Paramount e Warner Bros. bloccata da un'ingiunzione temporanea un giorno prima della chiusura La fusione tra Paramount e Warner Bros. bloccata da un'ingiunzione temporanea un giorno prima della chiusura Un giudice della California ha emesso un'ordinanza restrittiva temporanea sull'accordo Paramount-WBD dopo che i procuratori generali statali hanno citato "prove convincenti" di concentrazione di mercato. Una commissione di $650 milioni a trimestre incombe. Le auto elettriche hanno superato le vendite di quelle a benzina e diesel in Germania per la prima volta. Il luogo di nascita dell'auto ha appena cambiato il suo carburante. Le auto elettriche hanno superato le vendite di quelle a benzina e diesel in Germania per la prima volta. Il luogo di nascita dell'auto ha appena cambiato il suo carburante. La Germania ha registrato 84.057 veicoli elettrici a giugno, superando gli ibridi (83.315), la benzina (60.796) e il diesel (33.862). I veicoli elettrici ora detengono il 28,4% del mercato. La Tesla Model Y ha guidato. Il vecchio internet ha costruito un museo per i suoni della tecnologia morente, e in qualche modo è ancora vivo. Il vecchio internet ha costruito un museo per i suoni della tecnologia morente, e in qualche modo è ancora vivo. Questo meravigliosamente datato museo online conserva modem dial-up, unità floppy, suoni di avvio di Windows e altri suoni che sono scomparsi silenziosamente mentre i nostri gadget diventavano più eleganti, veloci e molto meno loquaci.

L'Helios di AMD mette 72 GPU e 31 terabyte di HBM4 in un rack. È la risposta di AMD al NVL72 di Nvidia.

AMD Helios include 72 GPU MI455X, 31TB di HBM4 e 2,9 exaflop di calcolo per l'inferenza in un unico rack. I campioni ingegneristici verranno spediti nel secondo semestre del 2026. La produzione di massa inizierà nel secondo trimestre del 2027.