Cerebras lancia il CS-4, il suo primo sistema multi-wafer, anche se il chip all'interno non è nuovo.

Cerebras lancia il CS-4, il suo primo sistema multi-wafer, anche se il chip all'interno non è nuovo.

      Cerebras ha messo per la prima volta tre dei suoi processori delle dimensioni di un piatto da cena in un unico rack. Il CS-4, svelato martedì all'evento Supernova dell'azienda e in spedizione in questo trimestre, è presentato come una macchina di inferenza per modelli all'avanguardia, e Cerebras afferma che li esegue fino a 30 volte più velocemente rispetto ai sistemi basati su GPU.

      Il lancio avviene cinque giorni dopo che la modalità Ultrafast di OpenAI, che esegue GPT-5.6 Sol circa 14 volte più velocemente su silicio Cerebras, è stata attivata. È anche il primo hardware che l'azienda ha spedito dal suo debutto al Nasdaq da 5,55 miliardi di dollari a maggio, la più grande quotazione tecnologica statunitense da Snowflake.

      Sulla carta, il sistema è formidabile. Ogni CS-4 porta tre wafer WSE-3 Turbo per un totale di 750 petaflops di calcolo FP16 sparso, 129,6 petabyte al secondo di larghezza di banda della memoria e supporto per modelli oltre 50 trilioni di parametri.

      La latenza wafer-to-wafer scende a due microsecondi da cinque, e il rack utilizza la metà dei componenti rispetto al suo predecessore. Cerebras ha spostato la conversione di potenza, con la sua stessa formulazione, cento volte più vicino ai processori, montandola in uno zaino rimovibile sul retro del telaio.

      Ciò che è meno chiaro è se il chip all'interno sia effettivamente nuovo. Il WSE-3 Turbo porta gli stessi quattro trilioni di transistor, gli stessi 900.000 core, gli stessi 44 GB di SRAM on-chip e lo stesso nodo TSMC da 5 nm del WSE-3 che sostituisce.

      The Register ha concluso che non si tratta di un nuovo silicio, quanto piuttosto del die esistente spinto da circa 1,4 GHz a 2,8 GHz. Il calcolo e la larghezza di banda per wafer raddoppiano esattamente, il che è il segno di un aumento della frequenza piuttosto che di un redesign, e Cerebras ha una generazione genuinamente nuova programmata per il 2027 comunque.

      La rivendicazione di 30 volte misura i token al secondo per utente su un singolo modello, gpt-oss-120b, rispetto a sistemi GPU non nominati, e i 250 petaflops per wafer sono un numero FP16 sparso rispetto ai 25 petaflops densi.

      Dove il design sembra genuinamente differenziato è nel consumo energetico. The Register stima il CS-4 a circa 120-140 kilowatt per rack, circa la metà di ciò che i sistemi rack AMD e Nvidia comparabili assorbono, il che rende plausibile il guadagno dichiarato di dieci volte nel throughput per watt.

      Andrew Feldman, l'amministratore delegato, ha inquadrato il lancio attorno alla latenza piuttosto che al throughput grezzo. “Nell'IA, la velocità è produttività,” ha detto nell'annuncio, e ha detto a Reuters che l'azienda si aspetta di diventare “quattro volte più veloce tra ora e la fine del 2027, e 20 volte più throughput”.

      Sean Lie, il direttore tecnico, ha legato l'argomento della velocità agli agenti piuttosto che ai chatbot. Essere 30 volte più veloci, ha detto, “dà a un sistema agentico spazio per più di un ordine di grandezza di ragionamento, verifica o utilizzo di strumenti”, che è la parte della proposta rivolta agli acquirenti aziendali piuttosto che alle tabelle di benchmark.

      Cerebras ha nominato OpenAI, G42, MBZUAI e AWS insieme al lancio, anche se non ha rivelato alcun accordo con clienti CS-4 e nessun prezzo.

      Il rack Helios di AMD, svelato a luglio, è presente nella lista dei partner, il che è coerente con un'azienda che ha dichiarato che lavorerà con tutti nel settore hardware per l'IA tranne Nvidia.

      Il contesto finanziario è misto. I ricavi del secondo trimestre sono stati di 180,1 milioni di dollari, in aumento del 74% rispetto all'anno precedente, con i ricavi cloud che quasi quadruplicano, ma sono diminuiti sequenzialmente rispetto ai 193,4 milioni di dollari del primo trimestre, e la pressione sui margini che Cerebras ha segnalato a giugno non è diminuita.

      Il trimestre ha prodotto una perdita netta GAAP di 450,5 milioni di dollari, una perdita rettificata di 6,9 milioni di dollari e 25,4 miliardi di dollari in obbligazioni di prestazione rimanenti. Cerebras prevede ricavi per l'intero anno tra 880 milioni e 890 milioni di dollari e 600 megawatt di capacità del data center attivi e sotto contratto entro la fine del 2027.

      La concentrazione rimane la questione strutturale. G42 e l'Università di Intelligenza Artificiale Mohamed bin Zayed hanno rappresentato insieme circa l'86% dei ricavi del 2025, e il contratto con OpenAI firmato a gennaio, del valore di oltre 10 miliardi di dollari alla firma, è la risposta dell'azienda a questo, insieme alle aggiunte del secondo trimestre tra cui Cognition, Lovable, CrowdStrike, Block e Figma.

      Le prime spedizioni del CS-4 sono previste prima della fine del trimestre. La prova più difficile arriverà nel 2027, quando la prossima generazione dovrà arrivare su nuovo silicio piuttosto che su un clock più veloce.

Altri articoli

La fabbrica di batterie Lansing da 2 miliardi di dollari di LG sta ora producendo celle. La fabbrica di batterie Lansing da 2 miliardi di dollari di LG sta ora producendo celle. LG Energy Solution ha avviato la produzione a Lansing, Michigan, in un impianto pianificato, parzialmente finanziato e venduto da GM. I suoi clienti sono ora Toyota e Tesla. ChatGPT sta ottenendo una versione per adolescenti, e ho molte domande. ChatGPT sta ottenendo una versione per adolescenti, e ho molte domande. Gli adolescenti stanno già usando l'IA per i compiti e molto altro. La nuova esperienza di ChatGPT di OpenAI vuole assicurarsi che stiano effettivamente imparando da essa — con alcune serie misure di sicurezza. Medly AI raccoglie 8 milioni di dollari per mettere un tutor AI di fronte a ogni studente che sostiene esami nel Regno Unito. Medly AI raccoglie 8 milioni di dollari per mettere un tutor AI di fronte a ogni studente che sostiene esami nel Regno Unito. Medly AI ha raccolto 8 milioni di dollari in un round di finanziamento iniziale guidato da Felix Capital, poche settimane dopo aver vinto un contratto del governo britannico da 300.000 sterline per testare il tutoraggio AI su studenti in difficoltà. SK Hynix riacquisterà 28,6 miliardi di dollari delle proprie azioni, il più grande riacquisto nella storia aziendale coreana. SK Hynix riacquisterà 28,6 miliardi di dollari delle proprie azioni, il più grande riacquisto nella storia aziendale coreana. SK Hynix ha approvato un riacquisto di azioni da 40 trilioni di won (28,6 miliardi di dollari), il più grande da parte di un'azienda coreana quotata, dopo che un trimestre record non è riuscito a far salire il suo titolo. Dai cockpit intelligenti alle auto native AI, Banma Intelligence punta alla prossima ondata di software automobilistico Dai cockpit intelligenti alle auto native AI, Banma Intelligence punta alla prossima ondata di software automobilistico Man mano che i grandi modelli di intelligenza artificiale accelerano la loro integrazione nei veicoli, le dinamiche competitive delle auto intelligenti stanno cambiando. In passato, i cruscotti intelligenti Questo EV del 1918 aveva 42 batterie e più autonomia di una Leaf del 2011. Questo EV del 1918 aveva 42 batterie e più autonomia di una Leaf del 2011. Una Detroit Electric del 1918 offerta a Monterey dichiarava un'autonomia di 80 miglia, più della prima Nissan Leaf. Ciò che la fece fallire fu il prezzo, non l'autonomia.

Cerebras lancia il CS-4, il suo primo sistema multi-wafer, anche se il chip all'interno non è nuovo.

Il CS-4 di Cerebras racchiude tre wafer in un rack e afferma di avere una velocità GPU 30 volte superiore. Il processore all'interno, però, è un WSE-3 con clock più veloce.