Cerebras lancia il CS-4, il suo primo sistema multi-wafer, anche se il chip all'interno non è nuovo.
Cerebras ha messo per la prima volta tre dei suoi processori delle dimensioni di un piatto da cena in un unico rack. Il CS-4, svelato martedì all'evento Supernova dell'azienda e in spedizione in questo trimestre, è presentato come una macchina di inferenza per modelli all'avanguardia, e Cerebras afferma che li esegue fino a 30 volte più velocemente rispetto ai sistemi basati su GPU.
Il lancio avviene cinque giorni dopo che la modalità Ultrafast di OpenAI, che esegue GPT-5.6 Sol circa 14 volte più velocemente su silicio Cerebras, è stata attivata. È anche il primo hardware che l'azienda ha spedito dal suo debutto al Nasdaq da 5,55 miliardi di dollari a maggio, la più grande quotazione tecnologica statunitense da Snowflake.
Sulla carta, il sistema è formidabile. Ogni CS-4 porta tre wafer WSE-3 Turbo per un totale di 750 petaflops di calcolo FP16 sparso, 129,6 petabyte al secondo di larghezza di banda della memoria e supporto per modelli oltre 50 trilioni di parametri.
La latenza wafer-to-wafer scende a due microsecondi da cinque, e il rack utilizza la metà dei componenti rispetto al suo predecessore. Cerebras ha spostato la conversione di potenza, con la sua stessa formulazione, cento volte più vicino ai processori, montandola in uno zaino rimovibile sul retro del telaio.
Ciò che è meno chiaro è se il chip all'interno sia effettivamente nuovo. Il WSE-3 Turbo porta gli stessi quattro trilioni di transistor, gli stessi 900.000 core, gli stessi 44 GB di SRAM on-chip e lo stesso nodo TSMC da 5 nm del WSE-3 che sostituisce.
The Register ha concluso che non si tratta di un nuovo silicio, quanto piuttosto del die esistente spinto da circa 1,4 GHz a 2,8 GHz. Il calcolo e la larghezza di banda per wafer raddoppiano esattamente, il che è il segno di un aumento della frequenza piuttosto che di un redesign, e Cerebras ha una generazione genuinamente nuova programmata per il 2027 comunque.
La rivendicazione di 30 volte misura i token al secondo per utente su un singolo modello, gpt-oss-120b, rispetto a sistemi GPU non nominati, e i 250 petaflops per wafer sono un numero FP16 sparso rispetto ai 25 petaflops densi.
Dove il design sembra genuinamente differenziato è nel consumo energetico. The Register stima il CS-4 a circa 120-140 kilowatt per rack, circa la metà di ciò che i sistemi rack AMD e Nvidia comparabili assorbono, il che rende plausibile il guadagno dichiarato di dieci volte nel throughput per watt.
Andrew Feldman, l'amministratore delegato, ha inquadrato il lancio attorno alla latenza piuttosto che al throughput grezzo. “Nell'IA, la velocità è produttività,” ha detto nell'annuncio, e ha detto a Reuters che l'azienda si aspetta di diventare “quattro volte più veloce tra ora e la fine del 2027, e 20 volte più throughput”.
Sean Lie, il direttore tecnico, ha legato l'argomento della velocità agli agenti piuttosto che ai chatbot. Essere 30 volte più veloci, ha detto, “dà a un sistema agentico spazio per più di un ordine di grandezza di ragionamento, verifica o utilizzo di strumenti”, che è la parte della proposta rivolta agli acquirenti aziendali piuttosto che alle tabelle di benchmark.
Cerebras ha nominato OpenAI, G42, MBZUAI e AWS insieme al lancio, anche se non ha rivelato alcun accordo con clienti CS-4 e nessun prezzo.
Il rack Helios di AMD, svelato a luglio, è presente nella lista dei partner, il che è coerente con un'azienda che ha dichiarato che lavorerà con tutti nel settore hardware per l'IA tranne Nvidia.
Il contesto finanziario è misto. I ricavi del secondo trimestre sono stati di 180,1 milioni di dollari, in aumento del 74% rispetto all'anno precedente, con i ricavi cloud che quasi quadruplicano, ma sono diminuiti sequenzialmente rispetto ai 193,4 milioni di dollari del primo trimestre, e la pressione sui margini che Cerebras ha segnalato a giugno non è diminuita.
Il trimestre ha prodotto una perdita netta GAAP di 450,5 milioni di dollari, una perdita rettificata di 6,9 milioni di dollari e 25,4 miliardi di dollari in obbligazioni di prestazione rimanenti. Cerebras prevede ricavi per l'intero anno tra 880 milioni e 890 milioni di dollari e 600 megawatt di capacità del data center attivi e sotto contratto entro la fine del 2027.
La concentrazione rimane la questione strutturale. G42 e l'Università di Intelligenza Artificiale Mohamed bin Zayed hanno rappresentato insieme circa l'86% dei ricavi del 2025, e il contratto con OpenAI firmato a gennaio, del valore di oltre 10 miliardi di dollari alla firma, è la risposta dell'azienda a questo, insieme alle aggiunte del secondo trimestre tra cui Cognition, Lovable, CrowdStrike, Block e Figma.
Le prime spedizioni del CS-4 sono previste prima della fine del trimestre. La prova più difficile arriverà nel 2027, quando la prossima generazione dovrà arrivare su nuovo silicio piuttosto che su un clock più veloce.
Altri articoli
Cerebras lancia il CS-4, il suo primo sistema multi-wafer, anche se il chip all'interno non è nuovo.
Il CS-4 di Cerebras racchiude tre wafer in un rack e afferma di avere una velocità GPU 30 volte superiore. Il processore all'interno, però, è un WSE-3 con clock più veloce.
