Nvidia afferma che Vera Rubin è in piena produzione, con OpenAI pronta a distribuire su larga scala nel terzo trimestre.
TL;DRNvidia ha confermato che la piattaforma Vera Rubin è in piena produzione, con OpenAI che la implementerà su larga scala nel terzo trimestre e CoreWeave che riporta dieci volte l'output di token. Nvidia ha confermato lunedì che la sua piattaforma Vera Rubin ha raggiunto la piena produzione, con Ian Buck, vicepresidente della computazione accelerata dell'azienda, che ha detto ai giornalisti presso la sede di Nvidia che i sistemi sono ora in fase di spedizione ai clienti, tra cui OpenAI, CoreWeave, Google Cloud, Microsoft Azure, Meta e Dell. OpenAI prevede di adottare Vera Rubin su larga scala durante il terzo trimestre, secondo Bloomberg, che ha riportato per primo il briefing. CoreWeave, uno dei primi fornitori di cloud a ricevere l'hardware, ha detto a Bloomberg che i suoi rack NVL72 stanno fornendo dieci volte l'output di token della generazione precedente. L’NVL72 è un sistema a rack completo che abbina 72 GPU Rubin con CPU Vera e utilizza il raffreddamento a liquido per eliminare il cablaggio interno, un cambiamento di design che Nvidia ha dimostrato durante l'evento presso la sede. Buck ha affermato che l'approccio al raffreddamento consente all'azienda di rimuovere le connessioni in rame che in precedenza limitavano quanto strettamente i componenti potessero essere impacchettati insieme. La CPU Vera è il componente che Nvidia ha costruito per sostituire i processori che in precedenza acquistava da altri, e l'azienda ha utilizzato il briefing per fare confronti diretti con AMD. Nvidia ha affermato che la CPU Vera è quasi due volte più veloce del chip Turin di AMD su carichi di lavoro Python, un benchmark scelto perché Python domina lo stack software che esegue la maggior parte delle inferenze AI. Anthropic e OpenAI sono tra i primi laboratori a ricevere il processore, insieme a Perplexity, SpaceX e Oracle. Il 💜 della tecnologia UELe ultime voci dalla scena tecnologica dell'UE, una storia del nostro saggio fondatore Boris e alcune opere d'arte AI discutibili. È gratuito, ogni settimana, nella tua casella di posta. Iscriviti ora!Il traguardo della produzione arriva in un momento imbarazzante per le azioni di Nvidia. Le azioni dell'azienda sono aumentate del nove percento quest'anno, mentre l'indice dei chip più ampio è salito del 66 percento nello stesso periodo, secondo Bloomberg. Intel, ARM e AMD hanno più che raddoppiato. Gli analisti prevedono che i ricavi di Nvidia aumenteranno dell'82 percento a circa 393 miliardi di dollari per l'anno fiscale, ma quel tasso di crescita non si è tradotto nel tipo di slancio del prezzo delle azioni che gli investitori hanno visto durante il ciclo Blackwell. Nvidia ha costantemente sviluppato la storia di Vera Rubin negli ultimi due mesi. Jensen Huang ha dichiarato che la piattaforma è in piena produzione al Computex all'inizio di giugno e ha nominato Anthropic, OpenAI, SpaceX e Oracle come primi destinatari. Il briefing di lunedì ha aggiunto i numeri di prestazione e le testimonianze dei clienti che il palco principale non ha fornito, trasformando un'affermazione in un insieme di benchmark misurabili. I numeri che Nvidia ha scelto di evidenziare sono i propri e quelli dei suoi clienti piuttosto che test indipendenti, una distinzione degna di nota. La cifra di token dieci volte superiore di CoreWeave e il benchmark Python contro AMD provengono dal briefing dell'azienda, non da una terza parte. Le spedizioni in volume tra tutti i clienti nominati e la verifica indipendente delle affermazioni sulle prestazioni sono ancora da venire.
Altri articoli
Nvidia afferma che Vera Rubin è in piena produzione, con OpenAI pronta a distribuire su larga scala nel terzo trimestre.
Nvidia ha mostrato i sistemi Vera Rubin presso la sua sede, con Ian Buck che ha confermato la produzione completa e OpenAI che pianifica un'implementazione su larga scala in questo trimestre.
