Il fossato di CUDA di Nvidia affronta la sua prima vera minaccia: l'IA stessa
La storia abituale su Nvidia è una storia di hardware: i chip più veloci, nella fornitura più limitata, al prezzo più alto. La parte più importante è il software. Per due decenni, il vero fossato dell'azienda è stato CUDA. È il livello che trasforma il suo silicio in qualcosa su cui gli sviluppatori possono costruire l'IA. Quel fossato ora è messo alla prova.
CUDA, acronimo di Compute Unified Device Architecture, ha richiesto anni per essere costruito. Raggruppa codice pronto all'uso e strumenti di debug. Permette anche a migliaia di chip di addestrare un modello insieme. La nuova minaccia è diretta: agenti di codifica IA che possono scrivere quel tipo di software di basso livello da soli.
Jeremy Nixon è un ex ricercatore di Google Brain che ha fondato la startup Infinity. Ha detto a Business Insider che il suo team ha utilizzato agenti per ricostruire software simile a CUDA per l'azienda di chip D-Matrix in circa 10 ore. L'ha presentato come prova che uno dei fossati più grandi di Nvidia sta venendo superato.
Due fossati, entrambi sotto pressione
Il primo vantaggio di CUDA è il software. Il secondo è tutto ciò che è costruito sopra di esso. Milioni di righe di codice aziendale e flussi di lavoro rendono lento e costoso il passaggio a un chip rivale. I documenti di Amazon una volta hanno segnalato CUDA come un grande ostacolo all'adozione dei suoi chip IA interni.
Gli agenti intaccano il primo vantaggio. La pressione non proviene solo dalle startup. Google, Amazon e Microsoft hanno trascorso anni a scrivere software per i propri chip. OpenAI e Anthropic hanno mostrato modelli che possono generare codice di sistema. Il fondatore di DeepSeek ha detto che gli agenti di codifica, insieme al proprio linguaggio di programmazione, hanno reso molto più facile costruire software IA.
Nvidia non contesta tanto la tendenza quanto la rivendica. Dice che gli sviluppatori si affidano sempre di più alle librerie di CUDA ogni anno. Utilizza anche agenti di codifica per costruire CUDA più velocemente. Il lock-in, in altre parole, potrebbe piegarsi prima di rompersi.
Il problema dell'inferenza
La minaccia più acuta è un cambiamento in ciò per cui servono i chip IA. Man mano che l'industria passa dall'addestramento dei modelli all'esecuzione degli stessi, le priorità cambiano. Gli acquirenti si preoccupano meno delle prestazioni massime e più di eseguire l'IA a basso costo. Questo avvantaggia il software che funziona su chip diversi, non il software saldato a un singolo fornitore.
Dal lato dell'inferenza, CUDA “non è più un fattore”, ha detto Marshall Choy della startup coreana di chip Rebellions. Lo definisce un gioco open source. È la stessa apertura che i nostri altri sfidanti dell'inferenza stanno inseguendo. Pensate ai chip ottici, al silicio di rete e all'alternativa open-source di Alibaba a CUDA stessa.
Chris Lattner, il cui startup Modular costruisce software IA indipendente dai chip, afferma che l'età di CUDA ha un effetto doppio. Porta con sé anni di eredità dalle sue origini nel gaming, dice, “come Microsoft Windows che cerca di adattarsi a un telefono.” Wall Street se n'è accorta. Gli analisti leggono l'andamento piatto delle azioni di Nvidia nell'ultimo anno come parzialmente una scommessa contro il fossato.
Il fossato potrebbe semplicemente spostarsi
Il controargomento è che gli agenti spostano il fossato piuttosto che rimuoverlo. Il codice generato deve ancora essere verificato e ottimizzato, ed è qui che l'ecosistema di CUDA è più profondo. Bing Xu, il cui ultimo startup di software per chip è stato acquistato da Nvidia, sostiene che la verifica diventa il prossimo fossato.
“Gli agenti possono generare molto codice in poco tempo, ma la verifica è il collo di bottiglia più grande,” ha detto Xu. Lattner è ancora più diretto. L'hype, dice, è “molto esagerato.” Scrivere codice è una piccola parte della costruzione di software; la parte difficile è sintonizzarlo per la produzione. E il software per chip è un campo di nicchia, con pochi esempi pubblici da cui gli agenti possano apprendere.
Quindi la lettura onesta non è che CUDA stia cadendo. È che la cosa che protegge Nvidia ha, per la prima volta, una data di scadenza plausibile. Gli agenti possono ora fare in ore ciò che prima richiedeva anni a team specializzati. L'inferenza premia chi libera gli acquirenti da un singolo stack. Se il fossato regge dipende da una cosa. I rivali devono chiudere il divario più velocemente di quanto Nvidia, che “non sta dormendo,” possa aprirne uno nuovo.
Altri articoli
Il fossato di CUDA di Nvidia affronta la sua prima vera minaccia: l'IA stessa
Il dominio di Nvidia si basa su CUDA, non solo sui suoi chip. Gli agenti di codifica AI e il passaggio all'inferenza sono le prime minacce credibili a quel fossato software.
