Il fossato di CUDA di Nvidia affronta la sua prima vera minaccia: l'IA stessa

Il fossato di CUDA di Nvidia affronta la sua prima vera minaccia: l'IA stessa

      La storia abituale su Nvidia è una storia di hardware: i chip più veloci, nella fornitura più limitata, al prezzo più alto. La parte più importante è il software. Per due decenni, il vero fossato dell'azienda è stato CUDA. È il livello che trasforma il suo silicio in qualcosa su cui gli sviluppatori possono costruire l'IA. Quel fossato ora è messo alla prova.

      CUDA, acronimo di Compute Unified Device Architecture, ha richiesto anni per essere costruito. Raggruppa codice pronto all'uso e strumenti di debug. Permette anche a migliaia di chip di addestrare un modello insieme. La nuova minaccia è diretta: agenti di codifica IA che possono scrivere quel tipo di software di basso livello da soli.

      Jeremy Nixon è un ex ricercatore di Google Brain che ha fondato la startup Infinity. Ha detto a Business Insider che il suo team ha utilizzato agenti per ricostruire software simile a CUDA per l'azienda di chip D-Matrix in circa 10 ore. L'ha presentato come prova che uno dei fossati più grandi di Nvidia sta venendo superato.

      Due fossati, entrambi sotto pressione

      Il primo vantaggio di CUDA è il software. Il secondo è tutto ciò che è costruito sopra di esso. Milioni di righe di codice aziendale e flussi di lavoro rendono lento e costoso il passaggio a un chip rivale. I documenti di Amazon una volta hanno segnalato CUDA come un grande ostacolo all'adozione dei suoi chip IA interni.

      Gli agenti intaccano il primo vantaggio. La pressione non proviene solo dalle startup. Google, Amazon e Microsoft hanno trascorso anni a scrivere software per i propri chip. OpenAI e Anthropic hanno mostrato modelli che possono generare codice di sistema. Il fondatore di DeepSeek ha detto che gli agenti di codifica, insieme al proprio linguaggio di programmazione, hanno reso molto più facile costruire software IA.

      Nvidia non contesta tanto la tendenza quanto la rivendica. Dice che gli sviluppatori si affidano sempre di più alle librerie di CUDA ogni anno. Utilizza anche agenti di codifica per costruire CUDA più velocemente. Il lock-in, in altre parole, potrebbe piegarsi prima di rompersi.

      Il problema dell'inferenza

      La minaccia più acuta è un cambiamento in ciò per cui servono i chip IA. Man mano che l'industria passa dall'addestramento dei modelli all'esecuzione degli stessi, le priorità cambiano. Gli acquirenti si preoccupano meno delle prestazioni massime e più di eseguire l'IA a basso costo. Questo avvantaggia il software che funziona su chip diversi, non il software saldato a un singolo fornitore.

      Dal lato dell'inferenza, CUDA “non è più un fattore”, ha detto Marshall Choy della startup coreana di chip Rebellions. Lo definisce un gioco open source. È la stessa apertura che i nostri altri sfidanti dell'inferenza stanno inseguendo. Pensate ai chip ottici, al silicio di rete e all'alternativa open-source di Alibaba a CUDA stessa.

      Chris Lattner, il cui startup Modular costruisce software IA indipendente dai chip, afferma che l'età di CUDA ha un effetto doppio. Porta con sé anni di eredità dalle sue origini nel gaming, dice, “come Microsoft Windows che cerca di adattarsi a un telefono.” Wall Street se n'è accorta. Gli analisti leggono l'andamento piatto delle azioni di Nvidia nell'ultimo anno come parzialmente una scommessa contro il fossato.

      Il fossato potrebbe semplicemente spostarsi

      Il controargomento è che gli agenti spostano il fossato piuttosto che rimuoverlo. Il codice generato deve ancora essere verificato e ottimizzato, ed è qui che l'ecosistema di CUDA è più profondo. Bing Xu, il cui ultimo startup di software per chip è stato acquistato da Nvidia, sostiene che la verifica diventa il prossimo fossato.

      “Gli agenti possono generare molto codice in poco tempo, ma la verifica è il collo di bottiglia più grande,” ha detto Xu. Lattner è ancora più diretto. L'hype, dice, è “molto esagerato.” Scrivere codice è una piccola parte della costruzione di software; la parte difficile è sintonizzarlo per la produzione. E il software per chip è un campo di nicchia, con pochi esempi pubblici da cui gli agenti possano apprendere.

      Quindi la lettura onesta non è che CUDA stia cadendo. È che la cosa che protegge Nvidia ha, per la prima volta, una data di scadenza plausibile. Gli agenti possono ora fare in ore ciò che prima richiedeva anni a team specializzati. L'inferenza premia chi libera gli acquirenti da un singolo stack. Se il fossato regge dipende da una cosa. I rivali devono chiudere il divario più velocemente di quanto Nvidia, che “non sta dormendo,” possa aprirne uno nuovo.

Altri articoli

Una startup coreana di chip ha appena quadruplicato il suo valore a 2,2 miliardi di dollari, scommettendo che il prossimo denaro dell'IA si trova al di fuori del data center. Un designer di chip sudcoreano di cui pochi al di fuori dell'industria hanno sentito parlare è appena diventato un'azienda da 2,2 miliardi di dollari. DeepX ha firmato la prima tranche di un round di finanziamento di Serie D che la valuta a circa quattro volte il suo valore precedente. E non ha finito di raccogliere fondi. Quando un agente AI ribelle hackera un'azienda, chi è responsabile? Quando un agente AI ribelle hackera un'azienda, chi è responsabile? I modelli di OpenAI e Anthropic hanno violato il contenimento e hackerato altre aziende. Chi è responsabile quando un agente AI autonomo va fuori controllo? La legge non ha una risposta chiara. Samsung punta ancora una volta su MediaTek per alimentare il suo tablet di punta Samsung punta ancora una volta su MediaTek per alimentare il suo tablet di punta Un nuovo benchmark suggerisce che il Galaxy Tab S12 Ultra utilizzerà il Dimensity 9500 di MediaTek, segnando il terzo tablet di punta consecutivo di Samsung alimentato dal produttore di chip. Nuova fuga di notizie di Lenovo ci ha appena dato la nostra migliore visione della scommessa post-Chromebook di Google. Nuova fuga di notizie di Lenovo ci ha appena dato la nostra migliore visione della scommessa post-Chromebook di Google. Un set completo di rendering del Lenovo Googlebook 15 rivela l'interfaccia desktop basata su Android di Google, i controlli dedicati a Gemini, porte generose e un'offerta di produttività insolitamente seria. La riprogettazione della ricerca vocale di Google potrebbe rendere più facili da trovare i suoi strumenti di ricerca AI. La riprogettazione della ricerca vocale di Google potrebbe rendere più facili da trovare i suoi strumenti di ricerca AI. Google sta testando un'interfaccia di ricerca vocale ridisegnata che unisce la ricerca normale, la modalità AI, la ricerca in tempo reale e la ricerca di canzoni in una barra degli strumenti scorrevole. L'India si muove per estendere le agevolazioni fiscali favorevoli ad Apple per la produzione in contratto. L'India si muove per estendere le agevolazioni fiscali favorevoli ad Apple per la produzione in contratto. L'India vuole mantenere Apple in attività. Il governo ha proposto di estendere un'agevolazione fiscale per le aziende straniere che forniscono attrezzature di produzione ai produttori in outsourcing, una modifica redatta tenendo presente l'assemblaggio dell'iPhone. Secondo un disegno di legge

Il fossato di CUDA di Nvidia affronta la sua prima vera minaccia: l'IA stessa

Il dominio di Nvidia si basa su CUDA, non solo sui suoi chip. Gli agenti di codifica AI e il passaggio all'inferenza sono le prime minacce credibili a quel fossato software.