Il server AI gratuito di ZML funziona su qualsiasi chip principale.

Il server AI gratuito di ZML funziona su qualsiasi chip principale.

      Una startup di Parigi vuole allentare la presa di Nvidia sull'IA, non con un nuovo chip, ma con software. ZML ha rilasciato uno strumento gratuito che esegue modelli open-source rapidamente su silicio Nvidia, AMD, Google, Apple e Intel.

      Nvidia domina ancora l'hardware per l'IA, ma le sue mura continuano a assottigliarsi. ZML, una startup di Parigi sostenuta dal pioniere dell'IA Yann LeCun, ha rilasciato software gratuito che esegue modelli linguistici open-source su una combinazione di chip, riporta TechCrunch. La lista comprende cinque obiettivi: Nvidia, AMD, i TPU di Google, Intel e Apple.

      Lo strumento, ZML/LLMD, è un server di inferenza. L'inferenza significa eseguire un modello addestrato per rispondere a richieste, la parte dell'IA che ora consuma la maggior parte della potenza di calcolo. Il fondatore Steeve Morin afferma che l'obiettivo è rompere i silos che bloccano gli utenti a un solo fornitore e spremere ogni chip alla sua massima velocità.

      Perché è importante una combinazione di chip

      Il costo è il motore. Man mano che le spese per l'IA aumentano, le imprese e i cloud vogliono la libertà di scegliere silicio più economico o meno energivoro per un determinato lavoro. “L'idea è restituire alle persone il potere di creare il proprio sistema,” ha detto Morin. Se fatto bene, appare meno come una funzionalità e più come un cuneo sotto il fossato di Nvidia.

      Potrebbe anche sollevare un'ondata di nuovi produttori di chip, molti dei quali europei. Morin ha citato Axelera, Fractile, Kalray, SiPearl, VSORA e altri. Un software che tratta i loro chip come di prima classe, non come di seconda scelta, offre agli acquirenti una vera ragione per provarli.

      Una corsa affollata e costosa

      Morin non esclude Nvidia e afferma che ZML ha un buon rapporto con il gigante dei chip. Ma il campo è affollato. La "corsa all'oro dell'inferenza" ha coniato rivali come Baseten, recentemente valutata 13 miliardi di dollari, oltre ai team dietro i progetti open-source vLLM e SGLang. Tutti inseguono lo stesso premio: rendere l'IA più economica da eseguire.

      Morin pensa che ZML arrivi più lontano. “Siamo arrivati al punto in cui stiamo co-progettando il silicio,” ha detto. Il suo team snello di 20 persone ha spedito rapidamente, con ulteriori rilasci in arrivo.

      Perché è importante

      LLMD è attualmente gratuito per raccogliere utilizzo, non è ancora un prodotto a pagamento. La sua origine insolita è il segnale più grande. Uno strumento costruito per allentare la presa di Nvidia e sostenere il proprio stack di IA europeo è arrivato da Parigi, non dalla Silicon Valley. Morin, che ha raccolto 20 milioni di dollari da investitori tra cui Kima Ventures di Xavier Niel, l'ha messa in modo chiaro. “Non avrei potuto fare ZML in nessun altro posto che a Parigi,” ha detto.

Altri articoli

Perplexity sta costruendo silenziosamente uno strumento di codifica AI. Perplexity sta costruendo silenziosamente uno strumento di codifica AI. Perplexity ha sviluppato uno strumento di codifica interno con il nome in codice "Teammate" che potrebbe competere con Cursor e Claude Code, riporta Business Insider. Un lancio non è confermato. OpenAI's GPT-Live: ChatGPT voce che ascolta e parla OpenAI ha lanciato GPT-Live, una voce ChatGPT a pieno duplex che ascolta e parla contemporaneamente, con traduzione in tempo reale. Viene distribuito a tutti gli utenti, anche a quelli gratuiti. La NATO sceglie Accenture e Leonardo per un cloud sicuro da 200 milioni di euro La NATO sceglie Accenture e Leonardo per un cloud sicuro da 200 milioni di euro La NATO firma un contratto di ~200 milioni di euro, della durata di sette anni, con Accenture e Leonardo per costruire un'infrastruttura cloud sicura, il Protected Business Network, per l'Alleanza. Il bug GhostApproval interrompe 6 principali agenti di codifica AI Il bug GhostApproval interrompe 6 principali agenti di codifica AI Il 'GhostApproval' di Wiz utilizza un vecchio trucco dei symlink per far scrivere sei agenti di codifica AI, da Amazon Q a Cursor, al di fuori della sandbox e consegnare la scatola. OpenAI's GPT-Live: ChatGPT voce che ascolta e parla OpenAI ha lanciato GPT-Live, una voce ChatGPT a pieno duplex che ascolta e parla contemporaneamente, con traduzione in tempo reale. Viene distribuito a tutti gli utenti, anche a quelli gratuiti. I clienti preferiscono ChatGPT ai chatbot aziendali, rileva Gartner I clienti preferiscono ChatGPT ai chatbot aziendali, rileva Gartner I clienti sono 3 volte più propensi a utilizzare GenAI di terze parti come ChatGPT rispetto ai chatbot aziendali per il supporto, secondo Gartner, poiché i ritorni sull'AI ritardano la spesa.

Il server AI gratuito di ZML funziona su qualsiasi chip principale.

ZML di Francia rilascia ZML/LLMD, un server di inferenza gratuito che esegue AI open-source su chip Nvidia, AMD, Google, Intel e Apple alla massima velocità.