IBM scommette 240 milioni di dollari su inferenze economiche e open-source per sfidare gli hyperscaler

IBM scommette 240 milioni di dollari su inferenze economiche e open-source per sfidare gli hyperscaler

      Un accordo pluriennale con la startup Together AI porterà i sistemi Nvidia Blackwell su IBM Cloud, e la scommessa è che le imprese ora si preoccupano di più del costo di gestione dell'IA piuttosto che del prestigio del modello che la gestisce.

      IBM ha deciso che il denaro nell'intelligenza artificiale non risiede più solo nella costruzione del modello più intelligente, ma nella sua gestione economica, e ha investito 240 milioni di dollari in questa convinzione.

      L'azienda ha firmato un accordo pluriennale con Together AI, una startup di San Francisco, per realizzare un cluster di inferenza IA su larga scala su IBM Cloud, e l'offerta è chiaramente rivolta alle imprese che cercano di ridurre le loro spese per l'IA.

      Il cluster funzionerà su sistemi Nvidia HGX B300, costruiti sull'architettura Blackwell che Nvidia commercializza come specificamente ottimizzata per l'inferenza, uniti alla rete Ethernet Spectrum-X dell'azienda, che è la stessa ricetta che una serie di specialisti hanno inseguito scommettendo che i veri profitti dell'IA risiedono nell'inferenza economica piuttosto che in addestramenti sempre più grandi.

      Together AI è un partner interessante da scegliere. Valutata 8,3 miliardi di dollari a luglio, la sua piattaforma consente alle aziende di addestrare e gestire carichi di lavoro su modelli open-source, tra cui DeepSeek, MiniMax e Kimi, e si propone come un'alternativa più economica e flessibile ai sistemi chiusi e proprietari che dominano le notizie.

      Si dice che gestisca circa 400 trilioni di token al mese, una cifra che dà un'idea di quanto flusso di inferenza grezza ora circoli attraverso questi tubi, e del perché un fornitore legacy come IBM desidererebbe una parte di quel traffico che gira sulla propria cloud.

      L'inferenza, il business di rispondere effettivamente alle query una volta che un modello è addestrato, è diventata silenziosamente uno dei maggiori motori di domanda per la capacità di calcolo, motivo per cui questo strato ha attratto una corsa di denaro e talenti.

      Nebius ha recentemente pagato 643 milioni di dollari per assorbire un team di 20 persone che lavorano sull'ottimizzazione dell'inferenza, un prezzo che ha senso solo se si crede che ridurre il costo per token sia dove ora risiedono i margini.

      L'altra metà della storia è il lento spostamento delle imprese verso l'open source. Le aziende vogliono ridurre ciò che spendono per l'IA, i modelli aperti stanno guadagnando una reale trazione all'interno delle grandi organizzazioni.

      E c'è anche una dimensione di sicurezza, poiché le preoccupazioni sulla cybersecurity riguardo ai modelli chiusi di Anthropic, OpenAI e Meta sono citate come una delle ragioni per cui alcune aziende preferirebbero gestire qualcosa che possono ispezionare e ospitare autonomamente.

      Nessuna di queste è una preferenza puramente tecnica, perché per una banca o un ospedale la capacità di mantenere dati sensibili su un'infrastruttura che controlla è spesso il punto principale.

      Per IBM, ospitare inferenze economiche e open-source è un modo per affrontare una sfida che potrebbe effettivamente vincere.

      L'azienda non avrebbe mai potuto competere con Amazon, Microsoft o Google in termini di pura scala cloud, quindi posizionare IBM Cloud come il luogo per gestire modelli aperti a prezzi accessibili le consente di competere in base all'economia piuttosto che alla dimensione, e si integra perfettamente con un più ampio appetito europeo per infrastrutture che non sono bloccate su un singolo gigante americano.

      Questo appetito si sta manifestando altrove sulla mappa. La spinta a costruire capacità di inferenza di cui le imprese e i governi possono fidarsi e controllare ha generato realtà come TensorX, che ha raccolto 8 milioni di euro per costruire inferenze IA sovrane per l'Europa su Nvidia Blackwell, un promemoria che lo stesso silicio alla base della scommessa di IBM viene integrato in un argomento più ampio su chi possiede la rete.

      C'è un'aria di corsa all'oro in tutto questo, e IBM lo sa. La competizione aperto-chiuso nell'IA aziendale è stata spesso inquadrata come un dibattito sulle capacità.

      Eppure la battaglia più significativa ora riguarda il prezzo, e un cluster da 240 milioni di dollari pieno di chip Blackwell è il modo di IBM per dire che preferirebbe vendere picconi e pale piuttosto che promesse.

      Se l'inferenza economica e aperta si dimostrerà altrettanto duratura e redditizia quanto sperano i suoi sostenitori è la scommessa che l'intero settore sta silenziosamente facendo, e un cluster da 240 milioni di dollari è uno dei suoi investimenti più consistenti finora.

Altri articoli

Target nomina il suo primo chief AI officer mentre i rivenditori aumentano la spesa per l'IA Target nomina il suo primo chief AI officer mentre i rivenditori aumentano la spesa per l'IA Target ha assunto l'esecutivo di Lowe's Chandhu Nair come suo primo chief AI officer, un ruolo che IBM afferma avere ora tre quarti delle grandi organizzazioni. Sonos pianifica un evento di lancio a settembre e un approfondimento nell'AI domestica Sonos pianifica un evento di lancio a settembre e un approfondimento nell'AI domestica Tom Conrad afferma che il miglior modello di intelligenza artificiale è la domanda sbagliata per la casa intelligente. Il primo hardware di quella strategia, il Sonos Ace Ultra, arriverà a settembre. Tesla ha esaurito la sua quota del nuovo rimborso per veicoli elettrici della California in cinque giorni. Tesla ha esaurito la sua quota del nuovo rimborso per veicoli elettrici della California in cinque giorni. Tesla ha esaurito la sua quota del nuovo rimborso MyFirstEV della California in cinque giorni, nonostante un limite di prezzo che esenta Rivian e Lucid ma non Tesla. Non mi interessa quanto sia sottile il Galaxy Z Fold 8, e questi due pieghevoli mostrano esattamente perché. Non mi interessa quanto sia sottile il Galaxy Z Fold 8, e questi due pieghevoli mostrano esattamente perché. I più recenti pieghevoli stanno diventando notevolmente sottili, ma dopo aver utilizzato i modelli più recenti di Motorola, Honor e Samsung, mi preoccupo molto di più delle batterie e delle cerniere che migliorano l'uso quotidiano. L'iPhone per il 20° anniversario di Apple ha appena superato una paura di cancellazione. L'iPhone per il 20° anniversario di Apple ha appena superato una paura di cancellazione. Un nuovo rapporto ha affermato che Apple ha abbandonato il suo redesign dell'iPhone con molto vetro, ma fonti interne dicono che il design per il 20° anniversario è ancora in programma per il prossimo anno. Il nuovo modello di intelligenza artificiale di Meta funziona completamente offline, ma la tua GPU deve tenere il passo. Il nuovo modello di intelligenza artificiale di Meta funziona completamente offline, ma la tua GPU deve tenere il passo. Meta ha rilasciato Muse Glimmer, un modello AI gratuito da 30 miliardi di parametri che puoi eseguire completamente offline. Nessun abbonamento, nessun data center, solo una GPU con almeno 24 GB di VRAM.

IBM scommette 240 milioni di dollari su inferenze economiche e open-source per sfidare gli hyperscaler

IBM e Together AI hanno firmato un accordo da 240 milioni di dollari per costruire un cluster di inferenza Nvidia Blackwell su IBM Cloud, una scommessa sull'economia dell'AI open-source rispetto ai rivali chiusi.