Cosa c'è dopo per l'IA e come arrivarci

Cosa c'è dopo per l'IA e come arrivarci

      TL;DR I modelli AI di frontiera si sono avvicinati entro il 5% l'uno dall'altro (Stanford 2026 AI Index). Gartner prevede che oltre il 40% dei progetti di AI agentica sarà cancellato entro la fine del 2027. Gediminas Rickevičius, SVP di Oxylabs, sostiene che il fattore distintivo è passato dalla selezione del modello all'infrastruttura dei dati: indici web costruiti per agenti (contenuti strutturati, non link blu) e strati di accesso in tempo reale per informazioni dinamiche. McKinsey scopre che l'88% delle organizzazioni utilizza l'AI, ma solo il 6% sono ad alte prestazioni.

      Nel 2026, il modo in cui parliamo di AI sta iniziando a cambiare. Due anni fa, ogni discussione in sala riunioni ruotava attorno alla stessa domanda: su quale modello scommettiamo? Oggi, quella domanda è appena percepita. I sistemi di frontiera si sono così strettamente avvicinati che, secondo l'AI Index 2026 di Stanford, i modelli leader hanno guadagnato circa 30 punti percentuali in un solo anno su parametri chiave e ora si raggruppano a un passo l'uno dall'altro nella maggior parte dei compiti. Il modello non è più la variabile; qualcos'altro lo è.

      Quel qualcosa sono i dati, specificamente, ciò che il modello vede, quando lo vede e quanto bene è strutturato. ​Ciò che fa la differenza ora è più fondamentale: la qualità, la freschezza e la profondità strutturale delle informazioni che un modello riceve. Le organizzazioni si trovano ad affrontare due muri contemporaneamente. Uno è colpito dagli agenti AI, che continuano a produrre errori sicuri. L'altro è a lungo termine e più fondamentale, trovare informazioni fresche richiede una nuova generazione di infrastruttura di ricerca. Entrambi i muri portano alla stessa base: i dati.

      Cosa c'è dopo: agenti AI e il web agentico

      Quando gli agenti inciampano

      L'AI agentica – sistemi che possono pianificare, cercare dati, utilizzare strumenti ed eseguire compiti a più fasi con una supervisione umana limitata – viene impiegata nel monitoraggio competitivo, nell'intelligenza dei prezzi, nella ricerca di mercato, negli acquisti e nella qualificazione dei lead. Purtroppo, gli agenti spesso falliscono nella maggior parte di questi.

      ​Gartner prevede che oltre il 40% dei progetti di AI agentica sarà cancellato entro la fine del 2027, citando costi in aumento, valore commerciale poco chiaro e controlli di rischio inadeguati. Uno studio MIT NANDA del 2025 lo ha messo in modo ancora più netto: circa il 95% dei progetti pilota di AI generativa non ha fornito ritorni misurabili, con flussi di lavoro fragili e una mancanza di apprendimento contestuale citati come motivi principali.

      ​L'istinto, quando un agente produce un errore sicuro, è incolpare il modello – un difetto di ragionamento, un'allucinazione. In realtà, il fallimento può solitamente essere ricondotto a qualcosa di molto più semplice: l'agente stava lavorando con informazioni obsolete o incomplete. Logica solida – fatti obsoleti, per dirla in modo semplice. Un agente che valuta la strategia di prezzo di un concorrente è limitato da se può accedere a prezzi attuali e geograficamente accurati, non da se può ragionare su di essi. Una flotta di tali agenti in funzioni critiche per il business è una responsabilità strutturale che nessuna quantità di ingegneria dei prompt può risolvere.

      Il contesto come infrastruttura

      C'è una tendenza persistente nel budgeting dell'AI aziendale a trattare l'acquisizione di dati come spese generali, qualcosa che vive sotto la linea e, una volta consegnato all'IT, non dovrebbe riemergere nelle conversazioni strategiche. Questo non è più sostenibile. L'industria ha persino coniato un termine per la disciplina di risolverlo: ingegneria del contesto, che, alla fine del 2025, Anthropic ha definito come la pratica di curare il set ottimale di informazioni disponibili per un modello al momento dell'inferenza.

      ​Per le organizzazioni la cui AI dipende dai dati web, elenchi di prodotti, divulgazioni finanziarie, notizie, annunci di lavoro, aggiornamenti normativi, attività dei concorrenti, le informazioni grezze sono là fuori. La difficoltà sta nell'accessarle in modo coerente. Il rendering di contenuti dinamici, formati di dati incoerenti e altre caratteristiche comuni dei siti web diventano ostacoli quando è necessario estrarre rapidamente e su larga scala dati pubblici. Le organizzazioni che investono poco nella loro risoluzione lasciano che la comodità determini ciò che la loro AI sa del mondo.

      Indici web migliori

      Per fornire a un agente informazioni fresche, hai bisogno di un indice web: il database organizzato che i motori di ricerca consultano invece di Internet dal vivo. Funziona come un catalogo di biblioteca, consentendo ai sistemi di localizzare informazioni attraverso miliardi di pagine in millisecondi senza leggere ogni “libro” da zero.

      Il processo è continuo: i crawler scoprono pagine, i parser rimuovono il rumore come annunci e codice, e il sistema memorizza contenuti puliti con segnali di qualità per il ranking. Mentre gli indici tradizionali forniscono link per gli esseri umani da cliccare, gli agenti richiedono dati strutturati che possono utilizzare immediatamente. Gli indici standard costringono gli agenti a recuperare, pulire e riassumere le pagine singolarmente, aggiungendo ritardi e costi di token. Gli indici specifici per agenti saltano questo passaggio memorizzando contenuti pronti all'uso con fonti verificabili, trasformando la ricerca in una base affidabile per l'azione piuttosto che in un elenco di link blu.

      Dove diventa interessante per chiunque costruisca con l'AI è che gli indici di ricerca tradizionali sono stati progettati per le persone: un titolo, un link, un breve estratto, abbastanza per decidere quale link blu cliccare. Un agente non vuole un elenco di link. Vuole le informazioni reali, già estratte e strutturate per un modello linguistico.

      Quando un indice restituisce solo link, l'agente deve recuperare ogni pagina, rimuovere le parti utili e riassumerle da solo, il che aggiunge ritardi, aumenta i costi dei token e crea più punti di rottura. Gli indici costruiti per agenti saltano quella corsa memorizzando contenuti che il modello può utilizzare immediatamente, con fonte e data allegate in modo che ogni fatto possa essere ricondotto. Quell'ultima parte è importante, perché mostrare da dove proviene un'affermazione è una delle difese più pratiche contro un agente che inventa qualcosa con sicurezza. Quindi, quando qualcuno dice che gli agenti hanno bisogno di dati migliori, significa in parte che gli agenti hanno bisogno di indici costruiti per loro.

      Infrastruttura per accesso in tempo reale

      Un buon indice ti porta lontano, ma anche il migliore è un'istantanea. Riflette il web all'ultimo crawl, e per molto di ciò che gli agenti fanno, quel ritardo è la differenza tra una risposta corretta e una inutile.

      La commoditizzazione dei modelli era una previsione marginale, ma non lo è più. L'indagine State of AI 2025 di McKinsey ha rilevato che l'88% delle organizzazioni ora utilizza l'AI in almeno una funzione, ma solo il 6% si qualifica come ad alte prestazioni estraendo valore significativo a livello aziendale. L'adozione non è più il vincolo, mentre l'esecuzione lo è. E una grande parte dell'esecuzione è ciò che il modello riceve quando inizia a lavorare, che si riduce all'infrastruttura attorno ad esso piuttosto che al modello stesso.

      Tale infrastruttura serve a due scopi fondamentali: un indice per memorizzare contenuti web strutturati per i modelli AI e accesso live per raggiungere dati web in tempo reale. Gli indici standard mancano aggiornamenti immediati come prezzi dinamici, cambiamenti normativi o nuovi lanci di prodotti, richiedendo agli agenti di affrontare ostacoli come contenuti dinamici e formati vari. Di conseguenza, il vantaggio competitivo dipende meno dalla selezione del modello e più dalla vastità e dall'immediatezza dei dati a cui un'AI può accedere.

      In sintesi

      I modelli contano, e costruire agenti è un lavoro davvero impegnativo.

Altri articoli

Claude ora ha il proprio browser e non ha più bisogno dell'estensione Chrome. Claude ora ha il proprio browser e non ha più bisogno dell'estensione Chrome. Anthropic ha inserito un browser all'interno di Claude Cowork, attivato per impostazione predefinita. La schermata di scelta del DMA vincola solo i gatekeeper, e Anthropic non è uno di essi. OpenAI, Anthropic, Google e Microsoft vogliono che la difesa informatica sia trattata come una priorità di leadership OpenAI, Anthropic, Google e Microsoft vogliono che la difesa informatica sia trattata come una priorità di leadership OpenAI, Anthropic, Google e Microsoft vogliono che la difesa informatica diventi una priorità di leadership. L'UE ha già imposto la segnalazione che stanno richiedendo. Passare a Metro di T-Mobile potrebbe farti ottenere un nuovo telefono e un notevole risparmio Passare a Metro di T-Mobile potrebbe farti ottenere un nuovo telefono e un notevole risparmio Il tuo attuale telefono potrebbe essere pronto per la pensione o avere ancora molta vita davanti. Un'offerta wireless migliore dovrebbe adattarsi a ciò di cui hai realmente bisogno. Metro by T-Mobile offre diversi modi per rendere più facile il passaggio tra operatori senza costringerti a seguire lo stesso percorso. Il Galaxy S27 Pro potrebbe seguire il nuovo look dell'Ultra, con tutte le vibrazioni dell'iPhone. Il Galaxy S27 Pro potrebbe seguire il nuovo look dell'Ultra, con tutte le vibrazioni dell'iPhone. Nuovi rendering CAD mostrano apparentemente che il Galaxy S27 Pro adotta un importante redesign della fotocamera simile a quello del prossimo Galaxy S27 Ultra. Anthropic testa un nuovo standard per Claude per lavorare con hardware di fabbrica e laboratorio Anthropic testa un nuovo standard per Claude per lavorare con hardware di fabbrica e laboratorio Lo Standard Hardware del Modello di Anthropic consente ai fornitori di specificare come un'IA può muovere una macchina. L'Europa regola le funzioni di sicurezza dell'IA nelle macchine a partire da gennaio 2027. Il Microduck di Pollen Robotics mira a rendere l'addestramento dell'IA fisica molto meno fragile e più economico. Il Microduck di Pollen Robotics mira a rendere l'addestramento dell'IA fisica molto meno fragile e più economico. Il Microduck di Pollen Robotics è un piccolo bipedale da $399 progettato per rendere l'addestramento dell'IA fisica più accessibile, consentendo agli sviluppatori di sperimentare nuovi comportamenti robotici su hardware in grado di sopportare qualche caduta occasionale.

Cosa c'è dopo per l'IA e come arrivarci

I modelli di frontiera si sono convergenti. I dati di Stanford mostrano che i migliori sistemi ora ottengono punteggi entro il 5% l'uno dall'altro. Gediminas Rickevičius, SVP di Oxylabs, sostiene che il vantaggio competitivo si è spostato dalla selezione del modello all'infrastruttura dei dati: indici web costruiti per agenti e strati di accesso in tempo reale.