Anthropic ha appena mostrato una versione preliminare di un'IA auto-migliorante.
Anthropic sta testando quanto dello sviluppo dell'IA può essere affidato all'IA stessa
Claude / Anthropic
Anthropic ha parlato di sistemi di IA che alla fine potrebbero aiutare a costruire versioni migliori di se stessi. La sua ultima ricerca mostra come potrebbero apparire le prime fasi di questo processo.
L'azienda ha fornito a Claude Sonnet 5 una versione preliminare del più potente Claude Opus 4.8 e gli ha chiesto di far comportare meglio il modello. In circa 60 ore, Sonnet ha testato più di 50 idee diverse prima di creare un metodo di addestramento utilizzando circa 2.400 esempi.
Il risultato ha avvicinato la versione preliminare di Opus molto di più al modello finale Opus 4.8 su 10 problemi comportamentali che Anthropic stava testando.
Anthropic
Quindi Claude può ora migliorare un'altra IA?
Essenzialmente, sì, anche se solo in modo limitato.
Claude stava svolgendo parte del lavoro normalmente gestito dai ricercatori di IA. Poteva leggere ricerche esistenti, proporre nuove idee, creare dati di addestramento, testare i risultati e riprovare se qualcosa non funzionava.
Nell'ambito dell'esperimento più ampio, Claude ha trovato modi per ridurre problemi come inganno, accordarsi troppo facilmente con gli utenti, jailbreak e violazioni della privacy. Alcuni di quei metodi hanno funzionato anche su modelli di IA molto più grandi di quelli su cui Claude li ha testati inizialmente.
Abbiamo già visto una forma più semplice di auto-miglioramento attraverso la funzione Dreaming di Claude, che consente agli agenti di rivedere il lavoro precedente e imparare dagli errori tra le sessioni. Questo esperimento porta le cose oltre, permettendo a un modello Claude di aiutare a migliorare un altro, più potente.
Anthropic
Questa è un'IA completamente auto-migliorante?
Non ancora. Anthropic chiama il punto finale eventuale auto-miglioramento ricorsivo, dove un'IA potrebbe costruire una versione migliore di se stessa e poi ripetere il processo. Claude non può farlo in questo momento. Gli esseri umani decidono ancora cosa deve essere corretto, forniscono i modelli di IA e la potenza di calcolo, e determinano se i risultati sono sufficientemente buoni.
C'è anche un'altra preoccupazione. Anthropic ha monitorato 1.601 esecuzioni di ricerca automatizzate e ha trovato comportamenti di imbroglio in 39 di esse. Alcuni agenti hanno cercato di manipolare i test o nascondere passaggi che violavano le regole.
Tuttavia, un modello Claude più debole è riuscito a trovare modi per migliorare uno più forte. Questo avvicina l'idea di IA auto-migliorante a qualcosa che possiamo effettivamente vedere accadere, piuttosto che a qualcosa che appartiene solo alla fantascienza.
Ho circa 4 anni di esperienza, principalmente nel settore dei videogiochi, hardware per PC e smartphone. Nel mio tempo libero, mi piace…
Sony e Warner hanno appena citato in giudizio Anthropic per l'uso di musica protetta da copyright per addestrare Claude, chiedendo 150.000 dollari per brano
I modelli Claude di Anthropic avrebbero imparato a scrivere testi piratando le esatte canzoni per cui Sony e Warner ora vogliono essere pagati.
Questa non è la prima volta che gli editori musicali citano in giudizio una grande azienda di IA, ma la portata rende la questione degna della tua attenzione. Sony Music e Warner Chappell hanno presentato nuove cause legali contro Anthropic. Gli editori affermano che Anthropic ha piratato decine di migliaia di canzoni protette da copyright per addestrare Claude (via Business Insider). Questo chatbot è diventato piuttosto popolare per la sua accuratezza e capacità di gestire compiti complessi.
Leggi di più
Colpiti dal ritiro dei modelli GPT da Cursor da parte di OpenAI? Anthropic offre una tempestiva ancora di salvezza con limiti più elevati per Claude
OpenAI sta lasciando Cursor, e Anthropic è appena intervenuta
Per gli utenti di Cursor che si sono improvvisamente trovati nel mezzo di una disputa nell'industria dell'IA, il tempismo non potrebbe essere peggiore. OpenAI sta riportando notizie secondo cui intende interrompere l'accesso diretto di Cursor ai suoi modelli - ma Anthropic sta intervenendo con un'alternativa piuttosto conveniente. SpaceX ha notificato a Cursor che intende terminare il suo contratto per la fornitura di modelli OpenAI, con la chiusura proposta per il 12 novembre 2026, secondo OpenAI. Il co-fondatore e CEO di Cursor, Michael Truell, ha confermato lo sviluppo, affermando che i modelli OpenAI rappresentano circa il 5% del traffico degli utenti di Cursor e che l'azienda sta parlando con OpenAI per risolvere la questione.
Leggi di più
I robot chef della pizza non stanno andando bene
Il sogno della pizza completamente automatizzata sta affrontando alcuni problemi molto umani
Il futuro del fast food doveva apparire in questo modo: entrare in un ristorante, effettuare un ordine e guardare un robot assemblare la tua pizza con precisione da macchina. Invece, alcune delle aziende che hanno promesso di automatizzare la preparazione della pizza hanno faticato a trasformare quella visione in un'attività sostenibile. L'ultimo esempio è Picnic, il cui sistema robotico per la preparazione della pizza è stato implementato in un ristorante Moto Pizza a Seattle. Ma a maggio, il suo fornitore ha chiuso bruscamente, lasciando il ristorante con macchine costose e senza supporto tecnico. Lee Kindell, che aveva investito circa 160.000 dollari nell'attrezzatura simile a un armadio, si è chiesto se la preparazione della pizza robotica valesse il rischio.
Leggi di più
Altri articoli
Anthropic ha appena mostrato una versione preliminare di un'IA auto-migliorante.
Anthropic sta esplorando l'IA auto-migliorante permettendo a Claude di ricercare, testare e perfezionare i metodi di addestramento per un modello Claude più forte, con guadagni misurabili in diversi problemi comportamentali.
