Thomson Reuters ha costruito il proprio modello su una base aperta cinese.
Thomson Reuters ha lanciato il suo primo modello di linguaggio di grandi dimensioni proprietario lunedì. L'azienda lo chiama Thomson. Affermano di aver speso 40 milioni di dollari in talenti e risorse computazionali per addestrare il modello, e che è partito da quella che il suo annuncio descrive come “una solida base open-source”.
L'annuncio non specifica quale base. Il suo chief technology officer l'ha nominata in un'intervista.
Cosa dice l'azienda di aver speso
Thomson Reuters è quotata a Toronto e sul Nasdaq come TRI. Vende prodotti legali, fiscali, contabili e di conformità, e possiede Reuters. L'annuncio fissa il costo dell'addestramento a 40 milioni di dollari, coprendo talenti e risorse computazionali.
Lo confronta con i laboratori di frontiera. Quei laboratori hanno “tipicamente speso miliardi di dollari in risorse computazionali e anni di investimenti in infrastrutture per raggiungere la frontiera”, afferma l'azienda. Descrive il risultato come un modello che controlla completamente, “senza i pesanti costi di inferenza dei tipici modelli di frontiera”.
L'azienda ha addestrato Thomson su meno del 10% dei propri contenuti finora, secondo il comunicato. Nomina Westlaw, Practical Law, Checkpoint e Reuters come fonti.
Qual è il modello di base
Joel Hron, il chief technology officer, ha detto a Business Insider che Thomson parte da un modello chiamato Snowdon. Snowdon è emerso da un “riallineamento” di un modello open-source Qwen di Alibaba. Business Insider ha identificato la base come Qwen3.5 e ha riportato il nuovo modello con il nome Thomson-1.
Il comunicato stampa dell'azienda descrive il punto di partenza solo come “una solida base open-source”. Non lo nomina.
Chi ha costruito Snowdon
Hron ha detto che un team congiunto di Thomson Reuters e Imperial College nel Regno Unito ha adattato Qwen per diversi mesi. Quel lavoro ha garantito che il risultato fosse “eticamente e politicamente privo di pregiudizi e sicuro da usare”, ha detto.
“Non c'è nulla che ci leghi necessariamente a Qwen,” ha detto Hron a Business Insider. Alibaba ha dichiarato il mese scorso che vuole far pagare i suoi utenti più grandi.
Dove il modello viene eseguito per primo
Il primo dispiegamento di Thomson si trova all'interno di Tabular Analysis in CoCounsel Legal, l'assistente AI dell'azienda per avvocati. Il comunicato lo definisce “revisione di documenti strutturati ad alto volume”. Raggiunge studi legali e dipartimenti legali aziendali nel prossimo rilascio.
Thomson Reuters afferma che CoCounsel Legal “rimane multi-modello per design”. Prevede di estendere Thomson attraverso il suo portafoglio legale e fiscale.
La partnership con iManage quattro giorni prima
Thomson Reuters e la società di gestione documentale iManage hanno annunciato una partnership ampliata il 20 agosto. Questo spinge CoCounsel Legal più in profondità nella piattaforma iManage, insieme a HighQ, Noetica e Legal Tracker.
Le due aziende hanno anche dichiarato che avrebbero aggiunto supporto per il Model Context Protocol, in modo che gli strumenti approvati di Thomson Reuters possano ragionare sui contenuti di iManage mantenendo i controlli di accesso, le barriere etiche e i confini di privilegio. Rawia Ashraf, co-responsabile di CoCounsel Legal, ha detto che il lavoro legale “vive in troppi posti”.
Cosa fa ancora Claude
Hron ha detto che CoCounsel si basa ancora principalmente su Claude. Thomson Reuters ha ampliato la sua partnership con Anthropic a maggio, per quel prodotto stesso.
“Il nostro obiettivo principale è rendere Thomson il modello che alimenta sempre più le capacità di CoCounsel nel tempo,” ha detto Hron a Business Insider. Ha detto che il nuovo modello non sostituisce il lavoro dell'azienda con Anthropic e altri laboratori.
Come Hron ha descritto la decisione
Hron ha citato il costo come uno dei motivi principali. Possedere un modello consente all'azienda di costruire sulla propria proprietà intellettuale, ha detto, piuttosto che pagare aziende di AI esterne per la loro. Ha paragonato la situazione all'affitto rispetto all'acquisto di una casa.
“Affittare una casa, hai comunque un tetto sopra la testa, e qualcuno se ne prende cura, ed è fantastico,” ha detto. “Ma non stai costruendo alcun capitale che si accumula in qualcosa di prezioso per te a lungo termine.” River AI ha raccolto 1,1 miliardi di dollari questo mese per consentire alle aziende di addestrare e mantenere i propri modelli.
Cosa ha detto Anthropic su Alibaba
Anthropic ha accusato i laboratori cinesi di distillare illecitamente le uscite dei suoi modelli per addestrare i propri. A giugno ha nominato Alibaba, in quella che ha definito la più grande campagna di distillazione mai condotta contro Claude. Ha chiesto agli Stati Uniti di imporre restrizioni.
Il senatore Tom Cotton ha sollevato preoccupazioni riguardo alle aziende statunitensi che utilizzano modelli open-source cinesi, tra cui Airbnb e Cursor. Ha citato potenziali minacce alla sicurezza come le backdoor. Anthropic e Alibaba non hanno risposto alle richieste di commento di Business Insider.
I due accademici citati nel comunicato
Thomson Reuters ha dichiarato di aver aperto il modello ad accademici legali e di AI prima del lancio. Il suo annuncio cita due di loro.
Jonathan H. Choi della Washington University School of Law ha testato Thomson contro ChatGPT e Claude, utilizzando domande dalla sua classe di Corporate Tax. “Tutti e tre i modelli hanno risposto correttamente alle domande, ma ho preferito le risposte di Thomson nel complesso,” ha detto, citando i collegamenti ai trattati.
Il professor Samuel Dahan dirige il Queen’s Conflict Analytics Lab e il Cornell Legal AI Lab. La sua valutazione ha trovato la “qualità delle citazioni di Thomson generalmente competitiva con i modelli di frontiera leader”, inclusi quelli sulle questioni di diritto del lavoro canadese.
Il rilascio open-weight
Thomson Reuters sta pubblicando una versione “piccola” di Thomson su Hugging Face come modello open-weight, per uso accademico e non commerciale. Affermano che un rapporto tecnico che copre lo sviluppo del modello di base è disponibile.
La stessa mossa di Harvey, un giorno prima
Harvey ha lanciato Tenet domenica, il suo primo modello proprietario per il lavoro legale. Harvey lo ha addestrato ulteriormente su Kimi K3, il modello open-weight del laboratorio cinese Moonshot AI. Il desk ha coperto il modello interno di Harvey quel giorno.
Thomson Reuters ha ridotto i ruoli ingegneristici a luglio e ha dichiarato di assumere invece personale nativo AI. Il desk ha coperto quegli licenziamenti ingegneristici all'epoca.
Cosa afferma il comunicato riguardo alle capacità
Steve Hasker, il CEO, ha detto che “le nostre prime valutazioni pongono Thomson allo stesso livello dei più recenti modelli di frontiera in una serie di compiti”. Quella valutazione è quella dell'azienda, e il comunicato non pubblica numeri accanto ad essa.
Il comunicato afferma che Thomson mostra “un significativo miglioramento” rispetto al suo modello di base nel seguire le istruzioni, e un miglioramento maggiore nella navigazione di contenuti densi e specifici per il dominio. Afferma che le valutazioni del modello di base sottostante appaiono in un rapporto tecnico sullo sviluppo del modello.
Cosa promette Thomson Reuters ai clienti
Il comunicato stabilisce uno standard che l'azienda chiama AI di grado fiduciario. Lo definisce come AI costruita per professionisti con doveri di cura e responsabilità, “dove quasi giusto non è abbastanza”. L'azienda afferma di non utilizzare i dati dei clienti per addestrare il modello senza consenso esplicito.
Centinaia di esperti di materia hanno lavorato su Thomson, secondo il comunicato, dalla progettazione degli obiettivi di addestramento fino alle valutazioni finali. Thomson Reuters afferma che seguiranno ulteriori “opzioni di AI sovrane”.
Altri articoli
Thomson Reuters ha costruito il proprio modello su una base aperta cinese.
Thomson Reuters ha speso 40 milioni di dollari per Thomson, il suo primo modello interno. L'annuncio parla di una fondazione open-source. Il suo CTO menziona Qwen di Alibaba.
