Google lancia Gemini 3.6 Flash e un rivale di Mythos
La risposta di Google a un'estate di essere superato non è un modello più grande. Sono modelli più economici.
Martedì l'azienda ha lanciato tre nuovi modelli Gemini, tutti nella sua fascia "Flash" veloce e a basso costo, un giorno prima che Alphabet riporti i guadagni. Il messaggio è efficienza rispetto alla pura potenza. Il problema è ciò che manca ancora.
Economici, veloci e ovunque tranne che al top
Il cavallo da lavoro è Gemini 3.6 Flash. Google afferma che fa meglio nel coding e nel lavoro di conoscenza rispetto al suo predecessore, utilizzando circa il 17% in meno di token di output, e costa meno. Sono $7,50 per milione di token di output, in calo rispetto a $9. La sua conoscenza ora si estende fino a marzo 2026.
Accanto ad esso si trova 3.5 Flash-Lite, il più veloce della famiglia a 350 token al secondo, e ancora più economico. Entrambi puntano su una scommessa: che la maggior parte del lavoro AI non ha bisogno di un cervello all'avanguardia, solo di uno veloce e conveniente.
Quella scommessa ha un campione. “Le aziende stanno già esaurendo i loro budget annuali di token, e siamo solo a maggio,” ha detto il CEO Sundar Pichai all'inizio di quest'anno. Una combinazione di modelli Flash, ha detto a Business Insider, potrebbe far risparmiare alle aziende oltre $1 miliardo all'anno.
Una possibilità più economica per Mythos
Il rilascio più mirato è Gemini 3.5 Flash Cyber. È sintonizzato per trovare e correggere vulnerabilità software, funzionando all'interno dell'agente CodeMender di Google. Google lo definisce un'alternativa “economica” ai grandi modelli di sicurezza.
L'obiettivo non nominato è Mythos di Anthropic, che costa $10 per milione di token di input e $50 per milione di output, come nota The Verge. Google afferma che Flash Cyber eguaglia le prestazioni all'avanguardia su un benchmark chiave a una frazione del prezzo, un attacco diretto al vantaggio di Anthropic nella sicurezza guidata dall'AI.
Poiché un cercatore di bug aiuta anche gli attaccanti, Google lo tiene sotto controllo. Flash Cyber va solo a governi e partner fidati, in un pilota limitato.
Il modello che non hanno spedito
Poi c'è l'assenza. Gemini 3.5 Pro, il modello di punta che Google aveva promesso per giugno, è ancora in fase di test, riportando di essere stato trattenuto dopo aver deluso nel coding. Google non ha alcun modello nella top ten pubblica.
Il tempismo è pungente. In circa una settimana, Grok 4.5 di xAI, tre versioni di GPT-5.6 di OpenAI e Kimi K3 di Moonshot sono stati tutti spediti. Nel frattempo, Fable 5 di Anthropic si trova in cima alle classifiche, come riportato da Reuters.
Gemini 4, sulla carta
La risposta di Google è puntare più avanti. Dice di aver iniziato la sua “corsa di pre-addestramento più ambiziosa di sempre” per Gemini 4. Questa è una dichiarazione di intenti, non una capacità spedita.
L'iniziativa di efficienza va oltre il software. Google sta anche costruendo un chip personalizzato per servire Gemini a un costo molto più basso. Un caveat vale la pena mantenere, però: ogni benchmark qui è di proprietà di Google, e nessun esterno li ha ancora verificati.
La scommessa
Il piano è coerente. In un anno in cui le aziende stanno contando i token, economico e veloce può vincere nel mezzo del mercato mentre il modello di punta recupera. Se reggerà dipende da due cose: 3.5 Pro finalmente spedito, e Gemini 4 che si rivela essere più di una corsa di addestramento.
Altri articoli
Google lancia Gemini 3.6 Flash e un rivale di Mythos
Google ha lanciato Gemini 3.6 Flash, 3.5 Flash-Lite e un modello cyber rivolto al Mythos di Anthropic, ma il suo modello di punta 3.5 Pro è ancora in ritardo. Gemini 4 è stato anticipato.
