Per Google, Gemini 3.8 Flash è “il suo miglior modello fino a oggi per ragionamento e programmazione”. Secondo i dati pubblicati il 2 settembre, il sistema migliora in modo significativo rispetto a Gemini 3.7 Flash e, in alcuni test, raggiunge o supera modelli più grandi e costosi. Si tratta però di benchmark comunicati dalla stessa Google e non equivalgono, da soli, a una verifica indipendente della superiorità del modello nell’uso quotidiano.
Indice degli argomenti:
I test interni e il confronto con Anthropic
Prima del lancio, il Wall Street Journal aveva riferito che Gemini 3.8 Flash era conosciuto internamente con il nome in codice “Skimaki”. Secondo dipendenti citati dal quotidiano, nei confronti effettuati attraverso Jetski, uno strumento interno di Google per la programmazione assistita dall’AI, alcuni ingegneri avrebbero preferito il nuovo modello a Opus di Anthropic. Il risultato riguarda valutazioni interne e non costituisce un benchmark pubblico.
Business Insider aveva inoltre riportato a fine agosto che i dipendenti di Google stavano già provando Gemini 3.8 Flash attraverso Jetski, descrivendo miglioramenti rispetto alla precedente versione 3.7.
Il coding è diventato uno dei principali terreni di confronto tra i laboratori di intelligenza artificiale. I modelli più recenti non si limitano a completare singole righe di codice: possono analizzare repository, modificare più file, eseguire test, individuare errori e ripetere autonomamente le operazioni necessarie per arrivare a una soluzione.
Google presenta Gemini 3.8 Flash proprio come un modello pensato per questi compiti di lunga durata.
Cosa mostrano i benchmark pubblicati da Google
Nel benchmark DeepSWE v1.1, dedicato a problemi di ingegneria del software che richiedono sequenze prolungate di operazioni, Google sostiene che Gemini 3.8 Flash superi la maggior parte dei modelli frontier più grandi presi in esame, mantenendo costi inferiori. La società non interpreta però il risultato come una superiorità generale del modello su tutti i concorrenti.

Gemini 3.8 Flash ha ottenuto inoltre il 54,9% su HLE-Verified, test rivolto a problemi complessi di scienze, discipline umanistiche e attività professionali. Google segnala miglioramenti anche nei benchmark Vals Finance Agent V2 e Harvey’s Legal Agent Benchmark.

Una delle caratteristiche indicate dall’azienda riguarda la quantità di calcolo utilizzata durante l’esecuzione. Nei problemi più difficili, il modello può effettuare più passaggi di ragionamento e utilizzare strumenti esterni ripetutamente. Questo comportamento può aumentare il consumo di token e quindi il costo complessivo di una singola attività, anche quando il prezzo per token resta invariato.

Fino al 31 dicembre 2026 Google applica a Gemini 3.8 Flash un prezzo di 0,75 dollari per milione di token in input e 3,75 dollari per milione di token in output. Dal 1° gennaio 2027 i prezzi annunciati saliranno rispettivamente a 1,50 e 7,50 dollari.

Flash cresce mentre il modello Pro accumula ritardi
Il ritmo delle pubblicazioni della serie Flash contrasta con i problemi incontrati dalla linea Pro, destinata ai modelli più potenti di Gemini.
A maggio 2026 Sundar Pichai aveva indicato giugno come possibile periodo di uscita di Gemini 3.5 Pro. A fine giugno il lancio era stato rinviato almeno a luglio per consentire ulteriori modifiche e test, secondo quanto riportato da Business Insider. A luglio il modello non risultava ancora disponibile pubblicamente.
Il Wall Street Journal ha riferito il 2 settembre che alcuni candidati interni per Gemini 3.5 Pro erano stati abbandonati perché il miglioramento rispetto ai modelli Flash non era ritenuto sufficiente. Lo stesso giornale ha scritto che Gemini 4, il prossimo modello di punta previsto da Google, avrebbe ottenuto buoni risultati durante la fase di pretraining ma dovrebbe ancora completare il post-training. )
I modelli Flash hanno un vantaggio operativo per Google: richiedono meno capacità di calcolo e permettono a più gruppi di ricerca di sperimentare contemporaneamente. I modelli Pro, molto più grandi, impegnano invece una quota maggiore dell’infrastruttura e rendono ogni ciclo di addestramento più costoso.
Il cambio ai vertici di DeepMind
Il lancio arriva meno di un mese dopo la riorganizzazione della leadership di Google DeepMind.
Il 5 agosto Demis Hassabis ha lasciato la gestione quotidiana del laboratorio per diventare presidente di Google DeepMind e chief scientist di Alphabet, concentrandosi maggiormente sulla ricerca scientifica e sui programmi di lungo periodo. Koray Kavukcuoglu, fino ad allora chief technology officer di DeepMind, ha assunto la responsabilità operativa dell’organizzazione come senior vice president, con riporto diretto a Sundar Pichai.
Nello stesso periodo Jeff Dean, uno dei ricercatori più conosciuti di Google e per anni figura centrale nello sviluppo dell’intelligenza artificiale dell’azienda, ha annunciato l’uscita insieme ad altri ricercatori per avviare una nuova società. (Axios)
Gemini 3.8 Flash era però già in sviluppo da mesi. Il Wall Street Journal riferisce che il progetto era partito prima della riorganizzazione e che Kavukcuoglu partecipava alle decisioni operative sullo sviluppo di Gemini già da almeno un anno.
Google punta su modelli veloci per gli agenti AI
Gemini 3.8 Flash è disponibile attraverso la Gemini API, Google AI Studio e diversi servizi dell’azienda. Google lo ha inoltre reso accessibile agli abbonati Google AI Pro e Ultra nella app Gemini e in altri prodotti. Le note ufficiali della Gemini API indicano che il modello è entrato in disponibilità generale il 2 settembre.
Gemini 3.8 Flash Cyber
Accanto alla versione standard, Google ha presentato Gemini 3.8 Flash Cyber, variante specializzata nell’individuazione e nella correzione delle vulnerabilità software. L’accesso a quest’ultima è limitato attraverso il programma Fairwind a soggetti selezionati, tra cui autorità pubbliche, operatori di infrastrutture critiche e manutentori di software.

Il lancio non risolve automaticamente il problema più ampio di Google: dimostrare di poter competere con i migliori modelli disponibili non soltanto nei benchmark, ma nei sistemi di coding autonomo utilizzati ogni giorno dagli sviluppatori e dalle aziende.

Gemini 3.8 Flash fornisce però a Google un modello più competitivo proprio nella fascia in cui velocità, prezzo e capacità di eseguire lunghe sequenze di operazioni contano quanto la potenza assoluta. Il confronto con OpenAI e Anthropic passerà ora dai test interni all’uso su larga scala da parte di sviluppatori e imprese.

Ecco la traduzione, con i link mantenuti attivi.
Gemini 3.8 Flash e Cyber: come iniziare
- Sviluppatori: sviluppa con 3.8 Flash ed esplora workflow pensati per gli agenti in Google Antigravity, oppure inizia subito a creare con la Gemini API tramite Google AI Studio e Android Studio. Puoi anche generare interfacce utente con Stitch. Per iniziare, consulta la documentazione per sviluppatori.
- Aziende: accedi a 3.8 Flash tramite Gemini Enterprise.
- Consumatori: 3.8 Flash è disponibile per gli abbonati Google AI Pro e Ultra nell’app Gemini, nella Modalità AI di Google Search e in Gemini per Google Sheets.
- Cyber: attraverso il nuovo Fairwind Program, Google offre ad autorità governative considerate affidabili, operatori di infrastrutture critiche e manutentori di software un accesso prioritario a Gemini 3.8 Flash Cyber. È possibile richiedere l’accesso.







Partecipa alla community