Vai al contenuto

Google DeepMind ha presentato Gemini 3.8 Flash per coding, ragionamento e flussi agentici, insieme a Gemini 3.8 Flash Cyber per ricerca e correzione automatica delle vulnerabilità. Il modello generale è disponibile nei prodotti Google e via API; la variante Cyber passa invece dal programma Fairwind per difensori selezionati.

L’ANALISI

Gemini 3.8 Flash migliora coding e agenti, con una variante Cyber ad accesso limitato

Google DeepMind ha presentato Gemini 3.8 Flash per coding, ragionamento e flussi agentici, insieme a Gemini 3.8 Flash Cyber per ricerca e correzione automatica delle vulnerabilità. Il modello generale è disponibile nei prodotti Google e via API; la variante Cyber passa invece dal programma Fairwind per difensori selezionati.

2 min di letturaFatti, limiti e fonti primarie
Google DeepMind, annuncio ufficiale di Gemini 3.8 Flash e della variante 3.8 Flash Cyber
Google DeepMind, annuncio ufficiale di Gemini 3.8 Flash e della variante 3.8 Flash Cyber ↗

Risposta diretta: Gemini 3.8 Flash è un aggiornamento operativo per chi usa agenti e coding via API, con prezzo introduttivo uguale a 3.7 Flash ma possibile consumo maggiore sui task difficili. Flash Cyber è più specializzato, ma per ora non è un modello liberamente accessibile: Google lo riserva a organizzazioni difensive approvate.

Che cosa cambia rispetto a 3.7 Flash

Google posiziona 3.8 Flash come il nuovo modello Flash più capace per ingegneria del software, uso iterativo degli strumenti e ragionamento in più passaggi. La velocità e il listino introduttivo restano quelli di 3.7 Flash, ma il comportamento è orientato a svolgere più lavoro quando il compito lo richiede.

Prezzo e disponibilità

Il prezzo introduttivo dichiarato è 0,75 dollari per milione di token in ingresso e 3,75 dollari per milione di token in uscita fino al 31 dicembre 2026. Il modello generale arriva in Google AI Studio, API Gemini, Gemini Enterprise, Antigravity e negli abbonamenti Google AI Pro e Ultra.

La variante Cyber non è il modello generale

Gemini 3.8 Flash Cyber usa la stessa base ma mitigazioni e accesso differenti. È pensato per individuare vulnerabilità e produrre patch, con disponibilità prioritaria per autorità, operatori di infrastrutture critiche e manutentori software ammessi al programma Fairwind.

Come leggere i benchmark

Google riporta il 54,9% su HLE-Verified per il modello generale e il 47,2% pass@1 su CWE-Bench per Flash Cyber. Sono segnali utili per selezionare un test, non una misura universale della qualità su repository, strumenti e vincoli diversi.

Il limite pratico è il costo del task completo

Google avverte che 3.8 Flash può eseguire più ragionamento e più chiamate agli strumenti, soprattutto con effort elevato. La tariffa per token da sola non basta: vanno misurati token totali, numero di tentativi, tempo e percentuale di task completati.

Procedura verificabile

  1. Seleziona un insieme di task reali con esito verificabile e conserva i risultati ottenuti con 3.7 Flash.
  2. Esegui 3.8 Flash con lo stesso harness, gli stessi strumenti e limiti di tempo comparabili.
  3. Registra token in ingresso e uscita, chiamate agli strumenti, latenza, retry e costo del task completato.
  4. Controlla separatamente qualità del codice, test superati e regressioni di sicurezza.
  5. Per Flash Cyber verifica prima i requisiti Fairwind e non progettare un flusso produttivo dando per scontato l’accesso.

Fonti primarie

Apri l’annuncio ufficiale di Google DeepMind ↗
Radar AI · a cura di Francesco Gruner

Il sito, in una chat.

Servizi, guide e idee da approfondire

Sono l’assistente AI di questo sito. Ti aiuto a orientarti tra il lavoro di Francesco, il blog, Radar AI e i video, con i link alle fonti.

Risposte AI da verificare nelle fonti. 16 messaggi al giorno per rete.