// data & ai · giornale tecnico MILANO ● LIVE 00:00:00

Google spinge la serie Gemini Flash su efficienza e prezzo: 3.6 Flash, 3.5 Flash-Lite e Flash Cyber

Google aggiorna il tier Flash di Gemini puntando su token efficiency e costi più bassi. La 3.6 Flash usa il 17% di output token in meno della 3.5 Flash, con prezzo di output ridotto da 9,00 a 7,50 dollari per milione.

Google ha rilasciato tre nuovi modelli nel tier Flash di Gemini: 3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber. È un tier pensato per velocità, costo e carichi agentic ad alto volume, non per la massima profondità di reasoning. Per chi manda in produzione agenti che fanno molte chiamate, la metrica che conta qui è il costo per task, e su quello Google ha lavorato.

La 3.6 Flash diventa il modello di default. Sull’Artificial Analysis Index usa il 17% di output token in meno rispetto alla 3.5 Flash, con una riduzione che sul benchmark DeepSWE arriva fino al 65%. Il prezzo scende in parallelo: 1,50 dollari per milione di input token e 7,50 per milione di output, contro i 9,00 precedenti in output. Meno verbosità più prezzo di output più basso significa costo per task agentic più contenuto. Migliora anche la qualità: DeepSWE 49% contro 37%, MLE Bench 63,9% contro 49,7%, OSWorld-Verified 83,0% contro 78,4%. Il computer use diventa uno strumento client-side integrato nell’API.

La 3.5 Flash-Lite punta su bassa latenza e throughput: 350 output token al secondo, a 0,30/2,50 dollari per milione. Supera la vecchia 3.1 Flash-Lite (Terminal-Bench 2.1 al 54% contro 31%) e in alcuni casi anche la più grande 3 Flash, come su SWE-Bench Pro (54,2% contro 49,6%). Espone livelli di thinking configurabili (minimal, low, higher) per bilanciare costo e capacità.

Il caso Flash Cyber

La 3.5 Flash Cyber è la più specializzata: fine-tuned per trovare, validare e patchare vulnerabilità software. La logica è quella di un modello economico chiamato molte volte: dentro CodeMender, l’agente di code security di Google, più istanze girano in parallelo fino a cinque invocazioni. Sul motore JavaScript V8 ha individuato 55 issue confermate uniche, contro le 47 della 3.5 Flash e le 36 di Claude Opus 4.6. Proprio per il rischio dual-use, questo modello resta in accesso limitato a governi e partner selezionati.

In sintesi

  • La 3.6 Flash taglia gli output token (17%, fino al 65% su DeepSWE) e abbassa il prezzo di output da 9,00 a 7,50 dollari per milione.
  • La 3.5 Flash-Lite gira a 350 token/s a 0,30/2,50 dollari per milione e supera la vecchia 3 Flash su alcuni eval.
  • La 3.5 Flash Cyber alimenta scansioni multi-agente low-cost, ma è gated per il rischio dual-use.

Fonte: Google Releases Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

Condividi X Facebook LinkedIn WhatsApp Email

// scritto da

Fernando

Hai qualcosa da aggiungere? Unisciti alla discussione.

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Altri dell'autore

dalla stessa firma