Gemini 3.7 Flash: Novità, Prezzi e Alternative (2026)

Google ha annunciato Gemini 3.7 Flash il 13 agosto 2026, definendolo "il nostro modello 'workhorse' più intelligente di sempre per la programmazione e gli agenti". Costa la metà rispetto a 3.6 Flash, arrivando tre settimane dopo quest'ultimo. Il prezzo indicato è promozionale e scadrà alla fine dell'anno.
Questo articolo analizza le novità, il prezzo effettivo e ciò che i benchmark misurano concretamente. Spiega inoltre a cosa affidarsi quando il risultato finale richiesto è un report o una presentazione. I dati sono aggiornati al 17 agosto 2026.
Le novità di Gemini 3.7 Flash
La novità principale è il salto di qualità nelle attività agentiche e di programmazione. Google indica come aree target l'ingegneria del software, il knowledge work, lo sviluppo web, la generazione di codice, il debugging, la risoluzione dei problemi, la comprensione dei documenti e l'automazione dei flussi di lavoro aziendali.
Due di queste aree sono fondamentali per chiunque lavori con i file anziché con il codice. La comprensione dei documenti e l'automazione dei flussi di lavoro aziendali sono quelle che interessano fogli di calcolo, rendiconti e report.
La frequenza di rilascio merita una nota a sé. Gemini 3.6 Flash è arrivato circa tre settimane prima, quindi si tratta di un'iterazione rapida piuttosto che di un cambio generazionale.
Questo ritmo ha una conseguenza pratica. Qualsiasi cosa si sviluppi attorno a una versione specifica del modello deve essere in grado di tollerare l'aggiornamento della versione sottostante.
Google inquadra inoltre questo livello esplicitamente come un modello "workhorse" piuttosto che come un modello di frontiera. È pensato per gestire volumi elevati e contenere i costi, non per risolvere il singolo problema più complesso che vi trovate ad affrontare.
La disponibilità varia a seconda del pubblico. Gli sviluppatori possono accedervi in Google AI Studio, Android Studio e Google Antigravity. Le aziende lo ottengono tramite la Gemini Enterprise Agent Platform. Gli utenti privati possono utilizzarlo tramite Gemini Spark, disponibile per gli abbonati a AI Pro e Ultra in oltre 160 paesi.
Queste tre piattaforme non sono lo stesso prodotto. Uno sviluppatore che effettua test in AI Studio e un collega che utilizza Spark lavorano con interfacce e limiti differenti.
Prezzi e la data da tenere d'occhio
| Ora | Dal 1° gennaio 2027 | |
|---|---|---|
| Input | $0.75 per 1M di token | $1.50 per 1M di token |
| Output | $3.75 per 1M di token | $7.50 per 1M di token |
Google dichiara chiaramente che "Le tariffe promozionali scadranno il 31 dicembre 2026". Il raddoppio dei prezzi è ufficiale, non si tratta di un'ipotesi.
Rispetto a 3.6 Flash, Google descrive la tariffa attuale come "la metà del costo originale di 3.6 Flash per milione di token". Di conseguenza, lo sconto è reale oggi ma temporaneo per definizione.
Se state pianificando un budget oltre quest'anno, basatevi sulle cifre di gennaio. Una previsione di spesa costruita sulla tariffa promozionale si rivelerà errata nel giro di pochi mesi.
Vale anche il discorso inverso. Per un progetto che si concluderà entro quest'anno, la tariffa attuale rappresenta un risparmio economico reale e non solo una cifra di marketing.
Un ulteriore dettaglio influisce sulla pianificazione. Il raddoppio si applica sia all'input che all'output, pertanto il rapporto tra i due rimane invariato.
Cosa misurano (e cosa no) i benchmark
Google ha pubblicato cinque confronti con 3.6 Flash. I miglioramenti sono notevoli in ognuno di essi.
| Benchmark | 3.7 Flash | 3.6 Flash |
|---|---|---|
| FrontierCode 1.1 Main | 43.6% | 34.4% |
| DeepSWE v1.1 | 65.3% | 49.0% |
| WebDev Arena Elo | 1588 | 1538 |
| GDP.pdf | 34.0% | 22.0% |
| AutomationBench | 30.4% | 17.0% |
Tre dei cinque benchmark sono valutazioni di programmazione. Dicono ben poco sulla capacità del modello di leggere correttamente il vostro export trimestrale.
Quello che si avvicina di più a questo tipo di attività è GDP.pdf, una valutazione sulla comprensione dei documenti. Guardate il suo valore assoluto piuttosto che il miglioramento: 34.0% significa che circa due terzi degli elementi vengono ancora tralasciati.
Lo stesso vale per AutomationBench. Un salto dal 17.0% al 30.4% rappresenta un grande guadagno relativo, ma un punteggio assoluto comunque basso.
Questa combinazione rappresenta la sintesi più onesta. Si tratta di un modello significativamente migliore per il lavoro sui documenti, ma il lavoro sui documenti rimane comunque la colonna più debole del quadro generale.
Cosa cambia se il vostro output finale è un report o una presentazione
Un'inferenza più economica e veloce modifica l'aspetto economico prima ancora di migliorare la qualità dell'output. Dimezzare il costo dei token rende sensato eseguire passaggi che in precedenza venivano saltati.
Il candidato ideale è la verifica. Richiedere un secondo passaggio per controllare un dato rispetto alla sua fonte costa pochissimo quando i token sono economici.
Il secondo candidato è il volume. Elaborare ogni singolo file in una cartella diventa sostenibile, anziché dover ricorrere a un campionamento.
Il terzo è l'iterazione. Quando il primo tentativo costa poco, è possibile porre la stessa domanda in tre modi diversi e confrontare le risposte.
Ciò che non cambia è l'ultimo miglio. Un modello che restituisce numeri corretti vi lascia comunque il compito di assemblare il grafico, il riepilogo scritto e le slide. La nostra pagina dedicata al generatore di report AI spiega come viene gestita questa fase di assemblaggio.
Ecco perché il costo per token è un indicatore debole del costo per deliverable. I token sono raramente la parte più costosa della produzione di un report.
Valutate il cambiamento in base a ciò che ora potete permettervi di fare due volte. Controllare il proprio lavoro è il passaggio che la maggior parte delle persone salta per motivi di costo.
Tre cose che l'annuncio non dice
La finestra di contesto. Nel post non compare alcuna cifra. Se i vostri file sono lunghi, questa omissione è la prima cosa da testare.
Come gestisce gli input tabellari disordinati. La comprensione dei documenti viene indicata come un punto di forza, senza però descrivere cosa accada con celle unite, intestazioni su più righe o tabelle scansionate.
Se la disponibilità su Spark equivalga alla parità con le API. Gemini Spark e le API sono elencate come piattaforme distinte, e il post non specifica se il comportamento sia identico.
Quali sono i limiti di frequenza (rate limit). Nell'annuncio non compare alcuna quota al minuto o al giorno, un aspetto che conta di più con un prezzo basso rispetto a uno alto.
C'è una quarta lacuna importante per la pianificazione. Non viene detto nulla su quanto a lungo Gemini 3.7 Flash rimarrà la versione corrente, considerando che Gemini 3.6 Flash è durato circa tre settimane.
Dove un modello più veloce smette di essere d'aiuto
Un modello è solo un componente. Il lavoro su cui venite giudicati è un prodotto finito, e il divario tra i due è ciò che richiede la maggior parte del tempo.
Questo divario si compone di tre parti: portare il file in un formato utilizzabile, decidere quali numeri contano davvero e produrre qualcosa che un collega possa leggere senza bisogno della vostra spiegazione a voce.
Notate come solo la parte centrale riguardi effettivamente l'intelligenza. La prima e l'ultima riguardano la gestione dei file e la produzione dei formati.
Nessuno di questi tre problemi viene risolto da un token più economico. Si risolvono invece con strumenti che integrano il file, l'analisi e l'output in un'unica piattaforma.
Questo è il livello in cui opera Powerdrill Bloom. Potete caricare file Excel, CSV, TSV o PDF ed esplorarli su un'area di lavoro (canvas). Ciò che decidete di conservare si trasforma in un grafico, un report o in slide in un solo passaggio. Il suo limite oggettivo risiede nella direzione opposta: non si tratta di un endpoint di modello grezzo, quindi non avrete il controllo su token, temperatura o scelta del modello.
Alternative da conoscere
| Se avete bisogno di | Prendete in considerazione |
|---|---|
| Inferenza economica e veloce per attività agentiche e di programmazione | Gemini 3.7 Flash |
| Ragionamento profondo su documenti lunghi e disordinati | Un modello di frontiera piuttosto che un livello "workhorse" |
| Un grafico, report o presentazione finiti a partire da un file di dati | Un agente d'azione con caricamento file ed esportazione |
| Una visualizzazione interattiva su un Google Sheet | Sheets canvas, di cui parliamo nella nostra guida a Sheets canvas |
Scegliete in base alla parte della catena che vi manca. Se l'elemento mancante è il costo dell'inferenza, un modello "workhorse" è la risposta.
Tenete presente che non si tratta di acquisti in concorrenza tra loro. Un livello di modello e uno strumento di distribuzione si collocano in punti diversi, e la maggior parte dei team finisce per pagare per entrambi.
Se l'elemento mancante è il prodotto finale, un modello più economico non lo genererà. Si tratta di una categoria di strumenti diversa, non di una più debole.
Conclusione
Gemini 3.7 Flash rappresenta un reale passo avanti nelle attività agentiche e di gestione dei documenti, alla metà del costo precedente, e questo dimezzamento del costo è temporaneo. Questi sono i tre fatti fondamentali da ricordare.
Il dato da tenere d'occhio è GDP.pdf al 34.0%. Miglioramento e sufficienza sono due cose diverse, e la comprensione dei documenti rimane la colonna da verificare personalmente.
Se il vostro lavoro si conclude con un grafico, un riepilogo scritto o una presentazione, provate Powerdrill Bloom con uno dei vostri file. Consultate anche le nostre guide sui plugin degli agenti e su cos'è MCP.
Domande frequenti
Cos'è Gemini 3.7 Flash?
È il modello di livello "workhorse" di Google annunciato il 13 agosto 2026, descritto come il suo modello "workhorse" più intelligente di sempre per la programmazione e gli agenti. Google indica la programmazione, il knowledge work, la comprensione dei documenti e l'automazione dei flussi di lavoro aziendali tra le sue aree target.
Quanto costa Gemini 3.7 Flash?
Attualmente $0.75 per milione di token di input e $3.75 per milione di token di output. Google dichiara che questa tariffa promozionale scadrà il 31 dicembre 2026, dopodiché si applicheranno le tariffe di $1.50 e $7.50.
È migliore di Gemini 3.6 Flash?
Google ha pubblicato miglioramenti in tutti e cinque i benchmark di confronto, tra cui FrontierCode 1.1 Main al 43.6% contro il 34.4%. Indica inoltre il prezzo attuale come la metà del costo originale di 3.6 Flash per milione di token.
Quanto è ampia la sua finestra di contesto?
L'annuncio non specifica una cifra per la finestra di contesto. Se i file lunghi sono importanti per il vostro lavoro, vi consigliamo di testarla personalmente anziché dare per scontata la parità con un altro livello.
Può trasformare un foglio di calcolo in una presentazione?
Un modello restituisce testo e ragionamento, non una presentazione formattata. La produzione di slide a partire da un file di dati richiede strumenti che gestiscano il file e l'esportazione, il che rappresenta un livello separato rispetto al modello.