Specifiche tecniche di Gemini 3.6 Flash
| Aspetto | Gemini 3.6 Flash |
|---|---|
| Provider | Google DeepMind |
| ID modello | gemini-3.6-flash |
| Famiglia del modello | Gemini 3.x |
| Disponibilità | Disponibilità generale (GA) |
| Tipi di input | Testo, Immagini, Video, Audio, PDF |
| Tipi di output | Testo |
| Finestra di contesto | 1,048,576 token |
| Output massimo | 65,536 token |
| Ragionamento | Supportato (medio/alto) |
| Chiamata di funzioni | Sì |
| Esecuzione del codice | Sì |
| Ricerca file | Sì |
| Contesto URL | Sì |
| Grounding tramite ricerca | Sì |
| Uso del computer | Anteprima |
| Output strutturato | Sì |
| Caching | Supportato |
Fonte: documentazione dell'API Google Gemini.
Che cos'è Gemini 3.6 Flash?
Gemini 3.6 Flash è il più recente modello Flash di Google pronto per la produzione, progettato per offrire un'intelligenza di frontiera mantenendo la bassa latenza e l'efficienza dei costi per cui la serie Flash è nota. È ottimizzato per la generazione di codice, la comprensione multimodale, il ragionamento e i flussi di lavoro agentici.
Rispetto a Gemini 3.5 Flash, il modello migliora la qualità della generazione di codice, l'accuratezza del ragionamento, l'uso degli strumenti e l'efficienza dei token, supportando al contempo un'enorme finestra di contesto da 1 milione di token. Google lo posiziona come il modello “cavallo di battaglia” predefinito per gli sviluppatori che costruiscono agenti di IA e sistemi di automazione complessi.
Caratteristiche principali di Gemini 3.6 Flash
- Supporta l'elaborazione di contesti lunghi da 1M token.
- Input multimodali nativi, inclusi testo, immagini, video, audio e documenti PDF.
- Miglioramenti significativi nella generazione di codice e nei compiti di ingegneria del software.
- Supporto integrato per Chiamata di funzioni, Ricerca file, Contesto URL, Grounding tramite ricerca e Uso del computer.
- Più efficiente in termini di token rispetto a Gemini 3.5 Flash, riducendo i costi di inferenza mantenendo una qualità superiore.
- Progettato per agenti di IA multi‑passo e flussi di lavoro autonomi.
Prestazioni nei benchmark
Google riporta che Gemini 3.6 Flash offre prestazioni superiori nella programmazione, nel ragionamento e nel multimodale rispetto a Gemini 3.5 Flash, pur utilizzando significativamente meno token di output. L'azienda evidenzia prestazioni migliorate su benchmark interni di coding e agentici e afferma che il modello può ridurre l'uso di token di output fino al 65% in alcune valutazioni di ingegneria del software come DeepSWE, abbassando i costi complessivi di inferenza. Google non ha pubblicato tabelle complete di benchmark pubblici (ad es., MMLU, GPQA, SWE-bench Verified) per questa release.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspetto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Rilascio | 21 luglio 2026 (GA) | Inizio 2026 | ~Feb 2026 (Preview) |
| Posizionamento | Cavallo di battaglia efficiente per agenti, coding, multimodale | Precedente modello Flash agentico | Reasoning Pro avanzato |
| Prezzi (per 1M token) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Più alti (es., ~$2 input / $12 output) |
| Efficienza dei token | 17% di token di output in meno vs 3.5 Flash; meno passaggi/chiamate a strumenti | Baseline | Meno efficiente nei flussi agentici |
| Velocità | Alta (famiglia Flash) | Alta | Più lenta dei modelli Flash |
| Finestra di contesto | 1M token | 1M token | Probabilmente simile |
| Punti di forza | Generazione di codice, knowledge work, multimodale (grafici/documenti), uso del computer, efficienza agentica | Buon equilibrio agenti/codice | Ragionamento più profondo su problemi complessi |
Sintesi rapida
- 3.6 Flash → La scelta complessiva migliore per la maggior parte degli utenti oggi: più veloce, più economico per task, più efficiente di 3.5 Flash e supera 3.1 Pro in molti benchmark pratici/agentici.
- 3.5 Flash → Solido predecessore; ancora valido ma superato da 3.6 Flash (costo token di output più alto, meno efficiente).
- 3.1 Pro → Più forte in alcuni scenari di ragionamento profondo ma più lento, più costoso e in generale dietro ai nuovi modelli Flash in velocità, efficienza e molti compiti reali/agentici.
Limitazioni
- La generazione di immagini non è supportata direttamente.
- La generazione audio non è disponibile.
- L'Uso del computer resta in anteprima.
- Alcuni parametri legacy di generazione (
temperature,top_p,top_k) sono stati rimossi dalla nuova interfaccia API. - Le prestazioni migliori si ottengono tramite la versione più recente della Gemini Interactions API.
Come accedere all'API Gemini 3.6 Flash
Passaggio 1: ottenere l'accesso all'API
Accedi a cometAPI. Se non sei ancora nostro utente, registrati prima. Accedi alla tua CometAPI console. Ottieni la chiave API delle credenziali di accesso dell'interfaccia. Fai clic su “Add Token” al token API nel centro personale, ottieni la chiave token: sk-xxxxx e invia.

Passaggio 2: inviare richieste all'API Gemini 3.6 Flash
Seleziona l'endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” per inviare la richiesta API e imposta il corpo della richiesta. Il metodo di richiesta e il corpo della richiesta sono ottenuti dalla documentazione API del nostro sito. Il nostro sito fornisce anche test Apifox per tua comodità. Sostituisci <YOUR_API_KEY> con la tua chiave CometAPI reale dal tuo account. L'URL di base è Gemini Generating Content
Inserisci la tua domanda o richiesta nel campo content—è ciò a cui il modello risponderà. Elabora la risposta dell'API per ottenere la risposta generata.
Passaggio 3: elaborare le risposte
L'API restituisce risposte candidate strutturate che includono testo generato, citazioni, metadati di safety e output opzionali degli strumenti.