Specifiche tecniche di Gemini 3.6 Flash
| Voce | Gemini 3.6 Flash |
|---|---|
| Provider | Google DeepMind |
| Model ID | gemini-3.6-flash |
| Model family | Gemini 3.x |
| Availability | Disponibilità generale (GA) |
| Input types | Testo, Immagine, Video, Audio, PDF |
| Output types | Testo |
| Context window | 1,048,576 token |
| Maximum output | 65,536 token |
| Thinking | Supportato (medio / alto) |
| Function calling | Sì |
| Code execution | Sì |
| File Search | Sì |
| URL Context | Sì |
| Search Grounding | Sì |
| Computer Use | Anteprima |
| Structured Output | Sì |
| Caching | Sì |
Fonte: documentazione dell'API Google Gemini.
Che cos'è Gemini 3.6 Flash?
Gemini 3.6 Flash è il più recente modello Flash di Google pronto per la produzione, progettato per offrire intelligenza di frontiera mantenendo la bassa latenza e l'efficienza dei costi per cui la serie Flash è nota. È ottimizzato per coding, comprensione multimodale, ragionamento e workflow agentici.
Rispetto a Gemini 3.5 Flash, il modello migliora la qualità della generazione di codice, l'accuratezza del ragionamento, l'uso degli strumenti e l'efficienza dei token, supportando al contempo una finestra di contesto massiva da 1 milione di token. Google lo posiziona come il modello predefinito robusto per gli sviluppatori che costruiscono agenti di IA e sistemi di automazione complessi.
Caratteristiche principali di Gemini 3.6 Flash
- Supporta l'elaborazione di contesti lunghi da 1M token.
- Input multimodali nativi, inclusi testo, immagini, video, audio e documenti PDF.
- Grandi miglioramenti nella generazione di codice e nei compiti di ingegneria del software.
- Supporto integrato per Function Calling, File Search, URL Context, Search Grounding e Computer Use.
- Più efficiente in termini di token rispetto a Gemini 3.5 Flash, riducendo il costo di inferenza mantenendo una qualità più elevata.
- Progettato per agenti di IA a più fasi e flussi di lavoro autonomi.
Prestazioni nei benchmark
Google riporta che Gemini 3.6 Flash offre migliori prestazioni in coding, ragionamento e multimodalità rispetto a Gemini 3.5 Flash, utilizzando significativamente meno token di output. L'azienda evidenzia prestazioni migliorate su benchmark interni di coding e agentici e afferma che il modello può ridurre l'uso di token di output fino al 65% in alcune valutazioni di ingegneria del software come DeepSWE, abbassando i costi di inferenza complessivi. Google non ha pubblicato tabelle di benchmark pubbliche complete (ad es., MMLU, GPQA, SWE-bench Verified) per questa release.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspetto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Release | 21 luglio 2026 (GA) | Inizio 2026 | ~Feb 2026 (Anteprima) |
| Posizionamento | Motore di lavoro efficiente per agenti, coding, multimodale | Precedente modello Flash agentico | Ragionamento avanzato di livello Pro |
| Prezzi (per 1M token) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Più alto (es., ~$2 input / $12 output) |
| Efficienza dei token | 17% di token di output in meno vs 3.5 Flash; meno passaggi/chiamate a strumenti | Riferimento | Meno efficiente nei workflow agentici |
| Velocità | Alta (famiglia Flash) | Alta | Più lento dei modelli Flash |
| Finestra di contesto | 1M token | 1M token | Probabilmente simile |
| Punti di forza | Coding, knowledge work, multimodale (grafici/documenti), uso del computer, efficienza agentica | Buon equilibrio agenti/coding | Ragionamento più profondo su problemi complessi |
Riepilogo rapido
- 3.6 Flash → La scelta migliore per la maggior parte degli utenti al momento: più veloce, più economico per attività, più efficiente di 3.5 Flash e supera 3.1 Pro in molti benchmark pratici/agentici.
- 3.5 Flash → Solido predecessore; ancora capace ma superato da 3.6 Flash (costo per token di output più alto, meno efficiente).
- 3.1 Pro → Più forte in alcuni scenari di ragionamento profondo ma più lento, più costoso e generalmente inferiore ai modelli Flash più recenti in velocità, efficienza e molti compiti reali/agentici.
Limitazioni
- La generazione di immagini non è supportata direttamente.
- La generazione audio non è disponibile.
- Computer Use rimane in Anteprima.
- Alcuni parametri legacy di generazione (
temperature,top_p,top_k) sono stati rimossi dalla nuova interfaccia API. - Le migliori prestazioni si ottengono tramite la versione più recente della Gemini Interactions API.
Come accedere all'API di Gemini 3.6 Flash
Passaggio 1: Ottieni l'accesso all'API
Accedi a cometAPI. Se non sei ancora nostro utente, registrati prima. Accedi alla CometAPI console. Ottieni la chiave API di credenziale di accesso dell'interfaccia. Clicca “Add Token” nel token API nel centro personale, ottieni la chiave token: sk-xxxxx e invia.

Passaggio 2: Invia richieste all'API Gemini 3.6 Flash
Seleziona l'endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” per inviare la richiesta API e imposta il corpo della richiesta. Il metodo della richiesta e il corpo della richiesta sono ottenuti dalla documentazione API del nostro sito web. Il nostro sito fornisce anche test Apifox per tua comodità. Sostituisci <YOUR_API_KEY> con la tua chiave CometAPI effettiva dal tuo account. base url is Gemini Generating Content
Inserisci la tua domanda o richiesta nel campo content—è ciò a cui il modello risponderà . Elabora la risposta dell'API per ottenere la risposta generata.
Passaggio 3: Elabora le risposte
L'API restituisce risposte candidate strutturate che includono testo generato, citazioni, metadati di sicurezza e output opzionali degli strumenti.