
Gemini 4
Esplora l'API di Gemini 4.

Esplora l'API di Gemini 4.

Gemini 3.8 Flash è un modello Gemini leggero di nuova generazione, con l'obiettivo di raggiungere un migliore equilibrio tra velocità, costi e capacità di programmazione.

Gemini 3.1 Flash Lite Image model è uno specialista dell’efficienza nella famiglia della generazione di immagini, progettato per una latenza ultrabassa e per una generazione e modifica di immagini a costi contenuti.

Gemini 3.5 Flash è un modello di IA ad alta velocità progettato per risposte rapide e prestazioni efficienti nella programmazione. Offre una velocità di generazione significativamente migliorata, pur mantenendo una solida capacità di ragionamento, il che lo rende adatto ad applicazioni in tempo reale e ai flussi di lavoro degli sviluppatori.

3.7 Flash offre miglioramenti sostanziali nei flussi di lavoro di ingegneria del software, lavoro della conoscenza e sviluppo web — con un prezzo di lancio pari alla metà del costo originale di 3.6 Flash per milione di token.

Gemini 3.1 Pro è la nuova generazione della serie di modelli Gemini, una suite di modelli di ragionamento altamente capaci e nativamente multimodali. Gemini 3 Pro è ora il modello più avanzato di Google per attività complesse e può comprendere vasti dataset e problemi impegnativi provenienti da diverse fonti informative, inclusi testo, audio, immagini, video e interi repository di codice

Gemini 3.6 Flash offre un’intelligenza di frontiera sostenuta, ottimizzata per attività del mondo reale, a una velocità maggiore e a un costo inferiore. Progettato per l’era degli agenti, eccelle nella generazione di codice, nell’esecuzione basata su agenti e nel ragionamento spaziale. Questo modello è particolarmente efficace per rapidi cicli basati su agenti che coinvolgono iterazioni e cicli di codifica complessi.

Panoramica delle capacità principali: Risoluzione: Fino a 4K (4096×4096), alla pari con Pro. Coerenza delle immagini di riferimento: Fino a 14 immagini di riferimento (10 oggetti + 4 personaggi), mantenendo la coerenza di stile e dei personaggi. Rapporti d'aspetto estremi: Aggiunti i nuovi rapporti 1:4, 4:1, 1:8, 8:1, adatti a immagini lunghe, poster e banner. Rendering del testo: Generazione di testo avanzata, adatta per infografiche e layout per poster di marketing. Miglioramento della ricerca: Integrazione di Ricerca Google + Ricerca immagini. Grounding: Processo di ragionamento integrato; i prompt complessi vengono analizzati prima della generazione.

Gemini Omni Fast è un modello multimodale leggero per la generazione di video, progettato per una creazione di contenuti rapida e flessibile. Consente una generazione di video efficiente con supporto per molteplici tipi di input, rendendolo adatto a flussi di lavoro interattivi e iterativi.
Veo 3.1 Fast è una versione ottimizzata di Veo 3.1, progettata per la generazione rapida di video e per produzioni ad alto throughput. Mantiene una qualità visiva elevata migliorando significativamente la velocità, il che la rende adatta alla creazione di contenuti in batch e a flussi di lavoro scalabili.

Veo 3.1 è un modello di generazione video basato sull'IA di punta, progettato per output cinematografici di alta qualità con sincronizzazione audio nativa. Offre movimenti realistici, elevata fedeltà visiva e una generazione audiovisiva strettamente allineata per la produzione video professionale.

Gemini 3.1 Flash-Lite è un modello Tier-3 altamente efficiente in termini di costi e a bassa latenza della serie Gemini 3 di Google, progettato per flussi di lavoro di IA di produzione ad alto volume, in cui throughput e velocità contano più della massima profondità di ragionamento. Combina un'ampia finestra di contesto multimodale con prestazioni di inferenza efficienti, a un costo inferiore rispetto alla maggior parte dei modelli di punta.

Nano Banana Pro è un modello di IA per l’assistenza di uso generale in flussi di lavoro incentrati sul testo. È adatto a prompt in stile istruzioni per generare, trasformare e analizzare contenuti con una struttura controllabile. Gli utilizzi tipici includono assistenti di chat, sintesi di documenti, domande e risposte basate sulla conoscenza e automazione dei flussi di lavoro. I dettagli tecnici pubblici sono limitati; l’integrazione è in linea con gli schemi comuni degli assistenti IA, come output strutturati, prompt arricchiti dal recupero e chiamata di strumenti o funzioni.
Veo 3 Fast è la variante ottimizzata per la velocità della famiglia di modelli generativi video di Google (Veo 3 / Veo 3.1 ecc.). È progettato per produrre clip video brevi e di alta qualità con audio generato in modo nativo, dando priorità al throughput e al costo per secondo, scambiando parte della massima fedeltà visiva e/o della durata più lunga di una singola ripresa a favore di una generazione molto più rapida e di un prezzo inferiore. Che cos'è Veo 3 Fast — introduzione concisa
Veo 3 di Google DeepMind rappresenta l’avanguardia della generazione da testo a video, segnando la prima volta in cui un modello di IA generativa su larga scala sincronizza perfettamente video ad alta fedeltà con l’audio corrispondente — inclusi dialoghi, effetti sonori e paesaggi sonori ambientali.

Gemini 3 Flash è un modello multimodale su larga scala, leggero ed efficiente, di Google, progettato per scenari reali che richiedono risposte rapide e bassa latenza.
gemini-3.1-flash in arrivo

Prossimamente
Gemini 3.5 Flash-Lite è un modello multimodale a bassa latenza e conveniente in termini di costi, ottimizzato per un'esecuzione a throughput elevato e a basso costo per attività di sottoagenti e per il parsing dei documenti. Il modello supporta input di testo, immagini, video, audio e PDF ed è progettato for flussi di lavoro basati su agenti ad alto volume, per l'estrazione semplice di dati e per applicazioni in cui la latenza e il costo delle API sono i vincoli principali.

Prossimamente