GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
new/Ricerca CometAPI

Gemini 4 Pro è in arrivo: tutto ciò che sappiamo da test, indiscrezioni & voci RSI

Checkpoint di Gemini 4 Pro con un limite di token di output pari a 256k (rispetto ai precedenti ~64k), calcolo intensivo e possibili ambizioni per una finestra di contesto da 1.5M+.

CometAPI
AnnaTeam di ricerca su modelli AI e API
Aggiornato Sep 17, 2026 11 min di lettura
Gemini 4 Pro è in arrivo: tutto ciò che sappiamo da test, indiscrezioni & voci RSI
Usa questo schema

Esegui la prima chiamata API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR: Google ha confermato che Gemini 4 è la sua “corsa di pre-training più ambiziosa finora”. Leak di community a metà settembre 2026 indicano un checkpoint interno iniziale di Gemini 4 Pro (nome in codice “argon”) con un riportato limite di output di 256k token, possibile contesto da milioni di token e modalità di ragionamento ad alto sforzo. Le timeline non ufficiali convergono su ottobre 2026 dopo ritardi nel pre-training. I collegamenti con l’RSI (recursive self-improvement) restano speculativi. In attesa del rilascio ufficiale, gli sviluppatori possono accedere agli attuali modelli di frontiera — tra cui GPT-6 Astra, Gemini 3.8 Flash e Claude Fable 5.1 — tramite API unificate e scontate come CometAPI.

Punti chiave

  • Gemini 4 esiste ed è in fase di training. Google ha dichiarato a luglio 2026 di aver iniziato la sua “corsa di pre-training più ambiziosa finora” per Gemini 4.
  • Gemini 4 Pro non è stato annunciato ufficialmente. Nome, ID del modello, pricing, disponibilità API, finestra di contesto e specifiche finali restano non confermati. Screenshot trapelate e report della community descrivono un checkpoint di Gemini 4 Pro con limite di output di 256k token (vs. ~64k precedenti), compute ad alto sforzo e ambizioni di contesto 1,5M+.
  • Gemini 4.0 sembra essere emerso in silenzio su Arena.ai (apparentemente, Gemini 3.8 Flash viene instradato al nuovo Gemini Pro all’interno di Arena)
  • I target non ufficiali più credibili ora puntano a un rollout pubblico nell’ottobre 2026 dopo affinamenti del pre-training.
  • Le affermazioni di forte RSI per Gemini 4 restano non verificate; la ricerca correlata (Dream-RSI) migliora le strategie di esplorazione senza aggiornare i pesi.
  • Fino al rilascio ufficiale di Gemini 4 Pro, gli sviluppatori possono già sperimentare con modelli di frontiera attuali tramite piattaforme come CometAPI, inclusi Gemini 3.8 Flash, GPT-6 Astra e Claude Fable 5.1.

Che cos’è Gemini 4 Pro?

Gemini 4 Pro è il presunto modello di punta di livello “Pro” nella prossima grande generazione Gemini di Google DeepMind. Si colloca sopra le varianti Flash più leggere ed è pensato per lavori ad alta complessità: coding avanzato, ragionamento multi-step, compiti agentici di lungo orizzonte, comprensione multimodale e analisi di documenti o codebase su scala enterprise.

Diversamente dai rilasci iterativi 3.x Flash che sono proseguiti nel 2026, Gemini 4 è descritto dalla leadership di Google come richiedente modelli di base sostanzialmente più grandi per rimanere competitivo alla frontiera. Sundar Pichai ha dichiarato nella call degli utili di Alphabet Q2 2026: “Per la prossima generazione di frontiera, serviranno modelli di base molto più grandi. Stiamo ora addestrando Gemini 4 e siamo molto ambiziosi al riguardo.”

La designazione “Pro” segnala storicamente il livello pubblico con la massima capacità ottimizzato per la qualità rispetto a pura velocità o costo — simile ai precedenti Gemini Pro e 2.5 Pro che hanno guidato le classifiche di coding e ragionamento per lunghi periodi.

Cosa sappiamo su Gemini 4 Pro (al 17 settembre)

Segnali ufficiali confermati

Google ha riconosciuto pubblicamente Gemini 4 a luglio 2026. Nel post di lancio di Gemini 3.6 Flash (e relative varianti Flash), il team ha affermato di aver “già iniziato la nostra corsa di pre-training più ambiziosa finora, per Gemini 4.” Il CEO di Alphabet Sundar Pichai lo ha ribadito nella call del Q2, descrivendo Gemini 4 come richiedente “modelli di base molto più grandi” per restare alla frontiera, con enfasi esplicita su coding e agenti autonomi. Ha espresso entusiasmo interno per i progressi e fiducia che i risultati piaceranno agli utenti esterni al rilascio.

Non è stata pubblicata alcuna scheda modello ufficiale, conteggio di parametri, finestra di contesto, benchmark, pricing o endpoint API per Gemini 4 o Gemini 4 Pro. La serie Flash (inclusi Gemini 3.8 Flash e 3.8 Live di settembre 2026) continua a ricevere aggiornamenti frequenti mentre procede il lavoro sul livello Pro più grande.

Checkpoint trapelato e specifiche

I report della community indicano che Google ha prodotto un checkpoint interno iniziale del prossimo modello Pro. un demo zero-shot peacock svg sta circolando. il checkpoint precedente era Argon 160 / Gemini 3.8 Flash su Arena. Dettagli riportati includono:

  • Un limite di output di 256k token (un grande aumento rispetto ai ~64k dei modelli Gemini precedenti).
  • Generazione con impostazione di sforzo di pensiero “High” che ha richiesto circa 2.4 minuti.
  • Associazione con il tier Gemini 4 Pro piuttosto che con un’altra iterazione Flash.

Spese in conto capitale e connessione con l’RSI

A inizio agosto 2026, il dirigente di Google DeepMind Jasjeet Sekhon (chief strategy officer) ha descritto pubblicamente le massicce spese in conto capitale dell’industria sull’AI come una scommessa sull’RSI — sistemi che possono migliorare se stessi o i processi che producono la prossima generazione di modelli. Ha osservato che i ricavi attuali non giustificano ancora la scala della spesa e che l’RSI sta diventando parte centrale della tesi di investimento, pur riconoscendo che non è ancora stato raggiunto.

Separatamente, i ricercatori Google hanno pubblicato il paper Dream-RSI a metà settembre 2026, dimostrando un miglioramento ricorsivo delle strategie di esplorazione di un agente (senza aggiornare i pesi del modello) usando modelli Gemini 3.x. Questa è ricerca correlata ma non evidenza che Gemini 4 incorpori RSI forte nello spazio dei pesi.
L’inquadramento RSI sottolinea la scala strategica dello sforzo Gemini 4: Google sta investendo a un livello coerente con un salto generazionale piuttosto che un upgrade incrementale.

Arena.ai / LM Arena: menzioni e presunti instradamenti

Arena.ai (la piattaforma crowdsourced di preferenze umane, in precedenza LMSYS Chatbot Arena / LMArena) è un frequente luogo di test anticipato per i modelli Google. Nuove voci Gemini anonime o etichettate spesso appaiono lì prima degli annunci ufficiali e la community le tratta come segnali di rilasci a breve termine.

Gemini 4.0 è “emerso silenziosamente” e che il traffico etichettato come Gemini 3.8 Flash viene talvolta instradato a un nuovo checkpoint Gemini Pro all’interno delle battaglie di Arena:

  • http://Arena.ai ha improvvisamente lanciato una nuova variante "gemini-3.8-flash" questa mattina, 17 settembre
  • La 3.8 Flash ufficiale è stata rilasciata il 2 settembre; la ricomparsa dello stesso nome è estremamente insolita.

Gemini 4 Pro è in arrivo: tutto ciò che sappiamo da test, indiscrezioni & voci RSI

Cosa resta non confermato

Al 17 settembre 2026, non c’è alcun annuncio autorevole di Google che confermi:

Attributo di Gemini 4 ProStato attuale
Training di Gemini 4Confermato
Nome di Gemini 4 ProNon confermato
Primo checkpoint ProLeak/indiscrezione
Rilascio in ottobreLeak/stima
Rilascio tra novembre–dicembreStima esterna
Contesto da 1,5MLeak non verificato
Contesto da 10MAffermazione non verificata
Punteggi di benchmark specificiNon verificato
Confronto con GPT-6 AstraNon verificato
Confronto con Claude Fable 5.1Non verificato
Conseguimento dell’RSINon verificato
ID del modello APINon annunciato
Prezzi ufficialiNon annunciato

La relazione tra Gemini 4 Pro e RSI

L’RSI (recursive self-improvement) — sistemi che possono migliorare in modo significativo le proprie capacità o i processi che producono la prossima generazione — è diventato un tema frequente di speculazione attorno a ogni grande corsa di training di frontiera.

  • L’affermazione che “Google ha raggiunto l’RSI, rendendo il suo nuovo modello più potente” proviene da post su X, ma non è stata ancora confermata da test o report ufficiali.
  • Separatamente, i ricercatori Google (con collaboratori) hanno pubblicato Dream-RSI a settembre 2026. Il sistema consente a un agente di migliorare ricorsivamente le proprie strategie di esplorazione e ricerca “sognando” politiche alternative e mantenendo le migliori, senza mai aggiornare i pesi del modello sottostante. Gli esperimenti hanno usato Gemini 3.1 Pro e Gemini 3.7 Flash. Questo è un miglioramento a livello meta dello strato di orchestrazione, non un RSI nello spazio dei pesi che produca automaticamente un Gemini 4 più forte da Gemini 3.
  • La ricerca più ampia del 2026 (AIDE², vari paper su loop agentici e analisi economiche) mostra auto-miglioramenti limitati o a livello di componente — prompt migliori, skill, recupero di memoria o framework di valutazione — ma non un RSI a ciclo chiuso a livello di pesi che produca modelli di base via via più forti senza intervento umano.

In breve: Google sta chiaramente investendo in sistemi agentici auto-miglioranti e la corsa di training di Gemini 4 è descritta come insolitamente ambiziosa. Le forti affermazioni che il modello stesso incarni un RSI risolto restano non provate e vanno trattate come rumor.

Quali funzionalità sono confermate o attese per Gemini 4 Pro?

Sulla scia della traiettoria da Gemini 1.5 → 2.5 → 3.x e dei dettagli trapelati su “argon”, le seguenti aree sono i siti più plausibili di progresso significativo. Ognuna è formulata come aspettativa a livello H3 basata su dati di leak o su un’estrapolazione ragionevole dalle generazioni precedenti.

Capacità di output drasticamente ampliata

Il limite trapelato di 256k token di output consentirebbe la generazione di intere codebase multi-file, lunghi report di ricerca o documenti strutturati complessi in un’unica passata. I modelli Gemini precedenti erano più vincolati sulla lunghezza di output, richiedendo spesso continuazioni iterative. Solo questo cambiamento semplificherebbe le pipeline di coding agentico.

Finestra di contesto più lunga e migliore recupero

Le segnalazioni di un possibile contesto da 1,5M–2M token (ancora da decidere) estenderebbero la tradizionale forza di Google nella gestione di contesti lunghi. Combinato con retrieval migliorato e riduzione degli effetti di “lost in the middle”, questo favorirebbe analisi legali, scientifiche e di grandi codebase.

Coding e prestazioni agentiche più forti

Pichai ha esplicitamente evidenziato coding e coding agentico come aree di focus. Gemini 2.5 e 3.x hanno già prodotto grandi balzi su SWE-bench, LiveCodeBench e WebDev Arena. Si prevede che Gemini 4 Pro spingerà oltre su refactoring multi-file, bug fixing autonomo, affidabilità nell’uso di tool e pianificazione di lungo orizzonte.

Ragionamento più profondo / compute adattivo

La modalità “High” di sforzo di pensiero che ha impiegato 2.4 minuti sul checkpoint “argon” suggerisce un investimento continuo nello scaling del compute in fase di inferenza (simile a Deep Think o alle modalità di thinking esteso nella serie 3.x). Aspettatevi logica multi-step più affidabile, tassi di allucinazione inferiori su problemi difficili e livelli di sforzo configurabili.

Miglioramenti multimodali e degli strumenti nativi

Gemini è da tempo nativamente multimodale. Ulteriori guadagni nella comprensione video, nel ragionamento visivo in tempo reale e nel tool calling senza soluzione di continuità (strumenti in background senza interrompere il flusso di conversazione) sono coerenti con la direzione di 3.8 Live e release correlate.

Efficienza e ottimizzazioni di serving

Anche con modelli di base più grandi, Google abbina tipicamente i modelli Pro di frontiera a varianti Flash efficienti e a speculative decoding. Aspettatevi progressi continui in token per secondo e costo per qualità.

Quale assistenza può fornire CometAPI nell’attesa?

Fino alla spedizione di Gemini 4 Pro, gli sviluppatori possono già accedere a modelli allo stato dell’arte tramite l’endpoint unificato, compatibile con OpenAI, di CometAPI. Opzioni notevoli includono:

  • GPT-6 Astra – Il modello di punta di OpenAI per ragionamento complesso, coding, uso del computer e lavoro agentico di lungo orizzonte (contesto da 1,050,000 token, fino a 128k di output). Disponibile su CometAPI a uno sconto permanente rispetto al listino.
    Pagina del modello: https://www.cometapi.com/models/openai/gpt-6-astra/
    Guida all’uso: https://www.cometapi.com/how-to-use-gpt-6-astra-api/
  • Gli ultimi modelli Gemini 3.x Flash e di classe Pro (incluse le varianti 3.8) per workload multimodali e agentici.
  • Passaggio senza interruzioni tra provider con una singola chiave API e compatibilità con l’SDK OpenAI.
  • Documentazione di integrazione con la CLI di Gemini per workflow di coding agentico in locale.

Il catalogo di CometAPI porta in superficie rapidamente i modelli emergenti, quindi si può prevedere che Gemini 4 Pro (una volta rilasciato) apparirà accanto alla lineup esistente sotto lo stesso endpoint.

Come si confronta Gemini 4 Pro (proiezioni vs. frontiera attuale)

CapacitàGemini 3.x / 2.5 Pro (Pubblico)GPT-6 Astra (Pubblico)Gemini 4 Pro (Trapelato / Atteso)
Finestra di contestoFino a ~1–2M token1,050,000 tokenVociferato 1,5M–2M
Token massimi di output~64k128,000Trapelato 256k
Modalità di ragionamento / pensieroDeep Think / Extendedlivelli di sforzo da basso → massimoAlto sforzo (osservati 2.4 min)
Focus su coding/agenticoForte (progressi su SWE-bench)Punto di forza di puntaPriorità esplicita + claim da leak
MultimodalitàNativa (testo/immagine/video/audio)Input testo + immagineContinuità + miglioramento attesi
StatoProduzioneProduzione (set 2026)Checkpoint interno, non rilasciato

Note della tabella: Le cifre di Gemini 4 Pro derivano dal leak “argon” e dai report della community; non sono specifiche ufficiali di Google. Le specifiche di GPT-6 Astra provengono dalla documentazione pubblica.

Conclusione

Gemini 4 Pro rappresenta il prossimo passo dichiarato da Google alla frontiera: uno sforzo di pre-training su scala maggiore esplicitamente mirato a tenere il passo — e idealmente superare — i modelli contemporanei di OpenAI, Anthropic e altri. Il checkpoint “argon” di settembre 2026 offre la prima concreta (sebbene ancora non ufficiale) occhiata a una capacità di output ampliata e a ragionamento ad alto sforzo. Il timing di rilascio sembra stringersi attorno a ottobre 2026, sebbene la post-elaborazione del training e la valutazione restino variabili.

L’RSI rimane una direzione di ricerca attiva, non una funzionalità confermata del modello. Nel frattempo, il percorso pratico per gli sviluppatori è chiaro: continuare a consegnare con i sistemi più forti disponibili — GPT-6 Astra, gli attuali modelli Gemini 3.x e i pari — monitorando i canali ufficiali di Google per l’annuncio di Gemini 4. Piattaforme come CometAPI già aggregano questi modelli sotto un’unica chiave e un’unica relazione di billing, riducendo l’attrito sia oggi sia quando Gemini 4 Pro arriverà.

Continua a imparare

Collega questo articolo alla prossima decisione.

Vedi tutti gli argomenti
Pubblicato il Sep 17, 2026
Ultimo aggiornamento Sep 17, 2026
2 visualizzazioni
Revisionato per chiarezza, attribuzione delle fonti e terminologia API aggiornata.

Pronto a ridurre i costi di sviluppo AI del 20%?

Inizia gratuitamente in pochi minuti. Crediti di prova gratuiti inclusi. Nessuna carta di credito richiesta.

Leggi di più