Tekniske specifikationer for Gemini Nano Banana 2.1
| Punkt | Gemini Nano Banana 2.1 |
|---|---|
| Model-ID | gemini-nano-banana-2.1 |
| Udbyder | |
| Modelfamilie | Gemini 3-serien; baseret på Gemini 3.6 Flash |
| Modeltype | Højeffektiv billedgenerering og konversationsredigering |
| Inputtyper | Tekst, billede, video, PDF |
| Outputtyper | Billede og tekst |
| API-input token-grænse | 131,072 tokens |
| API-output token-grænse | 32,768 tokens |
| Billedoutputopløsninger | 1K, 2K, 4K; 1K er standard |
| Tænkning | Understøttet; minimal, medium (default), high |
| Søgeforankring | Understøttet, inkl. Google Web Search og Image Search |
| Billedgenerering | Understøttet |
| Batch-API | Understøttet |
| Stabil version | gemini-nano-banana-2.1 |
| Senest dokumenterede opdatering | oktober 2026 |
Hvad er Gemini Nano Banana 2.1?
Gemini Nano Banana 2.1 er Googles højeffektive model til billedgenerering og konversationsredigering. Den opdaterer Nano Banana 2, bevarer effektiviteten på Flash-niveau og tilføjer forbedringer i visuel kvalitet, prompt-efterlevelse, figur-konsistens på tværs af flere runder, tekstgengivelse og infografiklayout.
Modellen er baseret på Gemini 3.6 Flash og kombinerer tekst- og billedeforståelse med generering af billeder og tekst. Den er beregnet til hurtig, iterativ billedskabelse og -redigering frem for generelle workloads som funktionkald eller kodeeksekvering.
Hovedfunktioner i Gemini Nano Banana 2.1
- 1K-, 2K- og 4K-billedgenerering: Producerer billeder i tre dokumenterede outputopløsninger, med 1K som standard.
- Sammenfletning af flere referencebilleder: Understøtter op til 14 referencebilleder, med dokumenterede konsistensmål for op til 4 figurer og høj fidelitet for op til 10 objekter.
- Forbedret tekst- og infografikgengivelse: Google rapporterer bedre tekstgengivelse og nøjagtigere infografiklayout, hvilket gør modellen velegnet til plakater, diagrammer og informationsrige visuelle elementer.
- Konversationsredigering i flere runder: Designet til iterativ billedskabelse og -redigering med forbedret figur-konsistens på tværs af runder.
- Google-søgeforankring: Kan anvende Google Web Search og Image Search-forankring til workflows, der har gavn af aktuel eller visuelt forankret information.
- Konfigurerbar tænkning: Understøtter
minimal,mediumoghightænkning, medmediumsom standard.
Benchmark-ydelse for Gemini Nano Banana 2.1
Googles modelkort fra oktober 2026 rapporterer følgende evalueringer af billedgenerering og -redigering. Dette er Elo-stil præferencescores og målinger af faktualitet frem for en enkelt generel benchmarkscore.
| Evaluering | Nano Banana 2.1 Thinking | Nano Banana 2.1 No Thinking |
|---|---|---|
| Tekst-til-billede samlet præference | 1050 ± 14 | 1015 ± 13 |
| Tekst-til-billede infografikdesign | 1048 ± 17 | 1001 ± 17 |
| Tekst-til-billede infografik-faktualitet | 0.521 | 0.328 |
| Redigering Generel redigering | 1026 ± 12 | 980 ± 15 |
| Redigering Konsistens for enkeltfigur | 1028 ± 14 | 1021 ± 14 |
| Redigering Konsistens for flere figurer | 1106 ± 14 | 1068 ± 14 |
| Redigering Maske-/blækbaseret redigering | 1049 ± 15 | 1042 ± 16 |
| Redigering Produktkonsistens | 1024 ± 18 | 981 ± 18 |
| Redigering Stilisering | 1062 ± 20 | 1036 ± 17 |
| Redigering Redigering med flere referencer | 1066 ± 22 | 1041 ± 20 |
Googles modelkort sammenligner disse resultater med Gemini 3.1 Flash Image ("Nano Banana 2") og Gemini 3 Pro Image ("Nano Banana Pro"). På de rapporterede evalueringer fra oktober 2026 scorer Nano Banana 2.1 Thinking højere end begge sammenligningsmodeller på samlet præference for tekst-til-billede, infografikdesign, generel redigering, konsistens for flere figurer, maske/blæk-redigering, stilisering og redigering med flere referencer.
Gemini Nano Banana 2.1 vs. relaterede billedmodeller
| Model | Positionering | Særligt kendetegn |
|---|---|---|
| Gemini Nano Banana 2.1 | Højeffektiv billedgenerering/redigering | Nyere model med konfigurerbar tænkning, 14-billede referencefusion og forbedret tekst-/infografikgengivelse |
| Gemini 3.1 Flash Image (Nano Banana 2) | Tidligere Flash-billedmodel | Tidligere generation; Nano Banana 2.1 er positioneret som dens opdatering |
| Gemini 3 Pro Image (Nano Banana Pro) | Højere-end billedmodel | Nano Banana 2.1 er positioneret som den mere effektive modpart |
Til hurtig iterativ generering, redigering, multireference-komposition og tekstrigt visuelt indhold er Nano Banana 2.1 det bedre valg blandt disse, når effektivitet er prioriteten. Nano Banana Pro forbliver den relevante sammenligning, når workloaden specifikt kræver Googles højere-end billedmodel.
Repræsentative anvendelsestilfælde
- Marketinggrafik og plakater — Generer og revider visuelle kampagner, mens overskrifter og anden grafisk tekst gengives.
- Infografikker og diagrammer — Skab informations-tætte visuelle elementer med forbedret layout og faktualitet.
- Produktvisualisering — Kombiner flere referencebilleder, mens produktidentitet og objektfidelitet bevares.
- Figur- og sceneredigering — Iterer scener med konsistens på tværs af flere figurer.
- Lokaliseret visuelt indhold — Generer visuelle aktiver med tekst på flere sprog.
- Hurtig kreativ iteration — Brug konversationsredigering og konfigurerbare tænkningniveauer til at afveje ræsonneringsdybde mod effektivitet.
Begrænsninger
Google dokumenterer flere tilbageværende begrænsninger: lille tekst kan stadig blive sløret; lange afsnit og tekst i sidestørrelse er fortsat vanskelige; figur-konsistens er ikke perfekt; maskerede eller doodle-baserede redigeringer kan delvist misse instruktioner; sjælden vedvarende pose kan forekomme under redigering; og rumlige relationer som venstre/højre kan nogle gange forveksles. Google bemærker også lejlighedsvis langsomhed eller timeout-problemer samt begrænsninger i avanceret verdensviden, 3D-ræsonnering og faktualitet.
Gemini API-dokumentationen opregner også funktionskald, kodeeksekvering, filsøgning, struktureret output, URL-kontekst, Live API, lydgenerering og Google Maps-forankring som ikke-understøttede kapabiliteter for denne model.
Sådan får du adgang til Gemini Nano Banana 2.1 API via CometAPI
Trin 1: Opret en CometAPI-konto og få en API-nøgle
Opret eller log ind på din CometAPI-konto, åbn sektionen for API-nøgler/tokens i CometAPI-konsollen, og generer en API-nøgle.
CometAPI leverer et samlet API-adgangslag, så udviklere kan få adgang til AI-modeller via en CometAPI API-nøgle i stedet for at administrere separate udbyder-legitimationsoplysninger for hver integration.
Hold din API-nøgle sikker, og gem den i en miljøvariabel i stedet for at eksponere den i kode på klientsiden.
export COMETAPI_API_KEY="YOUR_COMETAPI_API_KEY"
Trin 2: Vælg modellen Gemini Nano Banana 2.1
Brug følgende model-ID:
gemini-nano-banana-2.1
Gemini Nano Banana 2.1 er Googles højeffektive model til billedgenerering og konversationsredigering. Den understøtter input i form af tekst, billeder, video og PDF og producerer output i form af billeder og tekst. Modellen understøtter 1K-, 2K- og 4K-billedgenerering, konfigurerbar tænkning, multibillede-fusion og Google-søgeforankring.
Til billedgenererings-workflows følger CometAPI den samme grundlæggende forespørgsel/svar-tilgang som Googles native billedgenererings-API: angiv modellen, giv tekst- eller billedeinput, konfigurer det ønskede billedsvar, og behandl den returnerede billeddata.
Trin 3: Send en billedgenereringsanmodning
Opret en anmodning med gemini-nano-banana-2.1, din prompt og den ønskede billedkonfiguration.
Googles native API anvender en billedgenereringsanmodning med model-ID og billedsvar-konfiguration. For eksempel kan den native API anmode om et rent billede-svar og konfigurere parametre såsom billedformat og -størrelse.
En typisk CometAPI-workflow kan struktureres således:
Bemærk: Den præcise CometAPI-billede-endpoint og de billedspecifikke svarfelter bør kontrolleres mod den aktuelle CometAPI API-dokumentation før produktion. Googles native API dokumenterer i øjeblikket dedikerede billedgenereringsanmodningsformater for gemini-nano-banana-2.1.
Trin 4: Behandl det genererede billede
Når anmodningen er fuldført, behandles billedet, som API’en returnerer, i henhold til det svarformat, CometAPI eksponerer.
For eksempel kan Googles native billedgenererings-API returnere billeddata som Base64-kodet inline-data, der derefter kan dekodes og gemmes som en billedfil.
import base64
image_bytes = base64.b64decode(image_base64)
with open("nano-banana-2-1-output.png", "wb") as f:
f.write(image_bytes)
Du kan også bruge Nano Banana 2.1 til mere avancerede workflows, herunder multibillede-redigering og komposition med referencebilleder. Modellen understøtter op til 14 referencebilleder i et workflow, inklusive op til 4 figurer for konsistens og op til 10 objekter med høj fidelitet.
Hvorfor vælge Gemini Nano Banana 2.1 API på CometAPI?
1. Få adgang til Googles nyeste højeffektive billedmodel
Gemini Nano Banana 2.1 er Googles nyeste højeffektive model til billedgenerering og konversationsredigering. Den forbedrer visuel kvalitet, prompt-efterlevelse, tekstgengivelse og konsistens på tværs af flere runder, samtidig med at den bevarer effektiviteten fra Gemini Flash-familien.
2. Én API til en produktionsklar billedarbejdsgang
Ved at bruge Nano Banana 2.1 via CometAPI får udviklere et samlet API-adgangslag, som gør det lettere at integrere Googles billedgenerering i en eksisterende applikation uden at bygge en separat udbyderintegration fra bunden.
Dette er især nyttigt for applikationer, der allerede bruger flere AI-modeller via CometAPI og ønsker at tilføje Googles billedgenerering til den samme infrastruktur.
3. Kraftig billedgenerering og -redigering
Nano Banana 2.1 understøtter både billedgenerering og konversationsredigering. Den kan arbejde med tekst-, billede-, video- og PDF-input og understøtter 1K-, 2K- og 4K-billedoutput.
Modellen understøtter også multibillede-fusion, hvilket gør den velegnet til produktvisualisering, figur-konsistens, kreative kompositioner og iterativ billedredigering.
4. Stærk tekst- og infografikgenerering
Nano Banana 2.1 forbedrer specifikt tekstgengivelse og nøjagtigheden af infografiklayout. Det gør den til et stærkt valg til at generere plakater, marketinggrafik, diagrammer og andet visuelt indhold, hvor læsbar tekst og strukturerede layouts er vigtige.
5. Fleksibel til forskellige applikationsscenarier
Med billedgenerering, konversationsredigering, multireference-workflows, konfigurerbar tænkning og søgeforankring er Gemini Nano Banana 2.1 velegnet til applikationer såsom:
- Marketing- og reklamekreativer
- Produktfotografi og e-handelsvisuals
- Plakater og sociale medie-grafikker
- Infografikker og diagrammer
- Figur- og sceneredigering
- Multireference-billedkomposition
- Hurtig kreativ prototyping
For udviklere, der ønsker Googles nyeste effektive billedgenereringskapabiliteter, samtidig med at adgangen til AI-modeller holdes inden for en samlet CometAPI-arbejdsgang, er Gemini Nano Banana 2.1 på CometAPI et praktisk valg til produktionsklare billedgenereringsapplikationer.
Nano Banana 2.1 vs. at bruge Googles API direkte
Dette er sandsynligvis den vigtigere beslutning.
| Google Gemini API | CometAPI | |
|---|---|---|
| Nano Banana 2.1 | ✅ | ✅ |
| Native Google-model | ✅ | ✅ |
| Direkte relation til Google | ✅ | ❌ |
| Én API til mange udbydere | ❌ | ✅ |
| Samlet fakturering | ❌ | ✅ |
| Nem modelskift | Begrænset | ✅ |
| Google-native anmodningsformat | ✅ | CometAPI-wrapper |
| God til multimodel-applikationer | Okay | Fremragende |
| God til applikationer kun med Google | Fremragende | Okay |