Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →
G

Gemini 3.5 Flash Lite

Invoer:$0.24/M
Uitvoer:$2.016/M
Uitgebracht:Jul 21, 2026

Gemini 3.5 Flash-Lite is een kostenefficiënt multimodaal model met lage latentie, geoptimaliseerd voor uitvoering met hoge doorvoer en lage kosten bij subagent-taken en het parsen van documenten. Het model ondersteunt invoer van tekst, afbeeldingen, video, audio en PDF, en is ontworpen voor agentgebaseerde workflows met hoog volume, eenvoudige gegevensextractie en toepassingen waarbij latentie en API-kosten de primaire beperkingen zijn

Nieuw
Commercieel gebruik

Playground voor Gemini 3.5 Flash Lite

Verken Gemini 3.5 Flash Lite's Playground — een interactieve omgeving om modellen te testen en queries in realtime uit te voeren. Probeer prompts, pas parameters aan en itereer direct om ontwikkeling te versnellen en use cases te valideren.

Technische specificaties van Gemini 3.5 Flash-Lite

ItemGemini 3.5 Flash-Lite
AanbiederGoogle DeepMind
Model-IDgemini-3.5-flash-lite
ModelfamilieGemini 3.5
BeschikbaarheidAlgemene beschikbaarheid (GA)
InvoertypenTekst, Afbeelding, Video, Audio, PDF
UitvoertypenTekst
Contextvenster1,048,576 tokens
Maximale uitvoer65,536 tokens
RedenerenOndersteund (standaard: minimal; ook medium en high)
Function callingJa
Code executionJa
File SearchJa
URL ContextJa
Search GroundingJa
Structured OutputJa
Computer UseNiet ondersteund
CachingOndersteund
Primaire focusHoge doorvoer, lage latentie, inferentie met lage kosten

Wat is Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite is het snelste en meest kosteneffectieve model van Google binnen de Gemini 3.5-familie. Het is geoptimaliseerd voor workloads waarbij latentie, doorvoer en API-kosten belangrijker zijn dan maximale redeneerprestatie. Typische toepassingen zijn documentparsing, gestructureerde data-extractie, routing, lichtgewicht codering en autonome subagenten die op schaal opereren. Google positioneert het als het aanbevolen upgradepad vanaf Gemini 3.1 Flash-Lite en Gemini 2.5 Flash voor productie-implementaties.

Belangrijkste functies van Gemini 3.5 Flash-Lite

  • Geoptimaliseerd voor inferentie met groot volume en lage kosten.
  • Ondersteunt een contextvenster van 1 miljoen tokens voor lange documenten en repositories.
  • Native multimodale invoer, waaronder tekst, afbeeldingen, video, audio en PDF.
  • Ondersteunt Function Calling, Code Execution, File Search, URL Context, Search Grounding en Structured Outputs.
  • Configureerbare denkniveaus (minimal, medium, high) om snelheid en redeneerkwaliteit in balans te brengen.
  • Verbetert codering, redeneren en agent-workflows aanzienlijk ten opzichte van Gemini 3.1 Flash-Lite, met behoud van zeer lage latentie.

Benchmarkprestaties van Gemini 3.5 Flash-Lite

Volgens Google presteert Gemini 3.5 Flash-Lite aanzienlijk beter dan eerdere Flash-Lite-generaties op het gebied van codering, documentbegrip en agent-workflows, terwijl het het goedkoopste model in de Gemini 3.5-reeks blijft. Gemini 3.5 Flash-Lite behaalde 54% in de Terminal-Bench 2.1-test, een aanzienlijke verbetering ten opzichte van de 31% van zijn voorganger.

De sterke punten liggen bij classificatie, extractie, chatantwoorden en eenvoudige, door retrieval verbeterde antwoorden. Precies op deze gebieden kunnen snelle, goedkope modellen excelleren.

Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash

AspectGemini 3.5 Flash-LiteGemini 3.6 FlashGemini 3.5 Flash
PositioneringSnelst en goedkoopst voor dagelijkse taken met hoog volume (bijv. documentverwerking, zoeken)Huidige vlaggenschip-Flash: beste balans tussen intelligentie, efficiëntie en agent-prestatiesSterk agent-/codeermodel (nu grotendeels vervangen door 3.6)
Beste voorWorkflows met hoge doorvoer en lage kostenCodering, multimodaal, complexe agents, kenniswerkAlgemene agent- en coderingstaken
Intelligentie / prestatiesGoed (overtreft oudere Lite-modellen; competitief op veel agenttaken)Hoogste van de drie (merkbare winst in codering en agenttaken)Sterk (dicht bij de voorhoede binnen de Flash-serie)
Belangrijkste benchmarks- Terminal-Bench: ~54%- Sterk in document- en hoogvolume-taken- DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%)- Terminal-Bench: 76.2%- Lager dan 3.6 op de meeste codering-/agenttaken
SnelheidSnelst (~350 outputtokens/sec)Zeer snel (~280 t/s)Snel
EfficiëntieUitstekend voor volumeBeste (gemiddeld 17% minder uitvoertokens; tot 65% bij codering)Goed
MultimodaalTekst + Afbeelding + Video + AudioTekst + Afbeelding + Video + Audio (sterker redeneren)Tekst + Afbeelding + Video + Audio
Contextvenster~1M tokens~1M tokens~1M tokens
Maximale uitvoertokens~64k~64k~64k
Prijzen (per 1M tokens)Goedkoopst: ~$0.30 invoer / $2.50 uitvoer$1.50 invoer / $7.50 uitvoer$1.50 invoer / $9.00 uitvoer
Effectieve kostenLaagst per taak voor eenvoudig werkLager dan 3.5 dankzij efficiëntiewinstHoger dan 3.6

Samenvattende aanbevelingen

  • Kies 3.5 Flash-Lite — wanneer u maximale snelheid en minimale kosten nodig hebt voor taken met hoog volume of eenvoudige taken.
  • Kies 3.6 Flash — voor de meeste gebruikers en ontwikkelaars (momenteel de beste algehele keuze).
  • Kies 3.5 Flash — alleen als u bestaande workflows eraan hebt gekoppeld (plan om te upgraden naar 3.6).

Beperkingen van Gemini 3.5 Flash-Lite

  • Geoptimaliseerd voor efficiëntie in plaats van state-of-the-art redeneren.
  • Computer Use wordt niet ondersteund.
  • Native beeld- en audiogeneratie is niet beschikbaar.
  • Fine-tuning wordt momenteel niet ondersteund.
  • Complexe meerstaps redeneringstaken zijn doorgaans beter geschikt voor Gemini 3.5 Flash of Gemini 3.6 Flash.

FAQ

Prijzen voor Gemini 3.5 Flash Lite

Ontdek concurrerende prijzen voor Gemini 3.5 Flash Lite, ontworpen om te passen bij verschillende budgetten en gebruiksbehoeften. Onze flexibele abonnementen zorgen ervoor dat u alleen betaalt voor wat u gebruikt, waardoor het gemakkelijk is om op te schalen naarmate uw vereisten groeien. Ontdek hoe Gemini 3.5 Flash Lite uw projecten kan verbeteren terwijl de kosten beheersbaar blijven.

Comet Prijs (USD / M Tokens)Officiële Prijs (USD / M Tokens)Korting
Invoer:$0.24/M
Uitvoer:$2.016/M
Invoer:$0.3/M
Uitvoer:$2.52/M
-20%

Voorbeeldcode en API voor Gemini 3.5 Flash Lite

Krijg toegang tot uitgebreide voorbeeldcode en API-bronnen voor Gemini 3.5 Flash Lite om uw integratieproces te stroomlijnen. Onze gedetailleerde documentatie biedt stapsgewijze begeleiding en helpt u het volledige potentieel van Gemini 3.5 Flash Lite in uw projecten te benutten.

import os

from google import genai
from google.genai import types

client = genai.Client(
    api_key=os.environ["COMETAPI_KEY"],
    http_options={
        "api_version": "v1beta",
        "base_url": "https://api.cometapi.com",
        "retry_options": {"attempts": 1},
    },
)

response = client.models.generate_content(
    model="gemini-3.5-flash-lite",
    contents="Write a three.js script that renders an interactive 3D robot.",
    config=types.GenerateContentConfig(max_output_tokens=8192),
)

print(f"Response ID: {response.response_id}")
print(f"Model Version: {response.model_version}")
print(f"Finish Reason: {response.candidates[0].finish_reason}")
print(response.text)

Python Code Example

import os

from google import genai
from google.genai import types


client = genai.Client(
    api_key=os.environ["COMETAPI_KEY"],
    http_options={
        "api_version": "v1beta",
        "base_url": "https://api.cometapi.com",
        "retry_options": {"attempts": 1},
    },
)

response = client.models.generate_content(
    model="gemini-3.5-flash-lite",
    contents="Write a three.js script that renders an interactive 3D robot.",
    config=types.GenerateContentConfig(max_output_tokens=8192),
)

print(f"Response ID: {response.response_id}")
print(f"Model Version: {response.model_version}")
print(f"Finish Reason: {response.candidates[0].finish_reason}")
print(response.text)

JavaScript Code Example

import { GoogleGenAI } from "@google/genai";


const ai = new GoogleGenAI({
  apiKey: process.env.COMETAPI_KEY,
  httpOptions: {
    apiVersion: "v1beta",
    baseUrl: "https://api.cometapi.com",
    retryOptions: { attempts: 1 },
  },
});

const response = await ai.models.generateContent({
  model: "gemini-3.5-flash-lite",
  contents: "Write a three.js script that renders an interactive 3D robot.",
  config: {
    maxOutputTokens: 8192,
  },
});

console.log(`Response ID: ${response.responseId}`);
console.log(`Model Version: ${response.modelVersion}`);
console.log(`Finish Reason: ${response.candidates[0].finishReason}`);
console.log(response.text);

Curl Code Example

#!/bin/bash

curl "https://api.cometapi.com/v1beta/models/gemini-3.5-flash-lite:generateContent" \
  -H "x-goog-api-key: $COMETAPI_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {
            "text": "Write a three.js script that renders an interactive 3D robot."
          }
        ]
      }
    ],
    "generationConfig": {
      "maxOutputTokens": 8192
    }
  }'

Versies van Gemini 3.5 Flash Lite

De reden waarom Gemini 3.5 Flash Lite meerdere snapshots heeft, kan mogelijke factoren omvatten zoals variaties in de uitvoer na updates die oudere snapshots vereisen voor consistentie, het bieden van een overgangsperiode voor ontwikkelaars om zich aan te passen en te migreren, en verschillende snapshots die overeenkomen met wereldwijde of regionale eindpunten om de gebruikerservaring te optimaliseren. Voor gedetailleerde verschillen tussen versies, raadpleeg de officiële documentatie.

Versie
gemini-3.5-flash-lite
gemini-3.5-flash-lite-thinking