Specyfikacje techniczne Gemini 3.5 Flash
| Pozycja | Gemini 3.5 Flash |
|---|---|
| Dostawca | |
| Rodzina modeli | Gemini 3.5 |
| Oficjalny identyfikator modelu | gemini-3.5-flash |
| Typy wejściowe | Tekst, obraz, wideo, audio, PDF |
| Typy wyjściowe | Tekst |
| Okno kontekstu | 1 milion tokenów |
| Maksymalna liczba tokenów wyjściowych | ~65K tokenów wyjściowych |
| Najważniejsze atuty | Agentowe przepływy pracy, programowanie, rozumowanie multimodalne |
| Obsługa narzędzi | Wywoływanie funkcji, wykonywanie kodu, powiązanie z wyszukiwaniem, ustrukturyzowane wyniki, kontekst URL, wyszukiwanie plików |
| Wsparcie rozumowania | Regulowane poziomy myślenia/rozumowania |
| Framework bezpieczeństwa | Google Frontier Safety Framework |
Czym jest Gemini 3.5 Flash?
Google Gemini 3.5 Flash to flagowy, szybki model do multimodalnego rozumowania od Google, zoptymalizowany pod kątem agentowego wykonywania zadań, programowania i długotrwałych przepływów pracy. Rozszerza serię Gemini Flash o znacznie silniejsze możliwości rozumowania i inżynierii oprogramowania, jednocześnie utrzymując cechę niskich opóźnień wnioskowania.
W przeciwieństwie do wcześniejszych modeli Flash, które koncentrowały się głównie na lekkim wnioskowaniu, Gemini 3.5 Flash został zaprojektowany z myślą o trwałych agentach AI, wieloetapowych systemach programistycznych i potokach automatyzacji w przedsiębiorstwach. Google pozycjonuje go jako najsilniejszy jak dotąd agentowy model klasy Flash.
Najważniejsze funkcje Gemini 3.5 Flash
- Obsługa długiego kontekstu 1M tokenów: Radzi sobie z bardzo dużymi repozytoriami, obszerną dokumentacją, plikami PDF, transkrypcjami i wielosesyjnymi przepływami pracy w jednym kontekście promptu.
- Silne wykonywanie agentowe: Zoptymalizowany pod kątem wieloetapowych autonomicznych przepływów pracy, orkiestracji narzędzi, zadań w terminalu i długo działających agentów AI.
- Zaawansowana wydajność w programowaniu: Przewyższa Gemini 3.1 Pro w kilku benchmarkach programistycznych i agentowych, w tym Terminal-Bench i MCP Atlas.
- Natywne rozumowanie multimodalne: Akceptuje tekst, obrazy, audio, wideo i PDF-y do zadań wymagających zintegrowanego rozumowania.
- Narzędzia klasy produkcyjnej: Obsługuje ustrukturyzowane wyniki, wywoływanie funkcji, wykonywanie kodu, powiązanie z Google Search i Maps oraz wyszukiwanie plików.
- Konfigurowalne tryby rozumowania/myślenia: Programiści mogą dostrajać latencję względem głębokości rozumowania, używając sterowania poziomem myślenia.
Wydajność w benchmarkach Gemini 3.5 Flash
Zgłaszane przez Google wyniki benchmarków plasują Gemini 3.5 Flash wśród najsilniejszych agentowych modeli klasy Flash dostępnych obecnie:
| Benchmark | Gemini 3.5 Flash |
|---|---|
| Terminal-Bench 2.1 | 76.2% |
| GDPval-AA | 1656 Elo |
| MCP Atlas | 83.6% |
| CharXiv Reasoning | 84.2% |
Wyniki te wskazują na duże zyski w zakresie autonomicznego wykonywania, rozumowania multimodalnego i niezawodności inżynierii oprogramowania w porównaniu z wcześniejszymi wariantami Gemini Flash.
Gemini 3.5 Flash vs inne modele
| Zdolność | Gemini 3.5 Flash | Gemini 3.1 Pro | Claude Sonnet 4 |
|---|---|---|---|
| Okno kontekstu | 1M tokenów | Duży kontekst | Duży kontekst |
| Agentowe przepływy pracy | Doskonałe | Silne | Silne |
| Wydajność w kodowaniu | Bardzo silna | Silna | Doskonała |
| Szybkość wnioskowania | Zoptymalizowana latencja Flash | Wolniejsze | Umiarkowana |
| Wejścia multimodalne | Natywnie multimodalny | Natywnie multimodalny | Obraz + tekst |
| Ekosystem narzędzi | Rozbudowany zestaw narzędzi Google | Rozbudowany | Silne narzędzia API |
Kluczowe różnice
- vs Gemini 3.1 Pro: Gemini 3.5 Flash zapewnia lepsze programowanie i autonomiczne wykonywanie zadań, przy jednocześnie znacznie szybszym wnioskowaniu.
- vs Claude Sonnet 4: Claude często pozostaje silniejszy w niuansowanym długim rozumowaniu i jakości pisania, podczas gdy Gemini 3.5 Flash kładzie nacisk na szybkość, wykonywanie agentowe i integrację z ekosystemem Google.
- vs modele rozumujące z serii GPT: Gemini 3.5 Flash jest szczególnie konkurencyjny w agentowych przepływach multimodalnych i orkiestracji dużych kontekstów, zwłaszcza w zastosowaniach automatyzacji klasy enterprise.
Znane ograniczenia Gemini 3.5 Flash
- Obecnie nie obsługuje natywnego generowania obrazów ani dźwięku na wyjściu.
- Interfejsy API do rozmów na żywo nie są obsługiwane w tej klasie modeli.
- Benchmarki społecznościowe pokazują zróżnicowaną wydajność w niektórych wyspecjalizowanych zadaniach ewaluacyjnych, zwłaszcza w niszowych przepływach silnie wizualnych
Jak uzyskać dostęp do Gemini 3.5 Flash API
Krok 1: Uzyskaj dostęp do API
Zaloguj się do cometAPI. Jeśli nie jesteś jeszcze naszym użytkownikiem, najpierw się zarejestruj. Zaloguj się do swojej CometAPI console. Uzyskaj klucz API uprawniający do dostępu do interfejsu. Kliknij „Add Token” w sekcji tokenu API w centrum osobistym, pobierz klucz tokenu: sk-xxxxx i wyślij.

Krok 2: Wyślij żądania do Gemini 3.5 Flash API
Wybierz endpoint „` gemini-3.5-flash”, aby wysłać żądanie do API i ustaw treść żądania. Metodę żądania i treść żądania uzyskasz z dokumentacji API na naszej stronie. Nasza strona udostępnia również test w Apifox dla Twojej wygody. Zamień <YOUR_API_KEY> na swój rzeczywisty klucz CometAPI z konta. podstawowy adres URL to Gemini Generating Content
Wstaw swoje pytanie lub żądanie do pola content — na to model odpowie. Przetwórz odpowiedź API, aby uzyskać wygenerowaną odpowiedź.
Krok 3: Przetwarzanie odpowiedzi
API zwraca ustrukturyzowane odpowiedzi-kandydaty, w tym wygenerowany tekst, cytowania, metadane bezpieczeństwa oraz opcjonalne wyniki narzędzi.