Gemini 3.6 Flash i 3.5 Flash-Lite: Google wypuściło nowe modele AI bez zapowiedzi
21 lipca 2026 — Google zrobiło to po cichu. Żadnej konferencji, żadnego keynote. Po prostu nowe modele w API i post na blogu. Trzy naraz: Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber. I przy okazji zapowiedź Gemini 4.
Jeśli budujesz agenty AI albo płacisz za tokeny — to cię dotyczy.
Co nowego w każdym modelu
Gemini 3.6 Flash — mądrzejszy asystent deweloperski
To flagowy model tej aktualizacji. Ukierunkowany na coding i agentic workflows.
Kluczowe zmiany:
- -17% output tokenów — model produkuje mniej tekstu żeby powiedzieć to samo. Dla agentów płacących per token to bezpośrednia oszczędność
- Lepszy coding — Google opisuje to jako „higher precision with fewer unwanted code edits and reduced execution loops”. Mniej iteracji żeby dojść do działającego kodu
- Knowledge cutoff: marzec 2026 — poprzednik kończył się na styczniu 2025. Skok o 14 miesięcy to ogromna różnica jeśli pytasz o nowe frameworki, nowe API, obecne ceny usług
Ceny (na 1M tokenów):
| Input | Output | |
|---|---|---|
| Gemini 3.6 Flash | $1,50 | $7,50 |
| Poprzednik (Gemini 2.0 Flash) | $1,50 | $9,00 |
Output tańszy o 16,7%. Przy dużym wolumenie to istotna różnica — szczególnie w pipeline’ach gdzie model dużo generuje.
Gemini 3.5 Flash-Lite — tanio i szybko
Model do zastosowań wymagających wysokiej przepustowości przy niskim latency.
Ceny (na 1M tokenów):
| Input | Output | |
|---|---|---|
| Gemini 3.5 Flash-Lite | $0,30 | $2,50 |
To jeden z najtańszych modeli od dużego dostawcy w tej chwili. Google kieruje go do:
- agentic search — duże ilości małych zapytań, gdzie każda milisekunda kosztuje
- document processing — masowe przetwarzanie dokumentów
- zastosowań gdzie liczy się czas odpowiedzi, nie jakość rozumowania
Nie jest to model do skomplikowanych zadań. Ale do wstępnej klasyfikacji, ekstrakcji danych z dokumentów czy wyszukiwania — całkowicie wystarczy i kosztuje ułamek tego co pełny model.
Gemini 3.5 Flash Cyber — cyberbezpieczeństwo (limited access)
Trzeci model jest dość wyjątkowy — i nie dlatego że jest najlepszy.
Gemini 3.5 Flash Cyber został zbudowany do wykrywania i łatania luk w oprogramowaniu. Działa w parze z Google CodeMender — agentem automatycznej naprawy kodu.
Catch: dostęp tylko dla rządów i zaufanych partnerów. Google powołuje się na dual-use safety risks — cybersecurity AI może służyć do ataku tak samo jak do obrony.
Dla większości firm i deweloperów — ten model nie jest dostępny. Ale sygnalizuje kierunek: specjalistyczne modele do wąskich zastosowań security.
Który model wybrać?
Krótka ściąga:
| Zastosowanie | Model | Cena output/1M |
|---|---|---|
| Coding assistant, agent deweloperski | Gemini 3.6 Flash | $7,50 |
| Masowe przetwarzanie dokumentów | Gemini 3.5 Flash-Lite | $2,50 |
| Agentic search (wiele małych zapytań) | Gemini 3.5 Flash-Lite | $2,50 |
| Cybersecurity automatyzacja | Gemini 3.5 Flash Cyber | limited |
Jak to wypada na tle konkurencji?
Porównanie z Claude Haiku 4.5 (Anthropic) — popularny wybór dla podobnych zastosowań:
| Model | Input/1M | Output/1M | Okno kontekstu |
|---|---|---|---|
| Gemini 3.5 Flash-Lite | $0,30 | $2,50 | 1M tokenów |
| Claude Haiku 4.5 | $0,80 | $4,00 | 200K tokenów |
| Gemini 3.6 Flash | $1,50 | $7,50 | 1M tokenów |
Gemini 3.5 Flash-Lite wygrywa ceną przy prostych zadaniach. Claude Haiku 4.5 ma dłuższy track record w zastosowaniach produkcyjnych i mniejsze okno kontekstu — co przy prostym przetwarzaniu dokumentów może być zaletą (niższa złożoność zapytań).
Gemini 3.6 Flash jest droższy od Haiku 4.5, ale oferuje okno kontekstu 1M tokenów i świeższy knowledge cutoff (marzec 2026 vs styczeń 2025). To przewaga przy przetwarzaniu długich dokumentów lub agentach z rozbudowaną historią rozmowy.
Wybór zależy od konkretnego przypadku użycia i tego, którą infrastrukturę już masz.
I co z Gemini 4?
W tym samym poście na blogu Google zapowiedziało Gemini 4. Bez szczegółów, bez dat. Samo stwierdzenie że model jest w drodze.
Przy tym tempie aktualizacji — 14 miesięcy do przodu z cutoffem, nowe modele bez zapowiedzi — warto zakładać że rynek modeli będzie się zmieniał szybciej niż większość roadmap firmowych.
Na razie Gemini 3.6 Flash i 3.5 Flash-Lite są dostępne przez Google AI Studio i Vertex AI. Warto je przetestować szczególnie jeśli obecne modele w pipeline’ach kosztują więcej niż powinny.
TL;DR
- Gemini 3.6 Flash: tańszy output (−17% tokenów, $7,50/1M), świeższy knowledge cutoff (marzec 2026), dobry do codingu i agentów
- Gemini 3.5 Flash-Lite: $0,30/$2,50 — najtańszy model do masowych zadań o niskim latency
- Gemini 3.5 Flash Cyber: cybersecurity, dostęp tylko dla rządów i wybranych partnerów
- Gemini 4: zapowiedziany, bez daty
Dla firm i deweloperów budujących agenty AI — aktualizacja cennika i knowledge cutoff w 3.6 Flash to powód żeby wrócić do benchmarków i sprawdzić czy obecny stack nadal ma sens.