LLM 22 lipca 2026

Gemini 3.6 Flash i 3.5 Flash-Lite: nowe modele Google — co musisz wiedzieć

Phoebe
Phoebe 22 lipca 2026
Gemini 3.6 Flash i 3.5 Flash-Lite: nowe modele Google — co musisz wiedzieć

Gemini 3.6 Flash i 3.5 Flash-Lite: Google wypuściło nowe modele AI bez zapowiedzi

21 lipca 2026 — Google zrobiło to po cichu. Żadnej konferencji, żadnego keynote. Po prostu nowe modele w API i post na blogu. Trzy naraz: Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber. I przy okazji zapowiedź Gemini 4.

Jeśli budujesz agenty AI albo płacisz za tokeny — to cię dotyczy.

Co nowego w każdym modelu

Gemini 3.6 Flash — mądrzejszy asystent deweloperski

To flagowy model tej aktualizacji. Ukierunkowany na coding i agentic workflows.

Kluczowe zmiany:

  • -17% output tokenów — model produkuje mniej tekstu żeby powiedzieć to samo. Dla agentów płacących per token to bezpośrednia oszczędność
  • Lepszy coding — Google opisuje to jako „higher precision with fewer unwanted code edits and reduced execution loops”. Mniej iteracji żeby dojść do działającego kodu
  • Knowledge cutoff: marzec 2026 — poprzednik kończył się na styczniu 2025. Skok o 14 miesięcy to ogromna różnica jeśli pytasz o nowe frameworki, nowe API, obecne ceny usług

Ceny (na 1M tokenów):

Input Output
Gemini 3.6 Flash $1,50 $7,50
Poprzednik (Gemini 2.0 Flash) $1,50 $9,00

Output tańszy o 16,7%. Przy dużym wolumenie to istotna różnica — szczególnie w pipeline’ach gdzie model dużo generuje.


Gemini 3.5 Flash-Lite — tanio i szybko

Model do zastosowań wymagających wysokiej przepustowości przy niskim latency.

Ceny (na 1M tokenów):

Input Output
Gemini 3.5 Flash-Lite $0,30 $2,50

To jeden z najtańszych modeli od dużego dostawcy w tej chwili. Google kieruje go do:

  • agentic search — duże ilości małych zapytań, gdzie każda milisekunda kosztuje
  • document processing — masowe przetwarzanie dokumentów
  • zastosowań gdzie liczy się czas odpowiedzi, nie jakość rozumowania

Nie jest to model do skomplikowanych zadań. Ale do wstępnej klasyfikacji, ekstrakcji danych z dokumentów czy wyszukiwania — całkowicie wystarczy i kosztuje ułamek tego co pełny model.


Gemini 3.5 Flash Cyber — cyberbezpieczeństwo (limited access)

Trzeci model jest dość wyjątkowy — i nie dlatego że jest najlepszy.

Gemini 3.5 Flash Cyber został zbudowany do wykrywania i łatania luk w oprogramowaniu. Działa w parze z Google CodeMender — agentem automatycznej naprawy kodu.

Catch: dostęp tylko dla rządów i zaufanych partnerów. Google powołuje się na dual-use safety risks — cybersecurity AI może służyć do ataku tak samo jak do obrony.

Dla większości firm i deweloperów — ten model nie jest dostępny. Ale sygnalizuje kierunek: specjalistyczne modele do wąskich zastosowań security.


Który model wybrać?

Krótka ściąga:

Zastosowanie Model Cena output/1M
Coding assistant, agent deweloperski Gemini 3.6 Flash $7,50
Masowe przetwarzanie dokumentów Gemini 3.5 Flash-Lite $2,50
Agentic search (wiele małych zapytań) Gemini 3.5 Flash-Lite $2,50
Cybersecurity automatyzacja Gemini 3.5 Flash Cyber limited

Jak to wypada na tle konkurencji?

Porównanie z Claude Haiku 4.5 (Anthropic) — popularny wybór dla podobnych zastosowań:

Model Input/1M Output/1M Okno kontekstu
Gemini 3.5 Flash-Lite $0,30 $2,50 1M tokenów
Claude Haiku 4.5 $0,80 $4,00 200K tokenów
Gemini 3.6 Flash $1,50 $7,50 1M tokenów

Gemini 3.5 Flash-Lite wygrywa ceną przy prostych zadaniach. Claude Haiku 4.5 ma dłuższy track record w zastosowaniach produkcyjnych i mniejsze okno kontekstu — co przy prostym przetwarzaniu dokumentów może być zaletą (niższa złożoność zapytań).

Gemini 3.6 Flash jest droższy od Haiku 4.5, ale oferuje okno kontekstu 1M tokenów i świeższy knowledge cutoff (marzec 2026 vs styczeń 2025). To przewaga przy przetwarzaniu długich dokumentów lub agentach z rozbudowaną historią rozmowy.

Wybór zależy od konkretnego przypadku użycia i tego, którą infrastrukturę już masz.


I co z Gemini 4?

W tym samym poście na blogu Google zapowiedziało Gemini 4. Bez szczegółów, bez dat. Samo stwierdzenie że model jest w drodze.

Przy tym tempie aktualizacji — 14 miesięcy do przodu z cutoffem, nowe modele bez zapowiedzi — warto zakładać że rynek modeli będzie się zmieniał szybciej niż większość roadmap firmowych.

Na razie Gemini 3.6 Flash i 3.5 Flash-Lite są dostępne przez Google AI Studio i Vertex AI. Warto je przetestować szczególnie jeśli obecne modele w pipeline’ach kosztują więcej niż powinny.


TL;DR

  • Gemini 3.6 Flash: tańszy output (−17% tokenów, $7,50/1M), świeższy knowledge cutoff (marzec 2026), dobry do codingu i agentów
  • Gemini 3.5 Flash-Lite: $0,30/$2,50 — najtańszy model do masowych zadań o niskim latency
  • Gemini 3.5 Flash Cyber: cybersecurity, dostęp tylko dla rządów i wybranych partnerów
  • Gemini 4: zapowiedziany, bez daty

Dla firm i deweloperów budujących agenty AI — aktualizacja cennika i knowledge cutoff w 3.6 Flash to powód żeby wrócić do benchmarków i sprawdzić czy obecny stack nadal ma sens.


Phoebe

O autorze: Phoebe

Cześć od ponad 3 lat zasuwam i tworzę content na potrzeby nasze i naszych klientów. Oprócz tego 24/7 wertuję internet we wszystkich językach po to by przygotować czytelną treść dla Ciebie. Staram się być przy tym bardzo skrupulatna, ale ze znaną mi sporą dozą humoru i czasem oderwania od rzeczywistości. W tzw. międzyczasie korzystając z ElevenLabs śpiewam wszystkim 'Smelly Cat 🐈'. Także Enjoy your silent 😁