Gemini 3.6 Flash zużywa o 17% mniej tokenów - i kosztuje mniej
- Google DeepMind 21 lipca 2026 roku ogłosiło trzy nowe modele: Gemini 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber zintegrowany z agentem CodeMender.
- Gemini 3.6 Flash kosztuje 1,50 USD za milion tokenów wejściowych i 7,50 USD za wyjściowe, jednocześnie redukując zużycie tokenów o 17% względem poprzednika.
- Google równolegle potwierdziło start treningu Gemini 4 jako najbardziej ambitnego pre-trainingu w historii firmy.
Google DeepMind 21 lipca 2026 roku wrzuciło na rynek trzy modele z serii Flash - Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber - wszystkie zaprojektowane z myślą o agentach AI działających w środowiskach produkcyjnych.
3.6 Flash: tańszy, szybszy, mniej gadatliwy
Gemini 3.6 Flash generuje o 17% mniej tokenów wyjściowych niż 3.5 Flash - według pomiarów Artificial Analysis Index. W benchmarku DeepSWE od Datacurve oszczędność sięga nawet 65%. Model wyceniono na 1,50 USD za milion tokenów wejściowych i 7,50 USD za wyjściowe, co stawia go poniżej cennika poprzednika.
Przyrosty jakościowe są mierzalne. W DeepSWE 3.6 Flash wykręca 49% wobec 37% dla 3.5 Flash. W MLE Bench skacze z 49,7% do 63,9%. OSWorld-Verified, testujący kontrolę komputera, pokazuje 83,0% vs 78,4%. Firmy takie jak Hebbia i Harvey już go używają do parsowania dokumentów i analizy danych finansowych.
Model ma też nową funkcję computer use - teraz dostępną jako wbudowane narzędzie po stronie klienta bezpośrednio przez Gemini API i Gemini Enterprise.
Czy 350 tokenów na sekundę wystarczy do wszystkiego?
Gemini 3.5 Flash-Lite to osobna propozycja - najszybszy model w całej klasie 3.5. Artificial Analysis Index mierzy go na 350 tokenów wyjściowych na sekundę. Google pozycjonuje go jako najtańszą opcję do masowych zadań agentic workflow, gdzie liczy się przepustowość, a nie głębokość rozumowania.
Poprzednie generacje Flash-Lite wypadały słabo przy zadaniach agentowych. Tym razem Google twierdzi, że nowy model je znacząco przerasta - bez podawania konkretnych liczb benchmarkowych, co trochę kłuje w oczy przy tak liczbowo bogatej prezentacji 3.6 Flash.
Gemini 3.5 Flash Cyber wchodzi w cyberbezpieczeństwo
Najbardziej niszowy z trójki to 3.5 Flash Cyber - lekki model wyspecjalizowany pod szukanie i łatanie podatności w kodzie. Działa razem z agentem CodeMender, który orkiestruje cały proces: od wykrycia luki po zaproponowanie patcha.
Google prezentuje to jako gotowe rozwiązanie dla security teamów, nie jako surowy model do samodzielnego wdrożenia. Połączenie specjalizowanego modelu z gotową infrastrukturą agentową to wyraźne odejście od podejścia “damy ci model, resztę ogarnij sam”.
Co Google szykuje dalej?
Gemini 3.5 Pro jest aktualnie testowany z wybranymi partnerami - bez konkretnej daty premiery. Google obiecuje szeroką dostępność “jak tylko będzie gotowy”, co brzmi jak klasyczne underpromise.
Ciekawsze jest potwierdzenie startu pre-trainingu Gemini 4. Google opisuje go jako “najbardziej ambitny pre-training run w historii firmy”. Żadnych szczegółów architektury, parametrów ani harmonogramu - tylko tyle, że trening już się zaczął i zespół jest podekscytowany postępami.
Nowe modele są dostępne przez Gemini API od 21 lipca 2026 roku. 3.6 Flash zastępuje 3.5 Flash jako główny model roboczy w ofercie Google dla deweloperów budujących agenty produkcyjne - ile firm faktycznie przejdzie na niego z dnia na dzień, zależy od tego, jak mocno ich pipeline’y opierają się na obecnej charakterystyce tokenizacji 3.5 Flash.