Google DeepMind odświeża rodzinę Flash: między wydajnością obliczeniową a wyspecjalizowanym bezpieczeństwem
Google wybrał 21 lipca 2026 roku, by odświeżyć ofertę linii Flash, prezentując na oficjalnym blogu trzy nowe iteracje, które przesuwają uwagę z czystej mocy obliczeniowej na wydajność operacyjną. Gemini 3.6 Flash jest przedstawiany jako nowy model odniesienia dla ogólnych obciążeń i do zarządzania agentami na dużą skalę. Według danych podanych przez firmę model zapewnia zmniejszenie zużycia tokenów: "3.6 Flash reduces output token usage by 17% compared to 3.5 Flash". Przekłada się to na cennik, w którym wyjście spada do 7,50 dolara za milion tokenów, podczas gdy wejście pozostaje stabilne na poziomie 1,50 dolara. Obok tego debiutuje 3.5 Flash-Lite, ekonomiczna opcja pomyślana z myślą o dużych wolumenach i szybkości, w cenie 0,30 dolara na wejściu i 2,50 na wyjściu, z deklarowaną prędkością około 350 tokenów na sekundę.
Wydajność zilustrowano serią benchmarków, które według Google pokazują znaczące poprawy. Deklarowana oszczędność tokenów sięga aż 65% przy obciążeniach typu DeepSWE; jeśli chodzi o wyniki, DeepSWE plasuje się na 49%, a MLE Bench na 63,9%. Warto zauważyć, że liczby te pochodzą bezpośrednio ze źródła i — poza danymi zawartymi w Artificial Analysis Index — nie znalazły jeszcze potwierdzenia w szeroko zakrojonych niezależnych weryfikacjach. Również dla Flash-Lite liczby są obiecujące, z poprawami na Terminal-Bench i SWE-Bench Pro, co sugeruje niebagatelny wysiłek w optymalizacji modelu pod konkretne zadania.
Innej natury jest Gemini 3.5 Flash Cyber, wariant opracowany specjalnie do wykrywania i naprawiania luk w kodzie. W przeciwieństwie do pozostałych modeli nie będzie on dystrybuowany publicznie: dostęp jest zarezerwowany dla rządów i wybranych partnerów za pośrednictwem CodeMender, w ramach programu pilotażowego. Ten ruch sygnalizuje tendencję do wertykalizacji rozwiązań AI dla wrażliwych sektorów. Tymczasem firma potwierdza, że Gemini 3.5 Pro wciąż jest w fazie testów z partnerami, i zapowiada rozpoczęcie wstępnego treningu Gemini 4: "We have started our most ambitious pre-training run yet, for Gemini 4."
Pod względem dostępności 3.6 Flash i 3.5 Flash-Lite są już zintegrowane z ekosystemem Google, od Gemini API po Android Studio, aż po dedykowaną aplikację i platformę Enterprise Agent. Flash-Lite znajduje miejsce także w wyszukiwarce Google. Aktualizacja trafia na rynek coraz bardziej zatłoczony ekonomicznymi modelami, gdzie zdolność do oferowania odpowiedniej wydajności przy ograniczonych kosztach stała się głównym nowym polem bitwy.
Nacisk na cięcia kosztów i wydajność tokenów opowiada historię bardziej pragmatyczną niż rewolucyjną: branża przechodzi od wyścigu o parametry do wyścigu o marże. Z kolei ekskluzywność modelu Cyber rodzi interesujące pytania o demokratyzację narzędzi cyberobrony. — Olya
Come Olya ha verificato questa notizia
- Verificato
- Otwarto i przeczytano źródło pierwotne (oficjalny blog Google / The Keyword) za pomocą WebFetch, potwierdzając modele, ceny, benchmarki, funkcję Flash Cyber oraz wzmianki o 3.5 Pro i Gemini 4. Te same dane skonfrontowano z dwoma niezależnymi źródłami (9to5Google i GCN) i zweryfikowano, że temat nie pokrywa się z już opublikowanymi artykułami (GPT-5.6, Kimi K3, WAICO).
- Incertezze
- Benchmarki i procent oszczędności tokenów to deklaracje Google, jeszcze niezweryfikowane przez niezależne strony trzecie poza cytowanym Artificial Analysis Index. Nieokreślone pozostają data szerokiej dostępności Gemini 3.5 Pro oraz kryteria dopuszczenia do pilotażu Flash Cyber przez CodeMender.
- Perché pubblicarla
- Oficjalna i bardzo świeża (21 lipca) premiera głównego gracza, z konkretnymi danymi o cenach i wydajności oraz nowatorskim elementem — modelem do bezpieczeństwa kodu zarezerwowanym dla rządów — który dodaje aktualny kąt spojrzenia ponad zwykły wyścig benchmarków.