Google po raz kolejny udowadnia, że w segmencie modeli budżetowych nie zwalnia tempa. Zaledwie trzy tygodnie po debiucie Gemini 3.7 Flash, koncern z Mountain View prezentuje następcę – Gemini 3.8 Flash. To już trzecia odsłona tej linii w ciągu zaledwie sześciu tygodni. Tak dynamiczne tempo publikacji rodzi pytania o strategię giganta: czy to oznaka siły i płynności prac nad AI, czy może próba odwrócenia uwagi od wciąż nieobecnych flagowców, takich jak Gemini 3.5 Pro i długo wyczekiwany Gemini 4?
Nowy model dostępny jest w dwóch wariantach. Podstawowa wersja została zaprojektowana z myślą o ogólnym rozumowaniu i zadaniach programistycznych. Druga, specjalistyczna edycja o nazwie 3.8 Flash Cyber, powstała z kolei z myślą o cyberbezpieczeństwie. Nowy szef działu DeepMind, Koray Kavukcuoglu, podkreśla jednak, że Google nie koncentruje się wyłącznie na optymalizacji stosunku ceny do wydajności. Firma wciąż zamierza przewodzić pod względem surowych możliwości technologicznych.
Wyniki, które robią wrażenie w kodowaniu
Według danych opublikowanych przez Google, Gemini 3.8 Flash osiąga imponujący wynik 73,7 procent w teście DeepSWE v1.1. To benchmark mierzący umiejętności rozwiązywania złożonych, długoterminowych zadań inżynierii oprogramowania. Dla porównania, flagowy model Anthropica – Claude Opus 5 – uzyskuje 74,0 procent. Różnica jest minimalna. Co więcej, nowy model Google wyraźnie dystansuje konkurencję w tej samej kategorii: Claude Sonnet 5 zdobywa 53,8 procent, GPT-5.6 Sol od OpenAI – 72,7 procent, a poprzednia wersja 3.7 Flash – 65,3 procent.
Przedstawiciele Google przekonują, że Gemini 3.8 Flash pokonuje modele takie jak Opus 5 i GPT-5.6 Sol w wielu innych benchmarkach, pozostając przy tym znacznie tańszym rozwiązaniem. Należy jednak pamiętać, że są to wyniki testów laboratoryjnych. Rzeczywiste wrażenia z użytkowania modelu w codziennej pracy programisty mogą się od nich znacząco różnić.
Postęp w generowaniu 3D
Google chwali się również ulepszeniami w dziedzinie generowania trójwymiarowych światów. Firma opublikowała wideo prezentujące grę 3D, którą Gemini 3.8 Flash miał stworzyć na podstawie pojedynczego polecenia w narzędziu do kodowania AI o nazwie Antigravity. Tekstury do tej gry zostały natomiast wygenerowane przy użyciu modelu obrazowego Nano Banana.
Cena atrakcyjna na starcie, ale koszty potrafią rosnąć
Gemini 3.8 Flash debiutuje z promocyjną ceną 0,75 dolara za milion tokenów wejściowych i 3,75 dolara za milion tokenów wyjściowych. To dokładnie tyle samo, ile kosztował jego poprzednik. Od stycznia 2027 roku standardowa stawka wzrośnie odpowiednio do 1,50 i 7,50 dolara. Dla porównania, Claude Opus 5 wyceniany jest na 5 dolarów za milion tokenów wejściowych i 25 dolarów za wyjściowe. GPT-5.6 Sol kosztuje z kolei 4 i 20 dolarów. Nawet po zakończeniu okresu promocyjnego, model Google pozostanie znacznie tańszy od topowych rozwiązań OpenAI i Anthropica w przeliczeniu na pojedynczy token.
Jest jednak pewien haczyk. Przedstawiciele Google tłumaczą, że przewaga wydajnościowa nad wersją 3.7 wynika między innymi z większej liczby kroków rozumowania przy skomplikowanych zadaniach oraz iteracyjnego korzystania z narzędzi. Model po prostu „pracuje ciężej”, co przekłada się na wyższe zużycie tokenów. To z kolei częściowo niweluje korzyść płynącą z niższej ceny za token. Dla zastosowań, gdzie kluczowa jest efektywność obliczeniowa, Google zaleca korzystanie z niższych poziomów rozumowania lub pozostanie przy wciąż wspieranym modelu 3.7 Flash.
Niezależne testy potwierdzają potencjał i wskazują na wzrost kosztów
Niezależna platforma Artificial Analysis przyznała Gemini 3.8 Flash wynik 59 punktów w swoim Indeksie Inteligencji. To o trzy punkty więcej niż w przypadku poprzednika (56 punktów). Taki rezultat plasuje nowy model Google na równi z GPT-5.6 Sol (przy wysokim poziomie rozumowania) oraz Grok 4.6 (przy średnim poziomie rozumowania). Analitycy platformy wskazują, że główny wzrost wydajności wynika z lepszych rezultatów w testach agentowych, obejmujących korzystanie z narzędzi i zadania programistyczne.
Jeśli chodzi o koszt pojedynczego zadania, 3.8 Flash znajduje się na tzw. granicy Pareto. Oznacza to, że oferuje najniższą cenę za wykonanie zadania przy swoim poziomie inteligencji – około 0,58 dolara. Warto jednak zauważyć, że jest to wartość o około 40 procent wyższa niż w przypadku 3.7 Flash (0,40 dolara), mimo że cena za token pozostała bez zmian. To prawdopodobnie główny powód, dla którego Google rekomenduje poprzednią wersję do zadań wymagających maksymalnej wydajności.
Przy wysokim poziomie rozumowania, Gemini 3.8 Flash generuje około 300 tokenów na sekundę, a średni czas wykonania zadania wynosi 2,5 minuty. To wynik nieco lepszy niż w przypadku GPT-5.6 Luna (2,6 minuty) i GPT-5.6 Terra (3,3 minuty), ale gorszy od Claude Fable 5.1 (2,1 minuty) i starszego 3.7 Flash (2,2 minuty). Obniżenie poziomu rozumowania skraca czas wykonania zadania do około 48 sekund.
Cyberwersja tylko dla wybranych
Gemini 3.8 Flash Cyber, podobnie jak jego poprzednik 3.5 Flash Cyber, nie jest publicznie dostępny. Google dystrybuuje go w ramach programu Fairwind, skierowanego do agencji rządowych, operatorów infrastruktury krytycznej oraz osób odpowiedzialnych za utrzymanie kluczowego oprogramowania. Model ten ma mniej restrykcyjne ustawienia bezpieczeństwa niż wersja standardowa, ponieważ został zaprojektowany do defensywnych prac z zakresu cyberbezpieczeństwa.
W teście CyberGym, uznawanym za branżowy standard wykrywania podatności w językach C/C++, wersja 3.8 Flash Cyber uzyskuje 86,2 procent. To wynik lepszy niż w przypadku poprzednika (77,5%), GPT-5.6 Sol (83,6%) czy GPT-5.5-Cyber (85,6%). W zadaniu automatycznego łatania podatności (test CWE-Bench), model osiąga 47,2 procent Pass@1, niemal dorównując najlepszemu modelowi granicznemu (47,8 procent), ale przy znacznie niższych kosztach.
Nowy model wykazuje również większą odporność na ataki polegające na prompt injection. W benchmarku Gray Swan IPI, wskaźnik skuteczności ataku na Gemini 3.8 Flash wynosi zaledwie 5,5 procent. Dla porównania, DeepSeek V4 Pro osiąga 60,1 procent, Kimi K3 – 52,7 procent, a Grok 4.6 – 51,8 procent. Lepiej radzi sobie jedynie Claude Opus 5 od Anthropica z wynikiem 4,8 procent.
Gemini 3.8 Flash jest już dostępny dla programistów poprzez Google AI Studio, narzędzie Antigravity oraz Android Studio. Przedsiębiorstwa mogą korzystać z niego za pośrednictwem platformy Gemini Enterprise. Konsumenci z kolei znajdą go w aplikacji Gemini, trybie AI Mode w wyszukiwarce Google, a płacący subskrybenci – również w Google Sheets.
Najnowsza odsłona budżetowej linii Google to bez wątpienia krok naprzód w kwestii stosunku wydajności do ceny. Jednak lawina kolejnych wersji Flash w krótkim odstępie czasu może być sygnałem, że gigant z Mountain View stara się umocnić swoją pozycję w segmencie praktycznych zastosowań, podczas gdy świat wciąż czeka na prawdziwego flagowca nowej generacji. Odpowiedź na pytanie, czy szybkie iteracje są strategią na sukces, czy jedynie taktycznym zagraniem, poznamy dopiero w momencie premiery Gemini 4.

