logo
  • Środowiska
  • Dla firm
  • Cennik
Blogs
Sep 3, 2026

Gemini 3.8 Flash: Co nowego w kodowaniu i agentach AI

Najszybciej rozwijający się model Google zyskuje ulepszenia w kodowaniu, rozumowaniu agentycznym i cyberbezpieczeństwie — oto co naprawdę się zmieniło.

EigentEigent
Share to
Gemini 3.8 Flash: Co nowego w kodowaniu i agentach AI
  • Czym jest Gemini 3.8 Flash?
  • Co nowego w porównaniu z Gemini 3.7 Flash
  • Benchmarki Gemini 3.8 Flash
  • Cennik Gemini 3.8 Flash
  • Gdzie używać Gemini 3.8 Flash
  • Gemini 3.8 Flash Cyber: wariant bezpieczeństwa
  • Czy warto przejść z 3.7 Flash?
  • Zrób to z własną siłą roboczą AI
Automate Everything with
AI Workforce on Desktop
Download Eigent

Google właśnie wydał Gemini 3.8 Flash — trzecie wydanie modelu Flash w ciągu mniej więcej sześciu tygodni i „najbardziej inteligentny model roboczy" w historii tej linii. Przekaz jest prosty: znaczące usprawnienia w inżynierii oprogramowania, zadaniach agentycznych i wieloetapowym rozumowaniu — przy tej samej szybkości i niskiej cenie co 3.7 Flash. Osobny wariant Gemini 3.8 Flash Cyber jest skierowany do wykrywania i łatania luk w zabezpieczeniach. Ten przewodnik omawia zmiany, opublikowane przez Google benchmarki, koszty oraz zastosowanie przy budowaniu agentów AI.

Czym jest Gemini 3.8 Flash?

Gemini 3.8 Flash to lekki, multimodalny model z linii Flash Google, dostrojony do długoterminowego kodowania i autonomicznych agentów. Google określa go jako „nasz najbardziej inteligentny model roboczy", oferujący ulepszenia względem 3.7 Flash w zakresie inżynierii, pracy agentycznej i rozumowania w wyspecjalizowanych dziedzinach (Google).

Model zadebiutował 2 września 2026 roku, trzy tygodnie po 3.7 Flash — w ramach rytmu, w którym Google wydaje nowy model Flash mniej więcej co trzy tygodnie, począwszy od Gemini 3.6 Flash pod koniec lipca (Thurrott).

Wydanie obejmuje dwa warianty zbudowane na tej samej podstawowej inteligencji:

  • Gemini 3.8 Flash — ogólny model roboczy do kodowania, agentów i przepływów pracy w przedsiębiorstwach.
  • Gemini 3.8 Flash Cyber — model skoncentrowany na cyberbezpieczeństwie, służący do wykrywania luk i automatycznego łatania, dostępny wyłącznie dla zaufanych obrońców w ramach nowego programu Fairwind.

Co nowego w porównaniu z Gemini 3.7 Flash

Głównym przekazem jest to, że 3.8 Flash „przynosi znaczące usprawnienia" względem 3.7 Flash, „często zbliżając się do wydajności droższych modeli frontier" — bez podwyżki ceny (9to5Google).

Google przypisuje ten skok jednej decyzji projektowej: model pracuje ciężej. Przy złożonych zadaniach wykonuje więcej kroków rozumowania i iteracyjnie wywołuje narzędzia, co może oznaczać wyższe zużycie tokenów przy wyższych poziomach wysiłku. Jeśli koszt obliczeniowy jest głównym ograniczeniem, Google sugeruje zmniejszenie poziomu wysiłku lub pozostanie przy 3.7 Flash, który nadal jest wspierany dla obciążeń wymagających przede wszystkim efektywności.

Ten kompromis ma znaczenie dla twórców agentów. Większa staranność i iteracyjne wywoływanie narzędzi to dokładnie to, czego potrzebują długo działające pętle agentów — ale oznacza też, że należy monitorować wydatki na tokeny przy zadaniach o dużym wolumenie i niskiej złożoności.

Benchmarki Gemini 3.8 Flash

Google opublikował wyniki w zakresie kodowania, finansów, prawa i ogólnego rozumowania. Wszystkie poniższe dane pochodzą z materiałów startowych Google, więc należy traktować je jako benchmarki dostawcy, a nie niezależne testy.

  • DeepSWE v1.1 (długoterminowa inżynieria oprogramowania): 3.8 Flash przewyższa większość większych modeli frontier w autonomicznym rozwiązywaniu złożonych problemów inżynieryjnych od początku do końca, przy ułamku kosztów (Google).
  • Vals Finance Agent V2 i Harvey's Legal Agent Benchmark: 3.8 Flash przewyższa 3.7 Flash i inne modele frontier w tych wyspecjalizowanych dziedzinach zawodowych.
  • HLE-Verified (Humanity's Last Exam): 54,9%, co Google przytacza jako dowód wieloetapowego rozumowania w obszarach STEM, nauk humanistycznych i dziedzin zawodowych (9to5Google).

Wspólnym mianownikiem jest zdolność agentyczna w dziedzinach, gdzie model musi planować, używać narzędzi i utrzymywać koncentrację przez wiele kroków — a nie tylko odpowiadać na pojedyncze zapytanie.

Warto odnotować jedno zastrzeżenie: podobnie jak poprzedni model, Gemini 3.8 Flash ma datę graniczną wiedzy (knowledge cutoff) na marzec 2026 roku w niektórych dziedzinach, podczas gdy w innych wiedza może być ograniczona do stycznia 2025 roku (9to5Google). Zaplanuj dostarczanie świeżego kontekstu lub narzędzi dla wszystkiego, co jest aktualne.

Cennik Gemini 3.8 Flash

Google utrzymał cenę wprowadzającą na poziomie 3.7 Flash:

  • 0,75 USD za milion tokenów wejściowych
  • 3,75 USD za milion tokenów wyjściowych

Ta cena wprowadzająca obowiązuje do 31 grudnia 2026 roku; po tym terminie standardowa cena wzrośnie do 1,50 USD za milion tokenów wejściowych i 7,50 USD za milion tokenów wyjściowych (Google). Jeśli budujesz na tej podstawie, uwzględnij zmianę cen w styczniu w każdym długoterminowym modelu kosztowym — i pamiętaj, że zachowanie „pracuje ciężej" może zwiększać liczbę tokenów wyjściowych przy złożonych zadaniach.

Gdzie używać Gemini 3.8 Flash

Google udostępnił model od pierwszego dnia na platformach konsumenckich, deweloperskich i korporacyjnych:

  • Konsumenci: aplikacja Gemini, tryb AI w Google Search oraz Gemini w Google Sheets, dla subskrybentów Google AI Pro i Ultra (Search Engine Journal).
  • Deweloperzy: Google Antigravity, AI Studio, Android Studio i Gemini API.
  • Przedsiębiorstwa: Gemini Enterprise.

Dla twórców agentów najważniejszy jest dostęp przez API — pozwala on zintegrować 3.8 Flash z własną orkiestracją zamiast aplikacji Google.

Gemini 3.8 Flash Cyber: wariant bezpieczeństwa

Wariant Cyber jest najbardziej nowatorską częścią tego wydania. Jest skierowany do obrońców i priorytetowo traktuje naprawianie luk zamiast możliwości ofensywnych. Google raportuje wydajność na poziomie frontier w benchmarku CyberGym — standardowym teście dla autonomicznego wykrywania luk — oraz wskaźnik sukcesu powyżej 70% w wewnętrznym benchmarku obejmującym 20 języków programowania (Google).

Rzeczywiste wyniki przytaczane przez Google z własnych zespołów bezpieczeństwa:

  • Zespół bezpieczeństwa Chrome stwierdził, że 3.8 Flash Cyber generował 2,6 razy więcej poprawnych łatek dla luk w Chrome niż znacznie większe modele komercyjne (9to5Google).
  • Dostawca zabezpieczeń Wiz zmierzył 7,5–9,7% wyższy recall w wewnętrznym benchmarku testów penetracyjnych przy 2,3–5,2 razy niższym koszcie niż inne wiodące modele frontier.
  • Zespół Google Cloud Vulnerability Research wykorzystał go do znalezienia krytycznej luki fundamentalnej w mniej niż dwie godziny — pracy, która zwykle zajmuje miesiące.

Zastrzeżenie: 3.8 Flash Cyber jest dostępny wyłącznie przez program Fairwind dla zaufanych rządów, operatorów infrastruktury krytycznej i opiekunów oprogramowania. Nie jest to ogólne wydanie API.

Czy warto przejść z 3.7 Flash?

Krótki przewodnik decyzyjny na podstawie informacji opublikowanych przez Google:

  • Budujesz agenty do kodowania lub wieloetapowe? 3.8 Flash to właściwa aktualizacja — lepsza długoterminowa inżynieria i użycie narzędzi to sedno sprawy.
  • Obsługujesz zadania o dużym wolumenie i niskiej złożoności, gdzie dominuje koszt? Pozostań przy 3.7 Flash lub użyj niższego poziomu wysiłku; zachowanie „pracuje ciężej" może podnosić rachunki za tokeny.
  • Zajmujesz się defensywnym bezpieczeństwem i kwalifikujesz się do Fairwind? Złóż wniosek o 3.8 Flash Cyber.
  • Potrzebujesz aktualnej wiedzy? Podłącz wyszukiwanie lub narzędzia na żywo — data graniczna oznacza, że model samodzielnie nie będzie znał najnowszych wydarzeń.

Zrób to z własną siłą roboczą AI

Gemini 3.8 Flash jest zbudowany dokładnie pod wzorzec, na którym działa Eigent: długoterminowe agenty wywołujące narzędzia, które planują i wykonują prawdziwą pracę zamiast odpowiadać na jedno zapytanie. Eigent to open-source'owa aplikacja desktopowa „Cowork" — wieloagentowa siła robocza automatyzująca przepływy pracy lokalnie, dzięki czemu możesz kierować zdolne modele do kodowania, badań i zadań dokumentacyjnych, zachowując dane na swoim komputerze. Jeśli interesujesz się zyskami agentycznymi w 3.8 Flash, sprawdź jak działa przeglądanie PR-ów GitHub z siłą roboczą agentów lub porównaj spostrzeżenia z naszym zestawieniem najlepszych open-source'owych agentów AI do kodowania. Pobierz Eigent i zbuduj własny system.

Recent Posts

Claude Fable 5.1 i Mythos 5.1: Co nowego, wyjaśnione
Sep 3, 2026

Claude Fable 5.1 i Mythos 5.1: Co nowego, wyjaśnione

Claude Fable 5.1 i Mythos 5.1 wyjaśnione: ten sam model w dwóch poziomach zabezpieczeń, z nowymi wynikami benchmarków, niższymi kosztami o około 25–45 procent i szczegółami dostępu.

EigentEigent
GPT-6 Astra: Co naprawdę potrafi nowy model OpenAI
Sep 3, 2026

GPT-6 Astra: Co naprawdę potrafi nowy model OpenAI

GPT-6 Astra to nowy flagowy model OpenAI. Sprawdź, co potrafi, jak wypada w benchmarkach, ile kosztuje i jakie zastrzeżenia kryją się za nagłówkami o AGI.

EigentEigent
Muse Spark 1.3: Frontier Model Meta do Kodowania i Agentów, Wyjaśniony
Sep 3, 2026

Muse Spark 1.3: Frontier Model Meta do Kodowania i Agentów, Wyjaśniony

Muse Spark 1.3 to nowy frontier model Meta do kodowania i agentów. Sprawdź benchmarki, ceny, warianty xhigh i max, zmiany oraz porównanie z konkurencją.

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

Wypróbuj Eigent już dziś

Pobierz open-source’ową aplikację desktopową. Twoja SI workforce, działająca na Twoim komputerze.

Pobierz Eigent
Eigent

Otrzymuj najnowsze aktualizacje, poradniki i wydania dotyczące automatyzacji SI workforce.

Dziękujemy za zapis!

ProduktEigentŚrodowiskaCennikDla firm
OdkrywajRozwiązaniaPrzypadki użyciaUmiejętnościWtyczkiBlogi
DeweloperzyDokumentacjaGitHubCAMEL-AIFundusz Open SourcePartner
PobierzDla open source
FirmaO nasBrandKarieraWarunki korzystaniaPolityka prywatnościBezpieczeństwo i zaufaniePolityka plików cookiePolityka zwrotów i wersji próbnej

Wszelkie prawa zastrzeżone © 2026 EIGENT UK LTD