Przedstawiamy Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber

21 Lip, 2026

|

Nasze najnowsze modele Gemini zapewniają wydajność, szybkość działania i niezawodność pozwalające na tworzenie agentów AI na dużą skalę.


Tulsee Doshi

Senior Director, Product Management, on behalf of the Gemini team


obraz bohatera z napisem 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber

Deweloperzy i klienci tworzący agentów AI do zastosowań produkcyjnych potrzebują wyższej wydajności tokenów, mniejszych opóźnień i bardziej niezawodnej wydajności. Nasza seria modeli Flash została stworzona z myślą o osiągnięciu optymalnego poziomu wydajności i jakości, umożliwiając skalowanie przepływów pracy agentów. Bazując na Gemini 3.5 Flash, wprowadzamy nowe modele Gemini:

  • 3.6 Flash: Nasz model roboczy, który zapewnia lepsze kodowanie, pracę opartą na wiedzy i wydajność multimodalną. Według Wskaźnika Analizy Sztucznej Inteligencji (Artificial Analysis Index) , zmniejsza on zużycie tokenów wyjściowych o 17% w porównaniu z 3.5 Flash, a w niektórych testach porównawczych, takich jak DeepSWE firmy Datacurve , obserwujemy spadek nawet do 65%, a wszystko to przy niższym koszcie na token wyjściowy.
  • 3.5 Flash-Lite: Nasz najszybszy i najbardziej ekonomiczny model klasy 3.5, dostarczający 350 tokenów wyjściowych na sekundę według wskaźnika sztucznej analizy, a także znacznie przewyższający poprzednie generacje Flash-Lite w przypadku przepływów pracy opartych na agentach.
  • 3.5 Flash Cyber ​​w CodeMender: Skuteczne zastosowania cyberbezpieczeństwa wymagają starannej orkiestracji modelu i infrastruktury agentów. Wprowadzamy połączenie nowego, wysoce wydajnego, wyspecjalizowanego modelu skoncentrowanego na cyberbezpieczeństwie z naszym agentem bezpieczeństwa kodu CodeMender, który zapewnia konkurencyjną wydajność na rynku.

Poza dzisiejszymi wersjami, Gemini 3.5 Pro jest obecnie testowany z partnerami i planujemy udostępnić go szerokiej publiczności, gdy tylko będzie gotowy. Równocześnie nasz zespół koncentruje się na budowaniu kolejnej generacji modeli. Rozpoczęliśmy jak dotąd najbardziej ambitny etap wstępnego treningu dla Gemini 4 i jesteśmy podekscytowani postępami.

3.6 Flash: Wydajniejszy i lepszej jakości niż 3.5 Flash

Gemini 3.6 Flash bazuje bezpośrednio na opiniach programistów i klientów z wersji 3.5 Flash. Wersja 3.6 Flash nie tylko oferuje wyższy poziom kodowania i pracy z wiedzą, ale robi to jednocześnie znacząco poprawiając wydajność tokenów. Na przykład, według Wskaźnika Analizy Sztucznej Inteligencji, wersja 3.6 Flash zużywa o 17% mniej tokenów wyjściowych niż wersja 3.5 Flash. Wymaga również mniej kroków wnioskowania i wywołań narzędzi do realizacji wieloetapowych przepływów pracy.

Ta zwiększona wydajność idzie w parze z niższą ceną niż w przypadku wersji 3.5 Flash. Przy koszcie 1,50 USD/1 mln tokenów wejściowych i 7,50 USD/1 mln tokenów wyjściowych, wersja 3.6 Flash obniża całkowity koszt zadania agenta, dzięki czemu tworzenie i uruchamianie agentów jest bardziej opłacalne.

Wersja 3.6 Flash zapewnia lepszą wydajność tokenów i mniejszą liczbę szczegółów w porównaniu z wersją 3.5 Flash w zweryfikowanym zadaniu (API) OSWorld

Mimo że jest bardziej wydajny, wersja 3.6 Flash zapewnia wzrost wydajności w porównaniu do wersji 3.5 Flash w różnych przypadkach użycia:

  • Wersja 3.6 Flash zapewnia większą precyzję przy mniejszej liczbie niepożądanych edycji kodu i zredukowanych pętlach wykonywania, co wykazał DeepSWE (49% w porównaniu z 37%), a także wykazuje znaczną poprawę w badaniu ML Research, co wykazał MLE Bench (63,9% w porównaniu z 49,7%).
  • Poprawiło to możliwości korzystania z komputera, co widać w OSWorld-Verified (83,0% w porównaniu z 78,4%). Korzystanie z komputera jest teraz wbudowane w klienta za pośrednictwem API Gemini i Gemini Enterprise.
  • W testach wydajnościowych, takich jak GDPval-AA v2 (odpowiednio 1421 i 1349), przewyższa Flasha 3.5 w zakresie pracy z wiedzą. Klienci tacy jak Hebbia i Harvey uznali go za szczególnie wydajnego w zadaniach multimodalnych, takich jak analiza dokumentów, wykresów i danych oraz tworzenie raportów.
wykres
wykres

Klienci twierdzą, że wersja 3.6 Flash to krok naprzód zarówno pod względem kosztów, jak i jakości, zapewniający równowagę między wydajnością tokenów, dokładnością i szybkością w przypadku złożonych przepływów pracy i zadań opartych na wiedzy:

Zbudowany z myślą o bezpieczeństwie

Wersja 3.6 Flash jest dostarczana z ulepszonymi zabezpieczeniami Frontier Safety w obszarach nadużyć związanych z bronią chemiczną, biologiczną, radiologiczną i jądrową (CBRN) oraz cyberprzestępczością. Zabezpieczenia te znacznie zwiększają odporność modelu na jailbreak. Jednocześnie model został wytrenowany w celu minimalizacji odmów w celu wykorzystania w celach komercyjnych.

Więcej informacji znajdziesz na karcie modelu 3.6 Flash .

3.5 Flash-Lite: Zbudowany do skalowania przepływów pracy agentów

Oprócz technologii Flash udostępniamy również technologię Gemini 3.5 Flash-Lite przeznaczoną zarówno do zadań wymagających niewielkich opóźnień, jak i zadań, w których wysoka przepustowość ma kluczowe znaczenie dla przepływów pracy programistów, takich jak wyszukiwanie agentowe i przetwarzanie dokumentów.

3.5 Flash-Lite to najszybszy model z serii 3.5. Według pomiarów Artificial Analysis , działa z prędkością 350 tokenów wyjściowych/s. W cenie 0,3 USD/1 mln tokenów wejściowych i 2,5 USD/1 mln tokenów wyjściowych, a także ze znacznie lepszą jakością niż 3.1 Flash-Lite, 3.5 Flash-Lite oferuje korzystny stosunek ceny do wydajności dla programistów i klientów obsługujących ruch produkcyjny o dużej przepustowości.

3.5 Flash-Lite wykonuje zadania o dużej objętości przy mniejszym opóźnieniu niż 3.5 Flash.

Wersja 3.5 Flash-Lite umożliwia efektywne skalowanie systemów agentowych. Model ten znacząco przewyższa wersję 3.1 Flash-Lite na różnych poziomach myślenia. W zależności od obciążenia, programiści mogą skonfigurować model tak, aby priorytetyzował wykonywanie zadań o niskim opóźnieniu i niskim koszcie dla zadań o dużej objętości przy minimalnym i niskim poziomie myślenia lub angażował wyższe poziomy myślenia do przetwarzania wieloetapowych obciążeń subagentów. Model posiada teraz również wbudowane narzędzie komputerowe, które niezawodnie obsługuje te zadania agentowe na różnych platformach.

To znaczący krok naprzód w kodowaniu i zadaniach agentowych, jak widać w Terminal-Bench 2.1 (54% w porównaniu do 31%), w długim kontekście, jak widać w GDM-MRCR v2 (72,2% w porównaniu do 60,1%), oraz w wykonywaniu zadań w świecie rzeczywistym, jak widać w GDPval-AA v2 (1140 w porównaniu do 642).

wykres

W rzeczywistości, w wielu ocenach agentów i kodowania, 3.5 Flash-Lite wypada lepiej niż 3 Flash, w tym w SWE-Bench Pro (54,2% w porównaniu do 49,6%) i OSWorld-Verified (74,0% w porównaniu do 65,1%), co czyni go szybszą i wydajniejszą opcją dla obciążeń zarówno w 2.5, jak i 3 Flash.

wykres

Pierwsi klienci wersji 3.5 Flash-Lite podkreślają jej wyjątkowe połączenie szybkości, inteligencji i opłacalności w zakresie skalowania przepływów pracy agentów i zadań przetwarzania danych:

Więcej informacji na temat modelu znajdziesz w karcie modelu 3.5 Flash-Lite .

3.5 Flash Cyber ​​w CodeMender: skuteczne wyszukiwanie i usuwanie luk w zabezpieczeniach

Modele sztucznej inteligencji potrafią wykrywać luki w zabezpieczeniach szybciej, niż obecne systemy są w stanie je naprawić. Aby stawić czoła temu rosnącemu zagrożeniu, konieczne jest zastosowanie wysoce wydajnego i skutecznego podejścia do zabezpieczania oprogramowania.

Wydajność i efektywność Flasha sprawiają, że stanowi on idealną podstawę do wykrywania, weryfikowania i łatania luk w zabezpieczeniach kodu na dużą skalę. Gemini 3.5 Flash Cyber ​​został zbudowany na bazie Flasha 3.5 i zoptymalizowany pod kątem wyszukiwania i usuwania luk w cyberbezpieczeństwie przy niższej cenie za token niż w przypadku większych modeli.

W CodeMender, który wykorzystuje wielu agentów 3.5 Flash Cyber ​​współpracujących ze sobą w celu wygenerowania pojedynczego, łączonego raportu, 3.5 Flash Cyber ​​osiąga wydajność porównywalną z popularnym benchmarkiem CyberGym.

wykres

Biorąc pod uwagę dwojakie zastosowanie tej technologii, celowo wdrożyliśmy wersję 3.5 Flash Cyber. Model ten będzie wkrótce dostępny wyłącznie dla rządów i zaufanych partnerów za pośrednictwem CodeMender w ramach programu pilotażowego o ograniczonym dostępie. Zapewni to obrońcom na pierwszej linii przewagę w znajdowaniu i naprawianiu krytycznych luk w zabezpieczeniach, zanim zostaną one wykorzystane, jednocześnie ograniczając ryzyko nadużyć na szerszą skalę.

3.6 Flash i 3.5 Flash-Lite: Zacznij już dziś

Wersje 3.6 Flash i 3.5 Flash-Lite są dostępne od dziś:

Gdy zaczniesz budować komputery w wersjach 3.6 Flash i 3.5 Flash-Lite, chętnie poznamy Twoje opinie, które pomogą nam udoskonalić przyszłe modele Gemini. Z niecierpliwością czekamy na rychłe wydanie wersji 3.5 Pro.

Get the latest news from Google in your inbox

Sign up for our newsletters with product updates, event information, special offers, and more.

Your information will be used in accordance with Google's privacy policy. You may opt out at any time.