Google zaprezentowało nową generację modeli AI z serii Flash: 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber. Nowości skupiają się na poprawie precyzji, zmniejszeniu liczby generowanych tokenów oraz obniżeniu opłat za korzysGoogle nie zwalnia tempa w wyścigu z OpenAI czy Anthropic, ale zamiast chwalić się kolejnymi, gigantycznymi modelami o astronomicznych kosztach utrzymania, firma z Mountain View proponuje coś znacznie bardziej praktycznego. Debiutujące właśnie modele z linii Flash mają trafić dokładnie tam, gdzie w tej chwili bije serce branży tech: do zautomatyzowanych aplikacji, systemów agentowych i masowego przetwarzania danych.
Gemini 3.6 Flash. Zrobi to samo, ale zużyje mniej prądu i zasobów
Gwiazdą pokazu jest bez wątpienia Gemini 3.6 Flash, czyli bezpośredni sukcesor popularnego modelu 3.5. Zamiast zasypywać użytkowników jeszcze dłuższą litanią zbędnych odpowiedzi, inżynierowie skoncentrowali się na precyzji. Efekt jest taki, iż nowy algorytm wykonuje to samo zadanie programistyczne czy analityczne, generując średnio o 17 procent mniej tokenów wyjściowych. Tak przynajmniej twierdzi Google. W przypadku trudnych testów kodowania różnica w zużyciu zasobów sięga choćby 65 procent, bo sztuczna inteligencja rzadziej popełnia błędy i nie wpada w pętle bezmyślnych poprawek.
Co to oznacza w praktyce? Przede wszystkim niższe rachunki dla twórców aplikacji. Google przy okazji skorygowało cennik w API, dzięki czemu koszt prowadzenia automatycznych agentów wyceniono na 1,50 dolara za milion tokenów wejściowych oraz 7,50 dolara za milion wyjściowych. W pakiecie model dostał też wbudowaną obsługę komputera, co pozwala mu sprawniej poruszać się po oprogramowaniu i stronach internetowych tak, jak robi to człowiek.
Zdaniem Google Gemini 3.6 Flash działa szybciej i dokładniej, jednocześnie obniżając koszty. Źródło: GoogleGemini Flash-Lite. Tani demon prędkości?
Drugą z nowości jest Gemini 3.5 Flash-Lite. To propozycja skrojona pod zadania, w których liczą się ułamki sekund i przetwarzanie tysięcy zapytani naraz. Model wykręca prędkości rzędu 350 tokenów na sekundę, czyniąc go jednym z najszybszych rozwiązań w swojej klasie.
Deweloperzy zyskali możliwość elastycznego dopasowania poziomu analizy do konkretnego zadania. Przy prostej automatyzacji model wykonuje polecenia natychmiastowo, co pozwala ograniczyć koszty do 30 centów za milion tokenów wejściowych. Natomiast przy skomplikowanych problemach angażuje głębsze procesy wnioskowania. W testach programistycznych i zadaniach automatycznych ten budżetowy wariant ma pozwać osiągać wyższe wyniki niż starsze modele ze standardowej linii Flash.
W testach programistycznych i automatycznych Gemini 3.5 Flash-Lite wyprzedza starszy model 3 Flash. Źródło: GoogleBroń palna w świecie cyfrowym. Cyber-model zarezerwowany dla rządów
Najbardziej intrygującym ruchem Google jest jednak premiera Gemini 3.5 Flash Cyber. To wyspecjalizowany algorytm stworzony wyłącznie po to, by przeszukiwać kod źródłowy, odnajdywać luki w bezpieczeństwie i automatycznie generować na nie łatki. Działa on w ramach platformy CodeMender, gdzie połączone siły kilku sub-agentów tworzą kompletne audyty bezpieczeństwa.
Amerykański gigant zdaje sobie jednak sprawę z niebezpieczeństwa. Sztuczna inteligencja potrafi dziś bowiem wykrywać błędy w oprogramowaniu znacznie szybciej niż jakikolwiek programista. Ale dokładnie to samo narzędzie w rękach hakerów mogłoby posłużyć do błyskawicznego przygotowania ataku na skalę masową. Dlatego Google podjęło decyzję o zablokowaniu dostępu dla zwykłych użytkowników. Cyber-model trafi w ramach zamkniętego programu pilotażowego wyłącznie do agencji rządowych i wybranych partnerów z branży obronnej.
Model Gemini 3.5 Flash Cyber trafi wyłącznie do rządów i zaufanych partnerów. Źródło: GoogleCo z aplikacją, z której korzystasz na co dzień?
Choć większość tych zmian jest skierowana do programistów budujących własne oprogramowanie, nowości powoli trafiają też do powszechnego użytku. Wersję 3.6 Flash można już wypróbować w oficjalnej aplikacji Gemini. Z kolei wariant Flash-Lite trafia do tradycyjnej wyszukiwarki Google, gdzie odpowiada za natychmiastowe generowanie podsumowań.
Google jednocześnie uspokaja entuzjastów najwyższej mocy obliczeniowej. Firma w tej chwili prowadzi niejawne testy flagowego modelu Gemini 3.5 Pro. Z kolei w laboratoriach ruszył już proces trenowania czołowych algorytmów kolejnej, czwartej generacji.
Źródło tekstu i zdjęcia otwierającego: Google








