Modele AI

Google wypuszcza trzy modele Gemini Flash naraz. Flagowy 3.5 Pro dalej się spóźnia

21 lipca Google wydał od razu trzy modele: Gemini 3.6 Flash, 3.5 Flash-Lite i bezpieczeństwowy 3.5 Flash Cyber, obniżając ceny nawet o kilkadziesiąt procent względem poprzedniej generacji. Flagowy Gemini 3.5 Pro wciąż nie doczekał się nowej daty premiery.

Google wydało we wtorek, 21 lipca, trzy nowe modele z rodziny Gemini naraz: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite oraz Gemini 3.5 Flash Cyber — wyspecjalizowany model bezpieczeństwa. To największa jednorazowa aktualizacja segmentu “flash” od premiery Gemini 3, a zarazem kolejny sygnał, że firma koncentruje siły na tańszych, szybkich modelach, podczas gdy flagowy Gemini 3.5 Pro po raz kolejny każe na siebie czekać.

Ile kosztuje Gemini 3.6 Flash i co dostajemy w zamian?

Gemini 3.6 Flash w API kosztuje 1,50 dol. za milion tokenów wejściowych i 7,50 dol. za wyjściowe — to spadek z 9 dol. za tokeny wyjściowe w Gemini 3.5 Flash. Google podaje też, że nowy model zużywa około 17 proc. mniej tokenów wyjściowych do wykonania tego samego zadania, co dodatkowo obniża rzeczywisty koszt zapytania niezależnie od cennika. Zaktualizowano ponadto wiedzę modelu — cutoff przesunięto ze stycznia 2025 na marzec 2026.

Tańszy wariant, Gemini 3.5 Flash-Lite, wyceniono na 0,30 dol. za milion tokenów wejściowych i 2,50 dol. za wyjściowe. To model z myślą o zadaniach masowych, gdzie liczy się przepustowość i koszt jednostkowy, a nie najwyższa możliwa jakość odpowiedzi.

Co robi Gemini 3.5 Flash Cyber?

Trzeci model różni się od pozostałych dwóch przeznaczeniem. Gemini 3.5 Flash Cyber to wyspecjalizowany system do wyszukiwania i łatania podatności w kodzie, rozwijany w ramach programu CodeMender. Na razie Google udostępnia go wyłącznie rządom i zaufanym partnerom w ramach ograniczonego pilotażu — bez publicznego API i bez opublikowanego cennika. Model trafia do rosnącej kategorii wyspecjalizowanych systemów bezpieczeństwa o ograniczonym dostępie, obok Mythos od Anthropic i Project Perception od Microsoft, o którym pisaliśmy w zeszłym tygodniu.

Dlaczego Gemini 3.5 Pro wciąż nie ma premiery?

Kontrast z trzema świeżymi premierami jest wyraźny. Gemini 3.5 Pro, flagowy model Google, pozostaje niedostępny szerzej. Pisaliśmy już, że w lipcu Google przesunął jego premierę o kilka miesięcy, po tym jak wewnętrzne testy wykazały słabości w kodowaniu i złożonym, długofalowym rozumowaniu — teraz, jak podaje 9to5Google powołując się na CNBC, opóźnienie się przedłuża, a firma nie deklaruje nowego terminu.

Jednocześnie Google potwierdził, że trwa pretrening Gemini 4 — według firmy najbardziej ambitny run treningowy w jej historii. Ma go wspierać nowy chip Frozen v2, który względem poprzedniej generacji ma dać od 6 do 10 razy większą efektywność obliczeniową. Innymi słowy, zasoby, które mogłyby przyspieszyć dopracowanie 3.5 Pro, firma kieruje już w stronę kolejnej generacji modelu.

Wojna cenowa w segmencie flash

Premiery wpisują się w ostrą walkę cenową w tanim segmencie modeli. GPT-5.6 Luna od OpenAI kosztuje 1 dol. za milion tokenów wejściowych i 6 dol. za wyjściowe, a Grok 4.5 od SpaceXAI — 2 dol. i 6 dol. Gemini 3.6 Flash z ceną 1,50 dol. za wejście plasuje się między nimi, a budżetowy Flash-Lite podbija stawkę w dół jeszcze mocniej. Dla firm budujących produkty na dużą skalę to dziś główne pole rywalizacji — nie flagowce testujące granice możliwości, lecz modele, które można wywoływać miliony razy dziennie bez przekraczania budżetu.

Źródło: 9to5Google

Komentarze

Dołącz do dyskusji

Komentarze są moderowane przed publikacją.