Źródła
Zobacz w akcji
Przejrzyj modele i style stojące za takimi historiami — darmowe konto i galeria od razu.

Przejrzyj modele i style stojące za takimi historiami — darmowe konto i galeria od razu.
Google wydał we wtorek trzy nowe modele Gemini — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite i Gemini 3.5 Flash Cyber — ale Gemini 3.5 Pro, flagowy model średniej klasy, na który czekali twórcy, nadal jest w fazie testów.\n\n## Kluczowe informacje\n\n- Gemini 3.6 Flash to nowy główny szybki model Google, pozycjonowany jako szybszy i tańszy od swojego poprzednika.\n- Gemini 3.5 Flash-Lite to okrojona, tańsza wersja przeznaczona do zadań o dużej objętości i wrażliwych na koszty.\n- Gemini 3.5 Flash Cyber to dedykowany model cyberbezpieczeństwa, który Google opisuje jako „efektywną kosztowo i bardzo wydajną alternatywę" dla większych systemów AI bezpieczeństwa, takich jak Mythos od Anthropic.\n- Gemini 3.5 Pro nadal nie jest dostępny — Google twierdzi, że pozostaje w fazie testów, bez ustalonej daty wydania.\n- Google już trenuje Gemini 4, według Ars Technica, co sygnalizuje, że mapa drogowa rozwija się szybciej niż sugerują poszczególne wydania.\n\n## Trzy modele, ale brakuje tego, którego twórcy chcieli najbardziej\n\nDla twórców AI-art, którzy używają narzędzi opartych na Gemini do udoskonalania promptów, multimodalnego rozumienia obrazów lub przepływów pracy opartych na API, warstwa Flash zawsze była praktycznym koniem roboczym — wystarczająco szybka do użytku w czasie rzeczywistym, wystarczająco tania do uruchamiania na dużą skalę. Gemini 3.6 Flash kontynuuje ten trend. Jeśli wywołujesz API do iteracji opisów obrazów lub przetwarzania wsadowego materiałów referencyjnych, 3.6 Flash to model do przetestowania w pierwszej kolejności.\n\nGemini 3.5 Flash-Lite znajduje się poniżej tego poziomu, przeznaczony do zadań, gdzie koszt za token ma większe znaczenie niż surowa wydajność. Pomyśl o automatycznym tagowaniu, lekkiej klasyfikacji lub przetwarzaniu w tle, gdzie w przeciwnym razie przepaliłbyś budżet na cięższym modelu.\n\nBardziej niezwykłym dodatkiem jest Flash Cyber. Według The Verge, Google prezentuje go jako efektywny kosztowo zamiennik dla większych, droższych modeli skoncentrowanych na bezpieczeństwie — konkretnie wymieniając Mythos od Anthropic jako konkurencję. To wąska grupa odbiorców dla większości twórców, ale sygnalizuje, że Google jest gotowy wysyłać warianty zbudowane do konkretnych celów, zamiast czekać, aż model ogólnego przeznaczenia pokryje każdy przypadek użycia.\n\n## Co faktycznie oznacza brak 3.5 Pro\n\nGemini 3.5 Pro był powszechnie oczekiwany jako model między warstwą Flash a tym, czym okaże się Gemini 4 — wydajny model o średniej cenie do zadań wymagających większej głębokości rozumowania niż może dostarczyć Flash. Jego ciągła nieobecność jest godna uwagi, ponieważ TechCrunch donosi, że rodzi to nowe pytania o strategię AI Google: czy Pro jest opóźniony, aby uniknąć kanibalizacji przychodów z Flash, czy po prostu nie jest gotowy?\n\nDla twórców używających Gemini przez API do złożonych łańcuchów promptów lub potoków obraz-do-tekstu, luka między Flash a tym, co przyjdzie później, pozostaje szeroka. Modele Flash są naprawdę dobre pod względem szybkości i kosztów, ale osiągają pułap w niuansowym rozumowaniu — dokładnie tam, gdzie warstwa Pro by pomogła.\n\nPotwierdzenie Google, że Gemini 4 jest już w trakcie treningu, dodaje kolejną komplikację. Jeśli 3.5 Pro zostanie wydany blisko okna wydania Gemini 4, może pojawić się jako model przejściowy o krótkiej żywotności — coś warte uwzględnienia w każdych decyzjach dotyczących przepływu pracy, które podejmujesz wokół niego teraz.\n\n## Praktyczne wybory modeli w tej chwili\n\nJeśli budujesz lub udoskonalasz przepływ pracy oparty na Gemini dzisiaj — czy to do pomocy z promptami, podpisywania obrazów, czy generacji multimodalnej — praktyczne odczytanie jest proste: 3.6 Flash do większości zadań, 3.5 Flash-Lite tam, gdzie uważnie obserwujesz koszty tokenów, i wstrzymaj się z 3.5 Pro, dopóki Google faktycznie go nie wyda.\n\nJeśli chodzi o samo generowanie obrazów, natywne wyjście obrazów Gemini nadal dojrzewa. Twórcy wykonujący poważną pracę wizualną prawdopodobnie łączą możliwości językowe Gemini z dedykowanymi modelami obrazów. Katalog modeli Charmloop obejmuje to, co jest obecnie dostępne u głównych dostawców generacji obrazów, jeśli porównujesz opcje.\n\nWydanie Flash Cyber jest tymczasem głównie istotne dla deweloperów prowadzących audyty bezpieczeństwa wspomagane AI — nie jest to bezpośredni problem dla twórców wizualnych, ale pokazuje, że Google czuje się komfortowo fragmentując linię Gemini na specjalistyczne warianty, zamiast trzymać wszystko na jedno główne wydanie.\n\nZ Gemini 4 w trakcie treningu i 3.5 Pro nadal nieogłoszonym, tempo wydań Google wyraźnie przyspiesza, nawet gdy luki między poszczególnymi modelami się poszerzają. Twórcy polegający na Gemini w jakiejkolwiek części swojego potoku powinni spodziewać się, że krajobraz zmieni się ponownie przed końcem roku — i odpowiednio planować swoje wybory narzędzi. Możesz zbadać, jak obecne narzędzia AI wpasowują się w przepływy pracy generacji obrazów w przewodnikach Charmloop.