Źródła
Bądź na bieżąco ze sztuką AI
Otrzymuj na maila najważniejsze historie tygodnia o AI i sztuce AI — wyselekcjonowane, zwięzłe, za darmo.
Za darmo. Wypisz się w każdej chwili.

Otrzymuj na maila najważniejsze historie tygodnia o AI i sztuce AI — wyselekcjonowane, zwięzłe, za darmo.
Za darmo. Wypisz się w każdej chwili.
Lipcowa fala aktualizacji AI Google obejmuje wszystko — od modelu robotyki drugiej generacji po inteligentniejsze generowanie lokalne na urządzeniu — a kilka zmian ma bezpośrednie konsekwencje dla twórców, którzy polegają na ekosystemie Google przy pracy z obrazami i wideo.\n\n## Najważniejsze wnioski\n\n- Google ogłosiło w lipcu 2026 roku Gemini Robotics ER 2 — drugą generację swojego modelu rozumowania ucieleśnionego.\n- Veo, model generowania wideo AI od Google, otrzymał ulepszenia możliwości w ramach lipcowego wdrożenia.\n- Google rozszerza funkcje AI działające lokalnie na urządzeniu, ograniczając zależność od wnioskowania w chmurze przy niektórych zadaniach generowania.\n- Ogłoszono nowe narzędzia AI ukierunkowane na naukę, co sygnalizuje wejście Google w obszar edukacji wspomaganej przez AI obok narzędzi kreatywnych.\n- Aktualizacje obejmują infrastrukturę deweloperską, urządzenia konsumenckie i aplikacje kreatywne — to szeroka gra platformowa, a nie pojedyncze flagowe wydanie.\n\n## Gemini Robotics ER 2 i co sygnalizuje dla generowania multimodalnego\n\nGłównym ogłoszeniem modelowym jest Gemini Robotics ER 2, według Google AI Blog. Skrót ER w nazwie oznacza „embodied reasoning" — zdolność modelu do rozumienia i działania w środowiskach fizycznych. Dla twórców AI praktyczne znaczenie nie leży w robotach: chodzi o to, co ulepszone rozumowanie przestrzenne i fizyczne w modelu bazowym zazwyczaj odblokowuje na dalszych etapach. Lepsze rozumienie trwałości obiektów i scen w podstawowej architekturze Gemini zwykle poprawia spójność między promptem a obrazem — szczególnie w przypadku złożonych scen kompozycyjnych, gdzie obiekty muszą prawidłowo odnosić się do siebie w przestrzeni 3D.\n\n## Ulepszenia Veo i obraz generowania wideo\n\nVeo, model wideo AI Google, otrzymał aktualizacje w lipcowej paczce. Google nie ujawniło publicznie wszystkich szczegółów technicznych, ale lipcowe podsumowanie przedstawia ulepszenia jako część szerszego dążenia do tego, by wideo AI było bardziej użyteczne na powierzchniach konsumenckich i deweloperskich. Dla twórców eksperymentujących już z wideo AI, Veo pozostaje jednym z nielicznych modeli oferujących prawdziwą jakość kinematograficzną przy dłuższych ujęciach — każde zwiększenie możliwości ma znaczenie, gdy wybierasz między nim a konkurencją. Jeśli rozważasz opcje, krajobraz narzędzi do generowania wideo AI zmienił się w tym roku bardzo szybko.\n\n## AI na urządzeniu i co oznacza dla szybkości generowania\n\nPowracającym motywem w lipcowych ogłoszeniach Google jest wnioskowanie on-device — uruchamianie modeli AI lokalnie na sprzęcie Pixel i innych urządzeniach z Androidem, zamiast kierowania każdego żądania przez centra danych Google. W przypadku generowania obrazów i wideo przetwarzanie lokalne może oznaczać mniejsze opóźnienia i mniej podróży do chmury, choć kompromisem jest rozmiar modelu: najbardziej zaawansowane modele generowania nadal wymagają mocy obliczeniowej po stronie serwera. Google radzi sobie z tym, pozostawiając ciężkie generowanie w chmurze, a lżejsze zadania — sugestie stylu, dopracowywanie promptów, upscaling — przenosząc na urządzenie. Ta podzielona architektura jest warta obserwacji, ponieważ mogłaby ostatecznie pozwolić twórcom szybciej iterować prompty bez zużywania limitu API.\n\n## Narzędzia edukacyjne i szerszy ruch platformowy\n\nGoogle ogłosiło również narzędzia AI skierowane do edukacji i pomagające ludziom prosperować w gospodarce wspomaganej przez AI — kategorie, które mogą wydawać się odległe od generowania obrazów, ale odzwierciedlają sposób, w jaki Google pozycjonuje Gemini jako infrastrukturę na każdej powierzchni, a nie tylko chatbota. Im bardziej Gemini poprawia się jako ogólny system rozumowania, tym lepiej sprawdza się jako backend dla narzędzi kreatywnych zbudowanych na ekosystemie Google.\n\nDla twórców korzystających bezpośrednio z narzędzi Google — czy to przez generowanie obrazów AI, czy aplikacje firm trzecich zbudowane na API Gemini — lipcowe aktualizacje reprezentują przyrostowy, ale konsekwentny postęp. Żadne pojedyncze ogłoszenie nie jest przełomem, ale wzorzec jest jasny: Google zacieśnia integrację między swoimi modelami bazowymi, sprzętem urządzeń i aplikacjami konsumenckimi. Twórcy budujący przepływy pracy na ekosystemie Google powinni spodziewać się, że podział na on-device i chmurę będzie się pogłębiał przez resztę 2026 roku — przy czym najbardziej zaawansowane generowanie pozostanie w chmurze, a codzienne wsparcie kreatywne będzie się przesuwać bliżej sprzętu.\n\nNajbliższym testem będzie to, czy lipcowe ulepszenia Veo pojawią się w integracjach firm trzecich — tam większość twórców faktycznie się z nimi zetknie.