Джерела
Будь на крок попереду у ШІ-арті
Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.

Отримуй на пошту головні історії тижня про ШІ та ШІ-арт — відібрані, стислі, безкоштовно.
Безкоштовно. Відписатися можна будь-коли.
Хвиля оновлень Google AI у липні 2026 охоплює все — від моделі робототехніки другого покоління до розумнішої генерації на пристрої — і кілька змін безпосередньо стосуються авторів, які покладаються на інфраструктуру Google для роботи із зображеннями та відео.
Головним анонсом моделі став Gemini Robotics ER 2, згідно з блогом Google AI. ER у назві означає втілене міркування (embodied reasoning) — здатність моделі розуміти фізичне середовище та діяти в ньому. Для авторів, які працюють із ШІ, практична цінність полягає не в роботах: важливо те, що покращене просторове та фізичне міркування у фундаментальній моделі зазвичай відкриває нові можливості на наступних рівнях. Краще розуміння сталості об'єктів і сцен в основній архітектурі Gemini, як правило, підвищує узгодженість між промптом та зображенням — особливо для складних композиційних сцен, де об'єкти мають правильно співвідноситися у тривимірному просторі.
Veo, відеомодель Google на основі ШІ, отримала оновлення в липневому пакеті. Google не розкрив усіх технічних деталей публічно, але липневий огляд подає покращення як частину ширшого прагнення зробити відео на основі ШІ більш придатним для використання на споживчих і розробницьких платформах. Для авторів, які вже експериментують із відео на основі ШІ, Veo залишається однією з небагатьох моделей із справжньою кінематографічною якістю при більшій тривалості — будь-яке покращення можливостей має значення, коли ви обираєте між нею та конкурентами. Якщо ви зважуєте варіанти, ландшафт інструментів для генерації відео на основі ШІ цього року змінився дуже швидко.
Наскрізна тема липневих оголошень Google — інференс на пристрої: запуск моделей ШІ локально на пристроях Pixel та інших Android-пристроях замість того, щоб направляти кожен запит через дата-центри Google. Для генерації зображень і відео зокрема обробка на пристрої може означати меншу затримку та менше звернень до хмари, хоча компроміс полягає в розмірі моделі: найпотужніші моделі генерації досі потребують серверних обчислень. Google вирішує цю дилему, залишаючи важку генерацію в хмарі, а легші завдання — пропозиції стилю, уточнення промптів, апскейлінг — перекладаючи на пристрій. Ця розподілена архітектура заслуговує на увагу, оскільки з часом вона може дозволити авторам швидше ітерувати промпти, не витрачаючи квоту API.
Google також анонсував інструменти ШІ, спрямовані на освіту та допомогу людям у процвітанні в економіці, доповненій ШІ, — категорії, які можуть здаватися далекими від генерації зображень, але відображають те, як Google позиціонує Gemini як інфраструктуру для кожної платформи, а не лише як чат-бот. Що більше Gemini вдосконалюється як загальний розмірковувач, то краще він працює як бекенд для творчих інструментів, побудованих на інфраструктурі Google.
Для авторів, які безпосередньо використовують інструменти Google — через генерацію зображень за допомогою ШІ або сторонні застосунки на основі Gemini API — липневі оновлення являють собою поступальний, але послідовний рух уперед. Жодне окреме оголошення не є кардинальним зрушенням, але закономірність очевидна: Google посилює інтеграцію між своїми фундаментальними моделями, апаратним забезпеченням пристроїв і споживчими застосунками. Авторам, які будують робочі процеси на інфраструктурі Google, варто очікувати, що розподіл між пристроєм і хмарою стане більш вираженим до кінця 2026 року: найпотужніша генерація залишиться прив'язаною до хмари, тоді як повсякденна творча допомога наближатиметься до апаратного забезпечення.
Наступним випробуванням стане те, чи з'являться липневі покращення Veo у сторонніх інтеграціях — саме там більшість авторів насправді з ними зіткнеться.