Sources
Gardez une longueur d’avance sur l’art IA
Recevez chaque semaine les meilleures actus IA et art IA dans votre boîte mail — sélectionnées, concises, gratuites.
Gratuit. Désabonnement à tout moment.

Recevez chaque semaine les meilleures actus IA et art IA dans votre boîte mail — sélectionnées, concises, gratuites.
Gratuit. Désabonnement à tout moment.
La vague de mises à jour IA de Google pour juillet 2026 couvre tout, d'un modèle robotique de deuxième génération à une génération embarquée plus intelligente — et plusieurs de ces changements ont des conséquences directes pour les créateurs qui s'appuient sur l'écosystème Google pour les images et la vidéo.
L'annonce de modèle phare est Gemini Robotics ER 2, selon le blog Google AI. Le sigle ER dans le nom signifie « embodied reasoning » — la capacité du modèle à comprendre et à agir dans des environnements physiques. Pour les créateurs IA, la pertinence pratique ne réside pas dans les robots : elle tient à ce qu'un raisonnement spatial et physique amélioré dans un modèle de fondation tend à débloquer en aval. Une meilleure permanence des objets et une meilleure compréhension des scènes dans l'architecture centrale de Gemini améliorent généralement la cohérence entre le prompt et l'image, en particulier pour les scènes compositionnelles complexes où les objets doivent s'articuler correctement dans l'espace 3D.
Veo, le modèle vidéo IA de Google, a reçu des mises à jour dans le lot de juillet. Google n'a pas détaillé publiquement chaque aspect technique, mais le récapitulatif de juillet présente les améliorations comme faisant partie d'une poussée plus large visant à rendre la vidéo IA plus utilisable sur les surfaces grand public et développeur. Pour les créateurs qui expérimentent déjà la vidéo IA, Veo reste l'un des rares modèles offrant une véritable qualité cinématographique sur des durées plus longues — toute amélioration de capacité compte lorsqu'on le compare à ses concurrents. Si vous évaluez vos options, le paysage des outils de génération vidéo IA a évolué rapidement cette année.
Un thème récurrent dans les annonces de juillet de Google est l'inférence embarquée — exécuter des modèles IA localement sur le matériel Pixel et d'autres appareils Android plutôt que d'acheminer chaque requête vers les centres de données de Google. Pour la génération d'images et de vidéos en particulier, le traitement embarqué peut signifier une latence plus faible et moins d'allers-retours vers le cloud, bien que la contrepartie soit la taille du modèle : les modèles de génération les plus performants nécessitent encore du calcul côté serveur. Google navigue entre ces deux exigences en maintenant la génération lourde dans le cloud tout en déchargeant les tâches plus légères — suggestions de style, affinement des prompts, suréchantillonnage — vers l'appareil. Cette architecture partagée mérite d'être suivie, car elle pourrait à terme permettre aux créateurs d'itérer plus rapidement sur les prompts sans consommer de quota API.
Google a également annoncé des outils IA destinés à l'éducation et à aider les personnes à s'épanouir dans une économie augmentée par l'IA — des catégories qui peuvent sembler éloignées de la génération d'images, mais qui reflètent la façon dont Google positionne Gemini comme une infrastructure sur toutes les surfaces, et pas seulement comme un chatbot. Plus Gemini s'améliore en tant que raisonneur général, mieux il se comporte comme backend pour les outils créatifs construits sur l'écosystème Google.
Pour les créateurs utilisant directement les outils de Google — que ce soit via la génération d'images IA ou des applications tierces construites sur les API Gemini — les mises à jour de juillet représentent une progression incrémentale mais constante. Aucune annonce n'est un changement radical, mais la tendance est claire : Google resserre l'intégration entre ses modèles de fondation, son matériel et ses applications grand public. Les créateurs qui construisent des flux de travail sur l'écosystème Google doivent s'attendre à ce que la répartition entre embarqué et cloud devienne plus marquée d'ici la fin de 2026, la génération la plus performante restant liée au cloud tandis que les assistances créatives du quotidien se rapprochent du matériel.
Le prochain test sera de savoir si les améliorations de juillet de Veo se manifestent dans les intégrations tierces — c'est là que la plupart des créateurs les rencontreront réellement.