Choisissez un compagnon et découvrez son avis sur cette histoire
Articles similaires
OpenAI a lancé ChatGPT Images 2.5 mardi, et sa fonctionnalité phare — Sketch — vous permet de tracer une forme approximative directement dans la fenêtre de chat, puis de décrire en texte comment vous souhaitez la transformer en image finalisée.
Points clés
ChatGPT Images 2.5 est un nouveau modèle de génération d'images d'OpenAI, annoncé mardi.
Sketch est un nouveau mode de saisie qui accepte des gribouillis dessinés à la main dans ChatGPT comme point de départ visuel pour la génération d'images.
Les utilisateurs dessinent dans la fenêtre de chat et ajoutent une invite textuelle décrivant le résultat souhaité ; ChatGPT génère le rendu.
Sketch transfère le contrôle de la composition du texte seul vers une combinaison de dessin spatial et de langage — un changement significatif pour quiconque pense visuellement.
La fonctionnalité est disponible dans ChatGPT ; aucun outil séparé ni flux de téléchargement n'est requis.
Du gribouillis de serviette à l'image rendue
Le flux de travail est plus simple qu'il n'y paraît. Vous dessinez quelque chose — une silhouette de chat approximative, un plan de pièce, une figure dans un paysage — directement dans l'interface ChatGPT, puis vous tapez ce que vous souhaitez que l'image finalisée ressemble. Le modèle interprète votre intention spatiale et génère le rendu en conséquence, selon The Verge.
Une image d'un chat générée par IA produite par ChatGPT Images 2.5 à partir d'un croquis dessiné à la main.
Pour les créateurs d'art IA, le changement pratique ici concerne le contrôle de la composition. Les invites textuelles sont précises quant au sujet et au style, mais notoirement imprécises quant à l'arrangement spatial — placer une figure dans le tiers gauche du cadre, ou une ligne d'horizon à une hauteur spécifique, a toujours nécessité soit des contournements par inpainting, soit une ingénierie d'invite élaborée. Sketch remet ce contrôle entre les mains du créateur, littéralement. Un gribouillis de dix secondes peut résoudre ce que trois paragraphes de texte d'invite ne peuvent pas.
L'interface Sketch de ChatGPT Images 2.5, montrant une saisie dessinée à la main transformée en image IA rendue.
La filiation mérite d'être nommée : c'est la logique du rough de bande dessinée, de la vignette de l'animateur, du dessin gestuel sous-jacent qui ancre la composition visuelle depuis la Renaissance. Sketch ne remplace pas cette tradition — il numérise la première étape et confie le rendu à un modèle.
Ce qui change pour la pratique des invites
Les créateurs qui s'appuient actuellement sur l'inpainting, les références de pose de style ControlNet, ou les flux image-vers-image pour corriger la composition spatiale disposent désormais d'une alternative native et peu contraignante dans ChatGPT. Le gribouillis n'a pas besoin d'être bon — c'est tout l'intérêt. Le modèle lit l'intention, pas la maîtrise du dessin.
Cela dit, le plafond de qualité de toute approche basée sur le croquis dépend de la capacité du modèle d'image sous-jacent à interpréter une saisie spatiale approximative. ChatGPT Images 2.5 est un nouveau modèle, pas simplement une couche d'interface sur un modèle existant, donc sa fidélité aux repères spatiaux devra être testée sur de vraies tâches créatives. Les créateurs habitués à la précision d'outils dédiés comme ControlNet ou le prompting régional de Stable Diffusion devraient considérer Sketch comme un point de départ pour l'itération rapide plutôt que comme un pipeline de production finale.
Pour quiconque construit des personnages ou des scènes sur Charmloop, Sketch pourrait compresser la phase de conception initiale — ébaucher une pose ou un plan de scène avant de s'engager dans une exécution complète de génération d'images. Les guides sur /learn couvrent des techniques d'invite axées sur la composition qui s'associent naturellement à ce type de saisie spatiale.
La question d'auteur que Sketch soulève discrètement
Lorsque le squelette compositionnel d'une image provient d'une main humaine — même maladroite — et que le modèle remplit chaque détail de surface, la question de la paternité créative devient véritablement intéressante. Sketch remet davantage de décisions génératives entre les mains du créateur qu'une invite purement textuelle, ce qui compte tant sur le plan esthétique que, de plus en plus, juridique. Le dessin vous appartient ; le rendu appartient au modèle. Cette séparation est plus nette que ce que la plupart des flux de travail d'images IA proposent.
OpenAI n'a pas détaillé les spécificités tarifaires d'Images 2.5 au-delà de sa disponibilité dans ChatGPT. Les créateurs évaluant le choix de modèle pour des travaux à forte composition ont désormais une raison concrète de le tester aux côtés de leurs outils existants.