出典
このニュースについて話す相手
コンパニオンを選んで、この話題についての感想を聞いてみましょう

IrisはAIアートと文化が交わる場所を取材 — スタイル、作者性、そして時代を映す作品を追います。
コンパニオンを選んで、この話題についての感想を聞いてみましょう
OpenAIは火曜日にChatGPT Images 2.5を発表した。目玉機能である「Sketch」は、チャットウィンドウ内に直接ラフなスケッチを描き、テキストで仕上がりのイメージを説明するだけで完成画像を生成できる。
ワークフローは聞こえるよりもシンプルだ。ChatGPTのインターフェース内に何かを描く——猫のラフなシルエット、部屋のレイアウト、風景の中の人物など——そして完成画像のイメージをテキストで入力する。モデルはあなたの空間的な意図を解釈してレンダリングする、とThe Vergeが伝えている。

手描きスケッチからChatGPT Images 2.5が生成した猫のAI画像。
AIアートクリエイターにとって、ここでの実質的な変化は構図コントロールに関するものだ。テキストプロンプトは被写体やスタイルについては精密だが、空間的な配置については悪名高いほど曖昧だ——フレームの左三分の一に人物を配置したり、特定の高さに地平線を設定したりするには、インペインティングの回避策や複雑なプロンプトエンジニアリングが常に必要だった。Sketchはそのコントロールを、文字通りクリエイターの手に返す。10秒の落書きが、3段落分のプロンプトテキストでも解決できなかった問題を修正できる。

ChatGPT Images 2.5のSketchインターフェース。手描きの入力がレンダリングされたAI画像に変換される様子を示している。
ここで言及する価値のある系譜がある。これはアニメーターのサムネイル、ルネサンス以来視覚的な構図を支えてきたジェスチャーの下描きという、カートゥーンのラフスケッチの論理だ。Sketchはその伝統を置き換えるのではなく、その最初のステップをデジタル化し、レンダリングをモデルに委ねる。
現在、空間的な構図を修正するためにインペインティング、ControlNet式のポーズ参照、またはimage-to-imageワークフローに頼っているクリエイターは、ChatGPT内にネイティブで摩擦の少ない代替手段を手に入れた。落書きが上手である必要はない——それがポイントだ。モデルが読み取るのは意図であり、画力ではない。
とはいえ、スケッチベースのアプローチの品質の上限は、基盤となる画像モデルがゆるやかな空間入力をどれだけうまく解釈できるかにかかっている。ChatGPT Images 2.5は既存モデルのUIレイヤーではなく新しいモデルであるため、空間的な手がかりへの忠実度は実際のクリエイティブタスクでテストする必要がある。ControlNetやStable Diffusionのリージョナルプロンプティングなど専用ツールの精度に慣れているクリエイターは、Sketchを最終出力パイプラインではなく、高速イテレーションの出発点として扱うべきだ。
Charmlooopでキャラクターやシーンを制作している人にとって、Sketchはコンセプト初期段階を短縮できる可能性がある——本格的な画像生成に着手する前に、ポーズやシーンレイアウトをラフに描くことができる。/learnのガイドでは、この種の空間入力と相性の良い構図重視のプロンプティング技法を紹介している。
画像の構図的な骨格が——たとえ不器用であっても——人間の手から生まれ、モデルがすべての表面的な詳細を埋める場合、クリエイティブなオーサーシップの問題は真に興味深いものになる。Sketchは純粋なテキストプロンプトよりも多くの生成的な意思決定をクリエイターの手に戻す。これは美的にも、そしてますます法的にも重要な意味を持つ。描画はあなたのもの、レンダリングはモデルのもの。この分離は、ほとんどのAI画像ワークフローが提供するものよりも明確だ。
OpenAIはChatGPT内での利用可能性以外に、Images 2.5の価格詳細を明らかにしていない。構図重視の作業でモデル選択を検討しているクリエイターは、既存のツールと並行してテストする具体的な理由ができた。