出典
このニュースについて話す相手
コンパニオンを選んで、この話題についての感想を聞いてみましょう

Eliasは見出しの裏にある研究を、わかりやすい言葉でひもときます。
コンパニオンを選んで、この話題についての感想を聞いてみましょう

OpenAIはChatGPTモバイルアプリに専用のWorkタブを追加し、ProおよびPlusサブスクライバーが音声だけでマルチステップのエージェンティックタスク――モデルが自律的に実行する一連のアクション――をトリガーできるようにした。
エージェンティックタスクを平たく言えば、モデルが質問に答えるだけでなく、目標を達成するために一連のアクションを実行することを意味する。ドキュメントの下書き、ウェブ検索、結果の要約、そして出力の送信を順番に行う、といった具合だ。これまでChatGPTでのそのようなワークフローはデスクトップで管理する方が容易だった。Workタブはそれらの機能を単一のモバイル専用スペースに集約し、音声入力が主要なインターフェースとなる。
この実用的な変化は意義深い。参考画像をリサーチしたり、ムードボードの説明をまとめたり、通勤中にクライアントブリーフを下書きしたいクリエイターは、小さな画面でタイプする代わりにリクエストを話しかけるだけでよくなる。モデルがシーケンスを処理する。

ProおよびPlusサブスクライバー向けに音声駆動型エージェンティック機能を提供するChatGPTモバイルアプリの新しいWorkタブ。
TechCrunchによると、Workタブはエージェンティックな用途に特化してスコープされており、汎用チャットの再設計ではなく、タスク完了のために目的を持って構築されたスペースだという。この区別は重要だ。OpenAIは、エージェンティックワークフローが会話型チャットとは別のプロダクトサーフェスであり、設定に埋もれた高度なモードではないことを示している。
ProおよびPlusサブスクライバーがアクセス可能で、無料ユーザーは対象外だ。これはOpenAIがよりコンピューティング集約型の機能を展開してきた方法と一致している――エージェンティックタスクチェーンはリソースを多く消費し、音声処理がさらに別のレイヤーを加える。この格差は少なくとも当初は実質的な対象者を絞り込む。
有料ChatGPT階層のクリエイターにとって、当面の疑問はこれがデスクトップのエージェンティックワークフローを置き換えるのか補完するのかという点だ。発表内容に基づく答えは、補完するというものだ。Workタブはデスクトップで利用できない機能を導入するのではなく、モバイルに同等の機能をもたらす。価値は利便性と音声にあり、新たな基盤的な能力ではない。
OpenAIはモデルラインナップを着実に拡充しており――今年初めのGPT-6 SolおよびLunaのリリースでは、同社が能力とコストの両面を同時に推し進めていることが示された――Workタブはそのパターンに合致している。より多くのサーフェスとインタラクションモードに同じコア機能を展開するというものだ。
音声という側面はそれ自体で注目に値する。音声ベースのエージェンティック制御は、プロンプトをタイプするのとは異なるインタラクションモデルであり、どのような種類のタスクを委任することが自然に感じられるかを変える。短く、スコープが明確なリクエスト――「これら3つのリンクを要約して1段落の説明を下書きして」――は音声に適している。複雑で反復的なプロンプトエンジニアリングはそうではない。
AIアートクリエイターに特化して言えば、Workタブはプロジェクトのリサーチと整理の側面――参考資料の収集、ブリーフの作成、クライアントとのコミュニケーション管理――に最も役立つことが示唆される。画像生成のステップ自体は依然として専用ツールで行われる。それらのツールで何ができるかを探求するクリエイターは、生成側で現在利用可能なものの参考としてCharmloopモデルカタログが役立つだろう。
まだ不明な点は、音声インターフェースが修正と反復をどれほどうまく処理できるかだ――クリエイターが「やっぱり、もっと短くして」と言ってモデルがタスクの途中で修正できるのか、それとも各音声コマンドが新しいシーケンスを開始するのか。OpenAIはまだ修正モデルを公式に詳述しておらず、それが実際にモバイルワークフローがどれほど流動的に感じられるかを左右するだろう。
Workタブの展開は標準アプリアップデートを通じて現在進行中だ。機能が届く前にエージェンティックプロンプティングが標準プロンプティングとどう異なるかを把握したいクリエイターは、Charmloopガイドで基礎を学ぶことができる。