
Sofiaはクリエイターの創作を左右するお金、政策、プラットフォームを追いかけます。
無料。いつでも配信停止できます。
コンパニオンを選んで、この話題についての感想を聞いてみましょう

USA Today Co.および傘下の複数の地方紙が、AIモデルの学習に同社の記事数十万件を無断でスクレイピング・コピーしたとして、OpenAIを2億5000万ドル超で提訴した。これは、市場に出回るあらゆるAIテキストモデルの法的基盤を着実に狭めつつある、大手出版社による一連の訴訟の最新事例である。
この損害賠償額は偶然の産物ではない。ニューヨーク・タイムズが2023年末にOpenAIを提訴した際、具体的な金額は示さず「数十億ドル」を求めるにとどまった。USA Today Co.が明示した2億5000万ドルという要求は戦略的な選択であり、主張するコピーの規模に基づいた具体的かつ防御可能な数字だ。陪審員に判断の基準点を与えるとともに、出版社が失われたライセンス価値を算出済みであることを示している。
この訴訟は旗艦紙USA Todayだけでなく、USA Today Co.が所有する地方紙も対象としている。これは重要な点だ。なぜなら、地方報道は歴史的に学習コーパスの地味な根幹を担ってきたからである。AIの出力を根拠があり権威あるものに聞こえさせる、まさにそのような地域密着型で大量の事実に基づくテキストこそが問題の核心だ。出版社はこれを理解しており、それに見合った価格設定を進めている。
ニューヨーク・タイムズ、シカゴ・トリビューングループ、そして今回のUSA Today Co.——訴訟当事者のリストはもはや「孤立した紛争」という説明が通用しないほど長くなった。新たな訴状が提出されるたびに、出版社コンテンツを業界全体でスクレイピングする慣行が、善意ある行為者が誠実に対処できる法的グレーゾーンではなく、訴訟コストがライセンスコストを下回るという計算に基づいた賭けであったことを示す証拠が積み重なっていく。
その賭けは四半期ごとに分が悪くなっている。OpenAIはAssociated PressやAxel Springerなど一部の出版社とライセンス契約を締結しているが、条件は開示されておらず、有償契約の存在は無償スクレイピングに対するフェアユース論拠をむしろ損なう可能性がある。ライセンスが利用可能だったなら、なぜ使わなかったのか?
参考として、Stability AIは2023年にアーティストやGetty Imagesから画像学習データをめぐって提訴され、同様の圧力に直面した。この紛争は同社を数年にわたる法的不確実性に追い込み、経営陣の交代にも影響した。テキストモデルをめぐる現在の状況は、かつての画像データをめぐる争いと酷似した軌跡をたどっている。
AIアート制作者にとっての実際的な影響は間接的だが、確かに存在する。ChatGPTなどのツールにおけるプロンプト解釈、キャラクター描写、スタイルガイダンスを支えるテキストモデル——これらは業界全体の画像生成ワークフローに組み込まれているが——は、現在法的審査を受けているのと同じ学習パイプライン上に構築されている。裁判所が差し止め命令を出したりデータ削除を命じたりし始めれば、次世代のマルチモーダルモデルは意図的に貧弱なテキストコーパスを持つことになり、繊細なクリエイティブプロンプトの解析能力に影響が出る可能性がある。
OpenAI自身のEUウォーターマーキングとコンプライアンスをめぐる最近の動向は、同社がすでにより法的に慎重な姿勢で事業を運営していることを示唆している。著作権訴訟はその同じ圧力のもう一つの側面だ。問題は、法的和解が学習データのサプライチェーンを安定させるライセンスの枠組みを生み出すのか、それとも包括的な契約を結べる資本力のある大手に有利な形でサプライチェーンを分断し、小規模なモデル開発者が競争できなくなるのか、という点だ。
アダム・シフ上院議員による議会におけるAI著作権の膠着状態に関する最近の見解は、AI企業への立法的救済が近い将来には期待できないことを明確にしている。そのため、裁判所が主要な舞台となり、USA Today Co.の2億5000万ドルの提訴は、出版社が積極的にそれを活用する意図を持っていることを示す最新の証拠となっている。
次に注目すべき具体的な節目は、OpenAIが証拠開示手続きが始まる前に訴えの棄却を申し立てるか、和解を試みるかどうかだ。証拠開示は、どのデータがいつ使用されたかの正確な開示を強制するものであり、同社が最も失うものが大きいプロセスだからである。