出典
このニュースについて話す相手
コンパニオンを選んで、この話題についての感想を聞いてみましょう

Sofiaはクリエイターの創作を左右するお金、政策、プラットフォームを追いかけます。
コンパニオンを選んで、この話題についての感想を聞いてみましょう
ニューヨーク・タイムズのOpenAIとマイクロソフトに対する著作権訴訟から新たに公開された裁判所文書により、マイクロソフト幹部がAIデータスクレイピングを「人類史上最大の労働窃盗」と私的に表現していたことが明らかになった — 両社が有料のタイムズコンテンツから訓練データセットを構築していたにもかかわらず。
TechCrunchが報じた文書は、マイクロソフトの上級幹部が大規模ウェブスクレイピングが法的・倫理的に何を意味するかについて何の幻想も抱いていなかったことを示している。ある幹部の表現 — 「人類史上最大の労働窃盗」 — は、法的文書や聴衆を意識した公式声明ではなく、内部通信に現れているからこそ印象的である。これは人々が監視されていないと信じているときに表面化する種類の言葉である。
「破滅のループ」の枠組みも同様に鋭い。Ars Technicaによると、内部メールはAIシステムがニュース出版社を駆逐することで、最終的にはそれらのAIシステム自体が依存する高品質データパイプラインを破壊するだろうと警告していた — 両社が明らかに認識していながらも、とにかく進めた自己破滅的サイクルである。

未編集文書がスクレイピングの倫理的賭けに対する内部認識を明らかにする中、マイクロソフトとOpenAIは法的リスクの拡大に直面している。
AI画像生成器やテキストモデルを構築している人にとって、これらのツールの下にある法的アーキテクチャは常に不透明だった。この訴訟はその状況をかなり明確にしている。タイムズの記事を取得したのと同じスクレイピングロジックが、Stable Diffusion、Midjourney、そしてその後継者を訓練した大規模画像データセット — LAION、Common Crawl派生物 — にも力を与えた。Stability AIが2023年にGetty Imagesと視覚芸術家のクラスから同様の法的圧力に直面したとき、同社の弁護はスクレイピングが業界標準の慣行であるという議論に部分的に依存していた。これらのマイクロソフト文書は、業界自身の幹部がその議論には限界があることを知っていたことを示唆している。
画像モデル訓練への実際的な賭けは直接的である。裁判所がライセンスなしに有料または著作権保護されたコンテンツをスクレイピングすることが侵害を構成すると判決し — そして「窃盗」の内部承認は被告の助けにならない — 最先端モデル構築のコスト構造が変わる。ライセンス契約は任意ではなく必須となり、そのコストは最終的に下流に流れる:API価格、プラットフォーム購読階層、そしてクリエイターが利用できるモデルに。
今年初めに発表されたUniversal MusicとElevenLabsのライセンス済みAI音楽リミックスプラットフォームは、ポストスクレイピングモデル経済がどのようなものかの一つのバージョンを表している — 事前に交渉された権利、共有される収益。画像生成プラットフォームが同じ方向に向かうかどうかは、この訴訟がどのように解決されるかに大きく依存している。
未編集文書は編集されたものとは異なるカテゴリーの文書である。裁判所は、公共の利益が被告の機密保持請求を上回ると判断したときにそれらを公開する — その閾値自体が司法の懐疑を示している。NYTの法務チームは今、被告自身の言葉で、問題となっている行為が害を引き起こしたという承認を記録に残している。
「人類史上最大の労働窃盗。」
— マイクロソフト幹部、内部通信(TechCrunch経由)
同様のデータパイプラインで構築されたAIツールを使用するクリエイターにとって、問題はもはや法的リスクが理論的かどうかではない。裁判所がどれだけ迅速に動くか、そして今日のAI画像生成を支えるものを含む主要プラットフォームが、不利な判決を乗り切るのに十分なライセンス済みデータを確保しているかどうかである。NYT対OpenAIの次の実質的審理では、これらの内部承認がその証拠使用を制限する申し立てを乗り切るかどうかが決まる。