連邦裁判所は、Claudeの訓練に使用された書籍をめぐる著作者および出版社とのAnthropicの15億ドルの和解を承認した。これは記録上最大の著作権集団訴訟の支払額である。報道各社は見出しの数字と、この和解が著作権で保護された作品での訓練が合法かどうかを決着させることなく一つの訴訟を終結させたことで一致している。より詳細な報道では、William Alsup判事が退任前に予備承認を行い、後任が最終承認することになったと付け加えている。経営幹部にとって重要なのは判決ではなく、それが保留した先例である。これは価格であり、判決ではない。

戦略的シグナルは、無許可データが隠れた法的責任から定量化可能なビジネスコストへと移行したことである。1作品あたり約3,000ドルという金額は、最先端の訓練の経済性を再定義する。自由にスクレイピングしていたラボは今や遡及的な税金に直面し、一方でライセンスを事前交渉していた企業(OpenAI-News Corp、Google-Reddit、Amazon-NYT)は過剰に慎重ではなく先見の明があったように見える。コンテンツの急速な価格再設定が予想される。出版社、画像ライブラリ、音楽カタログは今や実証された下限価値を持ち、Getty、Reddit、Shutterstock、主要出版社は次回の契約交渉で優位に立つ。

競争上の帰結は、資本力のある企業の堀が広がることである。大規模なデータライセンスは、8桁や9桁のコンテンツ料金を吸収できないスタートアップよりも、Microsoftが支援するOpenAI、Google、Amazonが支援するAnthropic、Metaに有利に働く。これにより小規模な構築者は合成データ、許諾的にライセンスされたコーパス、QwenやKimiなどのオープンウェイト中国モデルへと向かい、すでに市場を不安定化させている構築vs購入と主権をめぐる議論を加速させる。

推奨される行動:訓練データの出所を取締役会レベルのリスクとして扱うこと。無許可の著作権保護素材についてコーパスを監査し、遡及的ライセンスの予算を組み、モデルベンダー契約に知的財産補償条項を挿入すること。投資家はデータ系統を文書化できないラボを割り引き、コンテンツ所有者の株式を上方修正すべきである。サードパーティモデルを導入する企業は、訓練データがライセンスされているか防御可能であるという書面による保証を要求すべきである。

未解決の問題は管轄権である。米国の和解はEU、英国、日本を拘束せず、そこではフェアユースの論理は適用されず、テキストおよびデータマイニング規則が異なる。グローバル事業者は最も厳格な制度が支配すると想定し、単一のクリアリング価格ではなく断片化したライセンスマップに備えるべきである。