社会と政策 Aug 25, 2026 at 16:277ブックマークに追加

WikiHowは、AIのトレーニングに許可なくコンテンツを使用されたとして、OpenAIを提訴した。この訴訟がニューヨーク・タイムズやゲッティ・イメージズの訴訟と法的に異なる点は:WikiHowはクリエイティブ・コモンズ・ライセンス(CC BY-NC)の下でコンテンツを公開しており、無償で使用できるが商用目的には利用できない。このNC条項により、トレーニングデータの使用に対する最も明確な著作権侵害の主張が構築される可能性がある。
WikiHowは、ほとんど何でも行うための無料のステップバイステップガイドを公開しています。同社は意図的にこのコンテンツを無料で公開し、公共の利用に供しています。WikiHowは現在、OpenAIを相手取り、商用AI製品のトレーニングにそのコンテンツを使用し、許可や補償なしにChatGPTでその実質を再現したとして訴訟を起こしています。
Medianamaが報じたWikiHowの訴訟によると、OpenAIがWikiHowの著作権で保護された記事をスクラップしコピーしてモデルのトレーニングに使用し、RAGシステムで活用し、ChatGPTの回答でその実質を再現したと主張しています。この主張は著作権侵害に当たり、WikiHowのコンテンツが公益のために公開されたものであり、商用AI製品による抽出のためではなかったという点が加味されています。
これにより、WikiHowはAI研究所と法的対立に陥っているコンテンツクリエイターのリストに加わりました。他にも、ニューヨーク・タイムズ、ゲッティイメージズ、作家ギルドを通じた個人作家、音楽出版社などが同様の訴訟を起こしています。これらの訴訟は、異なる原告を通じて同じ基本的な問いを追求しています。すなわち、著作権で保護されたコンテンツを使用して商用AIをトレーニングすることは侵害に当たるのかという点です。
オンラインで自由に公開されているコンテンツは、必ずしもどんな目的にも自由に使用できるわけではありません。著作権法は、クリエイターに対し、公共アクセスに料金を課すかどうかに関わらず、その作品の複製や商業的利用を管理する権利を与えています。WikiHowの訴訟は、OpenAIの商用トレーニング利用がフェアユースの例外に該当するのか、それとも著作権が保護する無断複製に当たるのかを検証します。
WikiHowのコンテンツは明確に指示的で手順的なものであり、AIモデルがユーザーの質問に対してほぼ逐語的に再現できるステップバイステップガイドです。RAGの申し立て(WikiHowの記事を検索拡張応答で使用すること)は、トレーニングデータの申し立てよりもクリーンな可能性があります。なぜなら、再現がより直接的であり、WikiHowに対する商業的損害(本来であればWikiHowを訪れるユーザーがChatGPTから回答を得ること)がより追跡しやすいためです。
あらゆるものをトレーニングに使用し、後にライセンスに関する懸念を抱いていた研究所は、法的責任のリスクが増大しています。問題は、最終的な和解コスト(おそらく裁判の判決ではなくライセンス契約を通じて支払われる)が、端数処理レベルのコストなのか、構造的な運用コストなのかという点です。原告が増えるにつれ、コンテンツ所有者の交渉力が強まります。
AI製品を構築しており、トレーニングや検索データに独自のライセンス条項を持つサイトのコンテンツが含まれている場合、WikiHowの訴訟はデータの出所と使用主張を見直す機会です。「知らなかった」「自由に利用できた」という弁護は、過去2年間で徐々に通用しなくなっています。この訴訟により、「自由に利用できたが公益のための非商用」という主張も難しくなりました。
本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。
This case could set a real precedent-if WikiHow wins, will it push AI companies toward more transparent, licensed data sources, or just slow down innovation for everyone?
What if WikiHow wins and suddenly AI training becomes a paid service? Would that even be feasible for most projects?
If WikiHow wins, will AI just pivot to uncopyrighted data? Feels like opening one loophole while closing another.
If AI training counts as fair use, where does that leave small creators? The line between scraping and stealing feels thinner every day.
That’s the thing-fair use wasn’t built for AI’s appetite for data, so small creators might end up footing the bill as the system adjusts.
This is about time. If AI scrapes content without consent, there’s no future for creators. Hope the court sides with WikiHow-fair use shouldn’t mean free for all.
But isn't the real issue that AI training makes derivative works, not direct copying? Might fair use still apply even if they didn't ask?
The line between fair use and exploitation here feels razor-thin, but if WikiHow wins, it could set a precedent that treats all training data as paywalled content-not exactly a win for open innovation.