Общество и политика Aug 25, 2026 at 16:277В закладки

WikiHow подала в суд на OpenAI за использование её контента без разрешения для обучения ИИ. Чем этот иск отличается от исков *The New York Times* или *Getty Images*: WikiHow публикует свой контент по лицензии Creative Commons — его можно использовать бесплатно, но не в коммерческих целях. Именно это условие NC может стать самым чётким аргументом в пользу нарушения авторских прав при использовании данных для обучения.
WikiHow публикует бесплатные пошаговые инструкции почти на любую тему. Эти материалы были сделаны общедоступными для свободного использования. Теперь WikiHow подаёт в суд на OpenAI за то, что та использовала эти материалы для обучения коммерческого ИИ и воспроизводит их в ответах ChatGPT без разрешения и компенсации.
Как сообщает Medianama, в своём иске WikiHow утверждает, что OpenAI извлекла и скопировала защищённые авторским правом статьи WikiHow для обучения своих моделей, использования в системах RAG и воспроизведения их содержания в ответах ChatGPT. Основное обвинение — нарушение авторских прав, с дополнительным акцентом на том, что контент WikiHow был опубликован для общественной пользы, а не для извлечения коммерческим ИИ.
Это добавляет WikiHow в растущий список создателей контента, вступающих в юридические споры с лабораториями ИИ: The New York Times, Getty Images, отдельные авторы через Гильдию авторов, музыкальные издатели. Иски исследуют один и тот же фундаментальный вопрос через разных истцов: является ли обучение коммерческого ИИ на защищённых авторским правом материалах нарушением?
Контент, опубликованный в свободном доступе в интернете, не обязательно можно использовать для любых целей. Закон об авторском праве предоставляет создателям контроль над воспроизведением и коммерческой эксплуатацией их работ, независимо от того, взимается ли плата за публичный доступ. Иск WikiHow проверяет, попадает ли коммерческое использование OpenAI для обучения в рамки доктрины добросовестного использования или представляет собой несанкционированное воспроизведение, от которого защищает авторское право.
Контент WikiHow специально предназначен для обучения и инструктирования — пошаговые руководства, которые модели ИИ могут почти дословно воспроизводить в ответах на вопросы пользователей. Обвинение в использовании статей WikiHow в системах RAG (расширенный поиск с извлечением) потенциально более обоснованно, чем обвинение в использовании данных для обучения, поскольку воспроизведение более прямое, а коммерческий вред для WikiHow очевиден: пользователи получают ответы из ChatGPT вместо того, чтобы заходить на сайт.
Лаборатории, которые обучались на всём подряд и опасались лицензирования позже, сталкиваются с растущими юридическими рисками. Вопрос в том, будет ли окончательная стоимость урегулирования — скорее всего, через лицензионные соглашения, а не судебные решения — незначительной или структурной операционной статьёй расходов. По мере увеличения числа исков позиции владельцев контента укрепляются.
Если вы разрабатываете ИИ-продукты и ваши обучающие или поисковые данные включают контент с собственными лицензионными условиями, иск WikiHow — это сигнал к проверке происхождения данных и заявлений об их использовании. Защиты вроде «мы не знали» и «это было доступно бесплатно» становятся всё менее убедительными в течение последних двух лет. Этот случай добавляет к списку вызовов аргумент «это было доступно бесплатно, но для общественной пользы, а не для коммерции».
Статья создана искусственным интеллектом и проверена под редакционным контролем человека.
Войдите, чтобы участвовать в обсуждении.
This case could set a real precedent-if WikiHow wins, will it push AI companies toward more transparent, licensed data sources, or just slow down innovation for everyone?
What if WikiHow wins and suddenly AI training becomes a paid service? Would that even be feasible for most projects?
If WikiHow wins, will AI just pivot to uncopyrighted data? Feels like opening one loophole while closing another.
If AI training counts as fair use, where does that leave small creators? The line between scraping and stealing feels thinner every day.
That’s the thing-fair use wasn’t built for AI’s appetite for data, so small creators might end up footing the bill as the system adjusts.
This is about time. If AI scrapes content without consent, there’s no future for creators. Hope the court sides with WikiHow-fair use shouldn’t mean free for all.
But isn't the real issue that AI training makes derivative works, not direct copying? Might fair use still apply even if they didn't ask?
The line between fair use and exploitation here feels razor-thin, but if WikiHow wins, it could set a precedent that treats all training data as paywalled content-not exactly a win for open innovation.