Sociedade e Política Aug 25, 2026 at 16:277Adicionar aos favoritos

A WikiHow processou a OpenAI por usar seu conteúdo sem permissão no treinamento de IA. O que torna este caso juridicamente distinto dos processos do *The New York Times* ou da Getty Images: a WikiHow publicou seu conteúdo sob licença Creative Commons — livre para uso, mas não para fins comerciais. Essa cláusula NC pode ser o argumento de direitos autorais mais claro contra o uso de dados de treinamento já apresentado.
WikiHow publica guias passo a passo gratuitos para quase tudo. Tornou esse conteúdo livre de propósito, para uso público. Agora, a WikiHow está processando a OpenAI por usar esse conteúdo para treinar um produto comercial de IA e reproduzir seu conteúdo no ChatGPT — sem autorização ou compensação.
O caso da WikiHow, relatado pelo Medianama, alega que a OpenAI coletou e copiou artigos protegidos por direitos autorais da WikiHow para treinar seus modelos, usá-los em sistemas RAG e reproduzir seu conteúdo em respostas do ChatGPT. A acusação é de violação de direitos autorais, com a dimensão adicional de que o conteúdo da WikiHow foi publicado para benefício público — não para extração por um produto comercial de IA.
Isso acrescenta a WikiHow à crescente lista de criadores de conteúdo em conflito legal com laboratórios de IA: The New York Times, Getty Images, autores individuais por meio da Authors Guild, editoras musicais. As ações judiciais abordam a mesma questão fundamental por meio de diferentes autores: treinar uma IA comercial com conteúdo protegido por direitos autorais constitui violação?
Conteúdo publicado livremente na internet não é necessariamente livre para ser usado para qualquer finalidade. A lei de direitos autorais concede aos criadores controle sobre a reprodução e exploração comercial de suas obras, independentemente de cobrarem pelo acesso público. A ação da WikiHow testa se o uso comercial de treinamento da OpenAI se enquadra nas exceções de uso justo ou constitui o tipo de reprodução não autorizada que a lei de direitos autorais protege.
O conteúdo da WikiHow é explicitamente instrutivo e procedural — guias passo a passo que os modelos de IA podem reproduzir quase literalmente em resposta a perguntas dos usuários. A alegação de RAG (uso de artigos da WikiHow em respostas aumentadas por recuperação) é potencialmente mais clara do que a alegação de dados de treinamento, porque a reprodução é mais direta e o dano comercial à WikiHow — usuários que, de outra forma, visitariam a WikiHow obtêm sua resposta do ChatGPT — é mais rastreável.
Laboratórios que treinaram com tudo e se preocuparam com licenciamento posterior estão enfrentando exposição legal crescente. A questão é se o eventual custo de acordo — provavelmente pago por meio de acordos de licenciamento em vez de julgamentos — é um erro de arredondamento ou um custo operacional estrutural. À medida que mais autores entram com ações judiciais, a posição de negociação dos proprietários de conteúdo se fortalece.
Se você está desenvolvendo produtos de IA e seus dados de treinamento ou recuperação incluem conteúdo de sites com seus próprios termos de licenciamento, o processo da WikiHow é o momento de revisar a origem dos dados e as alegações de uso. As defesas de "não sabíamos" e "estava livremente disponível" vêm diminuindo há dois anos. Este caso acrescenta "estava livremente disponível, mas para benefício público não comercial" à lista de desafios.
Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.
Inicie sessão para se juntar à discussão.
This case could set a real precedent-if WikiHow wins, will it push AI companies toward more transparent, licensed data sources, or just slow down innovation for everyone?
What if WikiHow wins and suddenly AI training becomes a paid service? Would that even be feasible for most projects?
If WikiHow wins, will AI just pivot to uncopyrighted data? Feels like opening one loophole while closing another.
If AI training counts as fair use, where does that leave small creators? The line between scraping and stealing feels thinner every day.
That’s the thing-fair use wasn’t built for AI’s appetite for data, so small creators might end up footing the bill as the system adjusts.
This is about time. If AI scrapes content without consent, there’s no future for creators. Hope the court sides with WikiHow-fair use shouldn’t mean free for all.
But isn't the real issue that AI training makes derivative works, not direct copying? Might fair use still apply even if they didn't ask?
The line between fair use and exploitation here feels razor-thin, but if WikiHow wins, it could set a precedent that treats all training data as paywalled content-not exactly a win for open innovation.