wikiHow 起诉 OpenAI,指控其未经许可抓取了超过 11000 篇文章用于训练 GPT 系列模型。
诉状里的直接主张是至少 1200 项已注册版权被侵犯。但更值得看的是背后那个更大的论点:wikiHow 这类站点的商业模式建立在人们通过搜索找到它们、点进去、看广告的链路上,而聊天机器人直接把答案给了用户,链路断了。
wikiHow 的内容形态在这件事里挺典型的。它就是怎么做某件事的步骤化说明——怎么换轮胎、怎么去掉衣服上的油渍、怎么折纸鹤。这恰好是聊天机器人最擅长、也最常被问到的问题类型。一个模型学完 wikiHow,几乎就完全替代了 wikiHow 本身的使用场景。这跟新闻网站不太一样——新闻有时效性,模型的知识总是滞后的;操作指南没有时效性,学一遍就是永久替代。
版权侵权这条路在类似案子里一直不好走。核心争议是训练算不算合理使用,美国法院此前的几次判决口径并不统一,而且模型输出通常不会逐字复现原文,实质性相似很难证明。
所以真正的看点可能不是判决本身,而是和解。目前主流内容方跟 AI 公司的关系正在从对抗转向签约——起诉是筹码,授权协议才是终点。wikiHow 手里有一批结构化极好、覆盖长尾生活场景的高质量语料,这东西对做智能体的公司很有价值。这场官司最可能的结局,是变成一份带钱的数据授权合同。
相关条目:Openai
© 版权声明
文章版权归作者所有,未经允许请勿转载。






wikiHow 把 OpenAI 告了,说被抓走一万一千篇文章