WikiHow 在美国曼哈顿联邦法院对 OpenAI 提起诉讼。诉状里的数字很具体:超过 11000 篇教程文章被未经许可抓取,用于训练 ChatGPT 和 GPT 系列模型,涉嫌侵犯至少 1200 项已注册版权。
WikiHow 是那种典型的「搜索时代产物」——你想知道怎么换轮胎、怎么系领带、怎么给猫剪指甲,搜索结果第一页大概率有它。这套内容的生产成本极高:每篇都要配步骤插图,很多要请专家审核,靠的是十几年积累的编辑流程和贡献者社区。
诉状里最要命的一段,说的不是「你用了我的数据」,而是「你现在能自己长出来了」。经过教程数据训练之后,模型可以根据提示词直接复现 WikiHow 的文本内容,并且能自主生成同类主题的完整教程。用户不用点进原网站就能拿到答案。
这就把伤害从版权层面推到了商业层面。搜索流量是 WikiHow 的命根子,而流量减少不是一次性损失——它会往上游传导:贡献者看到内容没人看,产出意愿下降,内容质量往下走,排名进一步掉。诉状里用了「逐步消磨创作者继续生产高质量文章的动力」这个说法。
这类案子最近一年多起,判决尚未形成明确方向。真正的分歧点在于「训练算不算合理使用」这一条,而不同法官对它的理解差异很大。WikiHow 这个案子有个特殊之处:它的内容是结构化的、步骤化的,比一般散文更容易被证明「模型输出和原文高度相似」,举证难度会比新闻类原告低一些。
© 版权声明
文章版权归作者所有,未经允许请勿转载。






WikiHow 把 OpenAI 告了,说自己一万一千篇教程被喂进了模型