2026年8月21日,wikiHow在纽约南区联邦法院按下了一颗看似微小、实则可能改写AI产业游戏规则的按钮。
这家被称为“互联网最大的人类撰写、专家验证的教程库”,正式把OpenAI告上了法庭。指控清单很长:未经许可爬取超过11,000篇教程文章用于训练ChatGPT等大模型,侵犯至少1,211项已注册版权,故意删除版权管理信息违反《数字千年版权法》,生成的回答近乎逐字复刻原文内容——以及,所有这些行为的后果是直接分流了wikiHow的页面流量、广告收入和内容授权收益。
OpenAI的回应几乎是标准模板:“训练数据来自公开信息,适用合理使用原则。”
但这次,情况可能不太一样了。
一个写了20年的“互联网图书馆”
wikiHow不是普通的UGC网站。它自2005年上线,由数千名志愿作者和编辑共同维护,每篇教程都经过严格的专家审查流程——从“如何给新生儿洗澡”到“如何在失业后重建生活”,内容覆盖了人类日常生活的几乎每一个角落。在搜索引擎里,用户输入“how to + 任何一个动词”,排名前三的结果几乎总有wikiHow。
根据起诉书,OpenAI对wikiHow内容的取用至少有两个路径:一是直接通过爬虫抓取网站页面,二是通过Common Crawl等第三方数据集间接获取。知名数据研究者Brian Roemmele在X上指出:“我清楚地知道它在Common Crawl里,因为我就是这方面的专家。”
更关键的是,wikiHow早在2023年就开始在robots.txt中屏蔽OpenAI的爬虫——GPTBot、OAI-SearchBot、ChatGPT-User逐一被封。2025年还进一步扩大了屏蔽范围。但起诉书称,OpenAI的爬虫在屏蔽之后仍然继续访问了网站“数十万次”。
换句话说,OpenAI在明确被告知“禁止入内”的情况下,依然破门而入。
不只是训练数据,是精准替代
WikiHow的指控不只是针对“用我的数据训练模型”这个行为本身。它引用了一个更具杀伤力的事实:ChatGPT现在可以生成与wikiHow内容几乎逐字一致的“如何做”答案。
这正是压垮很多内容创作者的最后一根稻草。用户原本会搜索“how to tie a tie”,点进wikiHow页面,看完几页带插图的教程——这个过程为wikiHow带来广告曝光和流量变现。现在用户打开ChatGPT,输入同一个问题,几秒钟就得到一段文字版答案。用户走了,流量没了,广告收入也蒸发了。起诉书明确指出这种行为“损害了继续创作原创内容的经济动力”。
据SimilarWeb的数据,wikiHow在2026年7月的全球排名从第2,050位下降至第2,177位。虽非断崖式下跌,但在AI搜索引擎和对话式问答产品的双重挤压下,老牌内容平台的流量天花板正在加速收窄。
第24场诉讼:AI版权战的多米诺骨牌
据Chat GPT Is Eating the World跟踪统计,WikiHow的起诉是OpenAI面临的第24起版权诉讼。全美范围内,截至2026年8月,针对AI公司的版权诉讼已达137起。
前情提要并不难列:《纽约时报》2023年12月率先发难,George R.R. Martin等作家集体诉讼紧随其后,The Intercept等新闻机构加入,Getty Images告Stability AI,环球音乐告Anthropic。但这些原告的共同特征是:要么是《纽约时报》级别的媒体帝国,要么是好莱坞式的版权大户。他们的诉讼往往给人一种“大厂打架、局外人看戏”的距离感。
wikiHow不一样。它既不是媒体帝国,也不是版权大户。它是一个靠“教你做任何事情”起家的实用型网站,用户就是最普通的互联网网民。当这样一家网站站出来起诉OpenAI时,信号再明显不过——AI训练数据的版权问题已经不只是“大媒体和作者的事”,而是波及了互联网内容生态的每一个角落。
值得注意的是,这些诉讼并非都朝着对AI公司不利的方向发展。2026年7月,印度德里高等法院在ANI诉OpenAI案中认可了OpenAI的“公平处理”抗辩。但在德国,出版商Penguin Random House已于2026年3月在慕尼黑地方法院起诉OpenAI,指控ChatGPT复制其儿童图书内容。在美国,《纽约时报》案仍在推进,双方已进入证据开示阶段。
“合理使用”还能撑多久?
面对几乎每一桩版权诉讼,OpenAI的回应策略高度一致:合理使用。
但这条防线正在被从多个方向同时突破。美国版权法中的“合理使用”有四要素判断:使用目的和性质、被使用作品的性质、使用部分的数量和质量、对原作品潜在市场的影响。OpenAI在前两个要素上有一定优势——它可以将训练定性为“转换性使用”。但在第四要素(市场影响)上,wikiHow提供了非常具体的证据:ChatGPT输出的内容直接分流了网站流量和广告收入,构成了市场竞争。
WikiHow这个案子的特殊之处在于:它的内容恰恰是AI最擅长复制的“结构化知识”——步骤清晰、要点明确、语言简洁。如果法院认定这种复制构成侵权,将产生一个结构性的判例效应。因为ChatGPT和所有大语言模型的核心价值主张,正是“用自然语言回答用户的结构化问题”。
这场诉讼的终极赌注
WikiHow要求金钱赔偿(实际损失、利润损失或法定赔偿)和永久禁令。如果禁令获批,OpenAI将不能再使用wikiHow的内容训练模型,已使用的也需要从训练数据中移除。
但对一个运营了20多年的网站来说,即便胜诉获赔,在漫长的诉讼周期面前,赔偿金也可能只是象征性的抚慰。真正重要的是一件事:能否确立一个判例,让内容创作者有权阻止AI公司无偿使用其原创内容进行训练并输出竞品答案。
2026年8月的这起诉讼,不会在明天就改变AI行业。但它是一个分水岭:当“写教程的”都开始起诉,AI公司与整个互联网内容生态之间的矛盾,已经没有转圜余地。
从《纽约时报》到wikiHow,从音乐出版商到教科书作者,AI公司正在面对一张越来越密的诉讼网。每新增一个原告,“合理使用”的护城河就被削去一层。每新增一个判例,AI训练数据的法律灰色地带就少一分模糊。
这场诉讼的结果可能要到2027年甚至更晚才能见分晓。但有一件事已经确定:OpenAI不再只是和媒体巨头掰手腕。它正站在整个互联网内容生态的对立面——与每一位创作者为敌。而互联网上最有价值的东西,绝大多数都是创作者一笔一笔写出来的。
当ChatGPT可以教你怎么做任何事情时,谁还愿意花20年把“怎么做到”写清楚?这个问题的答案,决定了AI能否和人类创作者共存。






快报