写了20年的教程,被ChatGPT一键复刻:WikiHow起诉OpenAI

2026.08.25 10:39
2026年8月21日,WikiHow在纽约南区联邦法院起诉OpenAI,指控其未经许可爬取超11,000篇教程文章用于训练ChatGPT,侵犯至少1,211项已注册版权,并在robots.txt屏蔽后仍持续访问数十万次。这是OpenAI面临的第24起版权诉讼,但或许是最具标志性的一起——当“写教程的网站”都开始反击,AI公司与整个互联网内容生态之间的矛盾再无转圜余地。

2026年8月21日,wikiHow在纽约南区联邦法院按下了一颗看似微小、实则可能改写AI产业游戏规则的按钮。

这家被称为“互联网最大的人类撰写、专家验证的教程库”,正式把OpenAI告上了法庭。指控清单很长:未经许可爬取超过11,000篇教程文章用于训练ChatGPT等大模型,侵犯至少1,211项已注册版权,故意删除版权管理信息违反《数字千年版权法》,生成的回答近乎逐字复刻原文内容——以及,所有这些行为的后果是直接分流了wikiHow的页面流量、广告收入和内容授权收益。

OpenAI的回应几乎是标准模板:“训练数据来自公开信息,适用合理使用原则。”

但这次,情况可能不太一样了。

一个写了20年的“互联网图书馆”

wikiHow不是普通的UGC网站。它自2005年上线,由数千名志愿作者和编辑共同维护,每篇教程都经过严格的专家审查流程——从“如何给新生儿洗澡”到“如何在失业后重建生活”,内容覆盖了人类日常生活的几乎每一个角落。在搜索引擎里,用户输入“how to + 任何一个动词”,排名前三的结果几乎总有wikiHow。

根据起诉书,OpenAI对wikiHow内容的取用至少有两个路径:一是直接通过爬虫抓取网站页面,二是通过Common Crawl等第三方数据集间接获取。知名数据研究者Brian Roemmele在X上指出:“我清楚地知道它在Common Crawl里,因为我就是这方面的专家。”

更关键的是,wikiHow早在2023年就开始在robots.txt中屏蔽OpenAI的爬虫——GPTBot、OAI-SearchBot、ChatGPT-User逐一被封。2025年还进一步扩大了屏蔽范围。但起诉书称,OpenAI的爬虫在屏蔽之后仍然继续访问了网站“数十万次”。

换句话说,OpenAI在明确被告知“禁止入内”的情况下,依然破门而入。

不只是训练数据,是精准替代

WikiHow的指控不只是针对“用我的数据训练模型”这个行为本身。它引用了一个更具杀伤力的事实:ChatGPT现在可以生成与wikiHow内容几乎逐字一致的“如何做”答案。

这正是压垮很多内容创作者的最后一根稻草。用户原本会搜索“how to tie a tie”,点进wikiHow页面,看完几页带插图的教程——这个过程为wikiHow带来广告曝光和流量变现。现在用户打开ChatGPT,输入同一个问题,几秒钟就得到一段文字版答案。用户走了,流量没了,广告收入也蒸发了。起诉书明确指出这种行为“损害了继续创作原创内容的经济动力”。

据SimilarWeb的数据,wikiHow在2026年7月的全球排名从第2,050位下降至第2,177位。虽非断崖式下跌,但在AI搜索引擎和对话式问答产品的双重挤压下,老牌内容平台的流量天花板正在加速收窄。

第24场诉讼:AI版权战的多米诺骨牌

据Chat GPT Is Eating the World跟踪统计,WikiHow的起诉是OpenAI面临的第24起版权诉讼。全美范围内,截至2026年8月,针对AI公司的版权诉讼已达137起。

前情提要并不难列:《纽约时报》2023年12月率先发难,George R.R. Martin等作家集体诉讼紧随其后,The Intercept等新闻机构加入,Getty Images告Stability AI,环球音乐告Anthropic。但这些原告的共同特征是:要么是《纽约时报》级别的媒体帝国,要么是好莱坞式的版权大户。他们的诉讼往往给人一种“大厂打架、局外人看戏”的距离感。

wikiHow不一样。它既不是媒体帝国,也不是版权大户。它是一个靠“教你做任何事情”起家的实用型网站,用户就是最普通的互联网网民。当这样一家网站站出来起诉OpenAI时,信号再明显不过——AI训练数据的版权问题已经不只是“大媒体和作者的事”,而是波及了互联网内容生态的每一个角落。

值得注意的是,这些诉讼并非都朝着对AI公司不利的方向发展。2026年7月,印度德里高等法院在ANI诉OpenAI案中认可了OpenAI的“公平处理”抗辩。但在德国,出版商Penguin Random House已于2026年3月在慕尼黑地方法院起诉OpenAI,指控ChatGPT复制其儿童图书内容。在美国,《纽约时报》案仍在推进,双方已进入证据开示阶段。

“合理使用”还能撑多久?

面对几乎每一桩版权诉讼,OpenAI的回应策略高度一致:合理使用。

但这条防线正在被从多个方向同时突破。美国版权法中的“合理使用”有四要素判断:使用目的和性质、被使用作品的性质、使用部分的数量和质量、对原作品潜在市场的影响。OpenAI在前两个要素上有一定优势——它可以将训练定性为“转换性使用”。但在第四要素(市场影响)上,wikiHow提供了非常具体的证据:ChatGPT输出的内容直接分流了网站流量和广告收入,构成了市场竞争。

WikiHow这个案子的特殊之处在于:它的内容恰恰是AI最擅长复制的“结构化知识”——步骤清晰、要点明确、语言简洁。如果法院认定这种复制构成侵权,将产生一个结构性的判例效应。因为ChatGPT和所有大语言模型的核心价值主张,正是“用自然语言回答用户的结构化问题”。

这场诉讼的终极赌注

WikiHow要求金钱赔偿(实际损失、利润损失或法定赔偿)和永久禁令。如果禁令获批,OpenAI将不能再使用wikiHow的内容训练模型,已使用的也需要从训练数据中移除。

但对一个运营了20多年的网站来说,即便胜诉获赔,在漫长的诉讼周期面前,赔偿金也可能只是象征性的抚慰。真正重要的是一件事:能否确立一个判例,让内容创作者有权阻止AI公司无偿使用其原创内容进行训练并输出竞品答案。

2026年8月的这起诉讼,不会在明天就改变AI行业。但它是一个分水岭:当“写教程的”都开始起诉,AI公司与整个互联网内容生态之间的矛盾,已经没有转圜余地。

从《纽约时报》到wikiHow,从音乐出版商到教科书作者,AI公司正在面对一张越来越密的诉讼网。每新增一个原告,“合理使用”的护城河就被削去一层。每新增一个判例,AI训练数据的法律灰色地带就少一分模糊。

这场诉讼的结果可能要到2027年甚至更晚才能见分晓。但有一件事已经确定:OpenAI不再只是和媒体巨头掰手腕。它正站在整个互联网内容生态的对立面——与每一位创作者为敌。而互联网上最有价值的东西,绝大多数都是创作者一笔一笔写出来的。

当ChatGPT可以教你怎么做任何事情时,谁还愿意花20年把“怎么做到”写清楚?这个问题的答案,决定了AI能否和人类创作者共存。

作品声明:内容由AI生成

快报

更多

10:58

工信部:要持续擦亮“专精特新”金字招牌,提升中小企业标准化发展能力

10:55

工信部:将研究起草动力电池退役相关行政法规,到2030年废旧动力电池综合利用量力争达到百万吨级以上

10:51

工信部:近期将发布促进中小企业发展“十五五”规划

10:49

韩国KOSPI涨幅扩大至2%,现报6878.94点

10:48

CPO概念震荡回升,剑桥科技涨停

10:46

港股芯片股、光通信股表现活跃,剑桥科技涨超8%

10:46

沪深两市成交额突破1万亿,较上一日此时放量超300亿

10:45

工信部:“十五五”时期中国将培育建设500家零碳工厂

10:42

工信部:加强公共技术服务平台、中试平台等载体建设

10:41

A股券商股集体走强,锦龙股份、湘财股份涨停

10:39

工信部:要促进制造业向微笑曲线两端延伸,提高全要素生产率

10:38

工信部:要推动要素资源向新兴产业集聚,实施科技产业金融一体化专项

10:36

工信部:将有序推动电信领域扩大自主开放

10:36

创业板指涨超1.00%,沪深京三市上涨个股近3100只

10:35

工信部:要增强人工智能、工业互联网、车联网等重点领域安全水平

10:35

工信部:6G是“十五五”时期核心技术攻关重中之重,要让信息通信技术融入车间产线,深入矿山、井下

10:27

工信部:“十四五”期间中国规模以上工业增加值年均增长5.9%

10:27

“十五五”时期中国将加快培育“人工智能+”“机器人+”等重大应用场景

10:24

大金融板块再度拉升,湘财股份直线涨停

10:24

“十五五”时期中国将促进6G产业成熟和生态构建