8月18日,东京的一场在线会议,把全球AI行业的目光重新拉回“版权”两个字。日本内阁府在当天的“AI时代知识产权”专家小组会议上,出示了生成式AI“原则准则”的最终案。它不罚款,不关停,强制的字眼一个都没有,却要求所有面向日本市场提供生成式AI服务的公司,做一件此前几乎不可能做到的事,公开训练数据从哪来、怎么收的。
一份没有牙齿的文件,凭什么让整个行业侧目?答案藏在日本的两条命脉里,一条是内容,一条是算力。
一份没有罚则的“最终案”
8月18日上午,日本内阁府向知识产权战略本部下属的“AI时代知识产权”专家小组出示“生成式AI原则准则”最终案。与会者没有提出明显异议,以座长一任的形式事实上认可了这份文件,日本政府预计近期正式定为基本原则,今秋开始适用。
这份准则的立足点,是2025年5月28日成立、同年6月4日公布的《人工智能相关技术研究开发及应用推进法》,日本第一部AI专门法律。它同时也是日本第一份专为生成式AI知识产权保护而设的规则,是这部促进法在知产维度上落下的第一块拼图。
准则围绕三件事打转。其一,训练数据概要公开。开发者在自社网站公布AI学习过程与数据类型,并注明是否使用自动收集数据的程序,也就是爬虫。其二,对权利人的披露。进入法律程序的权利人提出请求时,开发者在满足条件的前提下告知其作品URL是否包含在训练数据中。其三,对使用者的披露。担心权利受损的AI使用者询问时,告知所生成内容类似的受版权作品是否存在于训练数据中。
围绕这三根支柱,准则还要求尊重付费墙与robots.txt指令、回避盗版网站、留存训练日志、采取防止生成侵权内容的技术措施,并为权利人设立联系窗口。内阁府将公布接纳准则的企业名单和各公司披露信息的网页链接,期望企业每年更新披露。
这套框架覆盖所有面向日本市场提供服务的生成式AI开发者。读卖新闻点明,谷歌、OpenAI等美国公司就在设想范围内。但准则不具法律约束力,采用“遵守或解释”路径,企业要么守规矩,要么公开解释为什么不守。
两条命脉的交汇点
把这份准则放回日本经济的坐标里,冲击力立刻不一样了。
日本内容产业正处在史上最赚钱的时刻。出版科学研究所数据显示,2024年日本漫画市场销售额7043亿日元,连续7年创新高,其中电子漫画5122亿日元,占比超过七成。日本动画协会数据显示,同年动画产业市场3.84万亿日元,海外市场首次突破2万亿日元,达到2.17万亿日元,同比增长26%。日本政府自己则给出更激进的目标,2026年6月24日的经济财政咨询会议与日本成长战略会议合同会议上,提出到2033年实现游戏、动画、漫画的内容产业海外年销售额20万亿日元,与汽车出口额比肩。
同一时间,日本又在算力与AI上加注。2024年11月的综合经济对策提出,未来10年撬动官民投资50万亿日元以上。2026年6月24日的合同会议更排出硬指标,到2040年度对AI、半导体等17个战略领域投入官民合计370万亿日元以上,其中AI与半导体领域101.6万亿日元,仅半导体一项就有68万亿日元。
一个世界上最依赖内容IP出口的国家,配上一颗最渴望算力和数据的心。训练数据,恰好卡在这两条命的交汇点上。
为什么日本选择了“软”?
日本不是不想管,而是不敢管死。
全球AI治理现在是三条路线并跑。欧盟把监管写进法律,AI Act按风险分级设定义务,最严重时对违规企业可处最高达全球年营业额7%的罚款。美国联邦层面在行政令反复摇摆后,退回行业自律与企业自愿承诺。日本走了第三条路,基本法性质、没有罚则、软约束先行。
这背后是两重现实。其一,AI法本身就是一部促进法,名称里就写着“研究开发及应用推进”,对企业的要求停留在努力义务层面,此次准则延续了这一基调。其二,日本在算力与大模型竞赛里是追赶者,一个急着补课的国家,不会把唯一的规矩做成绞索。
在笔者看来,这不是妥协,而是审时度势的治理选择。日本行政指导传统绵延数十年,用“准则加解释”而非“法律加罚金”来规范新兴行业,是这套体系最熟练的姿势。先立共识,再慢慢加码,是日本一贯的节奏。
训练数据为什么是日本的命门?
对内容产业而言,训练数据从来不是技术问题,而是饭碗问题。
日本漫画市场2024年卖到7043亿日元,七年连增。动画产业3.84万亿日元,海外贡献2.17万亿。日本正在成为全球最大的漫画、动画内容出口国,内容IP是日本二十年来少数仍在增长的产业故事,如今更被写进国家战略的KPI。而训练图像模型,日式画风、日式叙事、日式角色,恰恰是价值最高的“食材”。
现行著作权法第30条之4为“信息分析”目的使用作品留下例外,AI训练数据是否落入这一例外,法律上至今没有定论。读卖新闻也指出,现行法原则上认可为学习之目的利用作品,而能轻易生成酷似原作的生成式AI出现后,要求加强权利保护的呼声不断高涨。
更深的背景是,日本版权界对“数据被白拿”这件事有切肤之痛。2016年2月开站、2018年4月停止运营的盗版漫画网站“漫画村”,曾一度成为日本最大规模的盗版漫画站,最盛期月访问量过亿次。运营者2019年被捕,2021年被福冈地方法院判处有期徒刑3年、罚金1000万日元。这件事让日本出版业从此对一切形式的内容非法使用高度警惕。准则专门要求回避盗版网站,正是这种警惕在AI时代的延续。
所以准则才会把披露范围明确铺到漫画、音乐、电影。这不是修辞,这是日本的产业安全清单。
软法的牙齿在哪里?
没有罚则,不意味着没有后果。“遵守或解释”的设计,把施压力度巧妙地转交给了市场。
第一步,声誉压力显形。内阁府将公布接纳准则的企业名单与各公司披露链接,相当于给每家公司发了一张公开的成绩单。训练数据披露一旦变成公开信息,版权人的法务、创作者协会、媒体、竞争对手都会盯着看,“用了什么数据训练”从此不再是秘密,黑箱由此变成玻璃房。
第二步,责任链条前置。对使用者的披露要求,把“生成内容与受版权作品相似”的判断从法庭搬到了日常问答里,AI抄袭从悄悄发生变成可被追问的事件,用户、平台、开发者之间的博弈从“事后打官司”变成“事前看得见”。
第三步,合规成本变成入场门票。覆盖境外开发者的设计,等于给进入日本市场增加了一道隐形门槛,要么付出披露成本,要么公开声明“我不愿意遵守”,而后者本身就是一份可以被媒体引用、被竞争对手拿捏的公开声明。
这套机制的核心逻辑只有一条,不逼你改,但让你的一切选择暴露在阳光下。准则的真正作用不是约束行为,而是改写信息不对称。谁用了什么数据,第一次需要变成能被追问的公开事实。
这刀还钝在哪里?
软法有软法的边界,准则的裂缝同样明显。
裂缝之一,披露粒度太弹性。“概览”式的披露要求给企业留下巨大操作空间,一家公司完全可以说“数据来自公开网络”而不给出任何可验证细节。训练日志虽然要求留存,但由谁来审计、按什么标准审计,准则没有回答。
裂缝之二,“解释”本身就是合法的退出通道。遵守或解释的精髓恰恰是给不愿合规者留了台阶,只要理由公开,不遵守也不算违规。如果大量公司选择“解释”,这套机制的效力会迅速衰减。
裂缝之三,著作权法本身没有变。第30条之4的解释之争、生成内容侵权的归责、惩罚性赔偿,都没有在这次准则中触及。准则只是把争议摆上了台面,并没有给出答案。
所以这份准则的效力上限,取决于正式落地后能否保持“名义软、实际紧”,也取决于著作权法这条更硬的线何时跟进。
训练数据透明化,正在成为全球新KPI
日本这一手,把一个全球性问题从暗处拖到了明处。训练数据透明化,正在从个别市场的倡议,变成主要经济体共同面对的政策课题。日本提供的是一份可复制的模板,不惩罚,只要求回答。
对行业而言,数据供应链将开始变成可审计资产。谁的数据干净,谁就在合规上领先,数据溯源、合规数据集交易、训练数据审计,都可能长成新生意。对创作者而言,维权逻辑从“事后起诉”转向“事前知情”,这是话语权的实质转移。而对那些靠灰色数据堆出来的模型、把“爬遍全网”当默认设置的公司,压力只会越来越大。
接下来的看点有三个。其一,这份原则准则的正式版何时定稿,细则会收紧还是放宽。其二,著作权法第30条之4的解释会不会被重新审视。其三,“披露”会不会从日本蔓延到更多市场,变成全球AI公司的新合规KPI。对从业者和投资人而言,把训练数据披露当成与算力、参数并列的第三项资产来审视,可能比追逐技术参数更早看到风险与机会的分野。
一个没有牙齿的规则,之所以让行业不安,是因为它第一次要求AI回答一个问题。你的智能,吃掉了谁的创作?当黑箱必须开口说话,权力的天平就已经开始移动。






快报