21世纪经济报道记者 肖潇
根据清华大学智能法治研究院最新报告,当地时间9月1日,美国司法部向纽约联邦法院提交了一份20页意见书,明确支持OpenAI,“强烈希望法院驳回大模型侵犯版权的论点”。
这场官司始于2023年,《纽约时报》起诉OpenAI和微软,指控其未经许可使用了数百万篇报道训练AI模型。如今,原本属于两家公司的版权纠纷,迎来了美国政府的介入。
美国司法部在意见书中认为,使用受版权保护的内容训练AI属于合理使用,如果法院对此作出“错误”的解释,将阻碍美国的技术进步、产业发展,削弱国家竞争力。政府还强调,这一意见不仅针对OpenAI和《纽约时报》,也适用于其他类似案件。
必须指出,这并不意味着美国政府替法院作出了裁决。根据美国联邦法典第517条,司法部可以在涉及国家利益的案件中,向法院提交法律意见,性质为“利益陈述”(Statement of Interest)。至于意见是否被采纳,仍需法院决定。
但该意见书仍然值得关注。这是美国政府第一次在AI版权争议上表明态度,也是首次把AI合规问题与产业竞争、国家经济发展直接联系起来。
美国政府支持“合理使用”
20页的意见书由美国司法部官员和外部律师一起撰写,开篇就把AI版权放到了产业竞争和国家利益的框架下。
美国司法部认为,如果因为对“合理使用”(fair use)原则的误解而限制大模型发展,不仅会阻碍创新和技术进步,也会影响美国的产业繁荣和经济发展。
“合理使用”是知识产权领域的一个核心概念,指的是无需许可直接使用版权作品。AI公司使用版权作品训练大模型是否属于合理使用,是近年法律领域的争议焦点。
针对这一问题,美国司法部对法院提出了两点判断建议:
第一,大模型训练具有“非凡的变革性”。在美国司法部看来,一篇新闻报道的目的可能是向读者提供信息,但大模型并不是简单重复这些文章,而是从中学习语言和知识的关系,再将这些能力用于生成新的内容,因此属于一种具有创造性的使用。
第二,大模型与《纽约时报》的新闻业务并不构成直接的实质性竞争。美国司法部认为,不能只看AI是否影响整体收入,而要看被使用的具体作品是否被新产品直接取代。
为了说明这一点,美国司法部还用了一个少见的类比。
美国作家琼·狄迪恩曾回忆,十几岁时,她会把海明威的小说逐字打出来,通过这种方式学习写作。美国司法部认为,如果把AI训练和AI最终生成的内容视为一个连续过程,那么按照《纽约时报》的逻辑,狄迪恩后来出版作品并与其他作家竞争,也应该为当年打印海明威小说付费。
因此,意见书认为,“训练”和“输出”是两个不同的问题。即使ChatGPT偶尔能够复现《纽约时报》的付费报道,导致输出内容可能侵权,也不能因此认为使用这些报道训练AI违法。
《纽约时报》在最新回应中提到,AI版权保护和产业发展并不冲突。“AI和创作者都可以蓬勃发展,只需要AI公司按照版权法的要求,为使用支付合理的费用。”
意见书似乎预料到了这一点。意见书写道,AI公司可以通过授权协议,为实时新闻、付费报道、深度报道等高价值内容付费,但不应要求AI公司为所有训练素材逐一获得许可。
对全球AI版权争议的影响
美国政府提交的这份意见并非法院裁决,但这并不意味着它没有影响。
根据美国联邦法典第517条,司法部可以在涉及政府利益的案件中,向法院提交意见。过去十余年,美国司法部曾利用这一机制,就投票权、移民、住房歧视等案件表达政府立场。
此次意见书的特殊之处在于,司法部首次将AI的版权争议,与美国的产业竞争力、国家安全和全球地位直接联系起来。虽然不具有法律约束力,但它可能成为接下来AI公司应对争议的重要依据,也可能影响AI时代法律对知识产权的重新理解。
在美国,AI训练版权争议已经出现了几项重要法院判决,但没有形成明确结论。两个判断重点是:训练数据是如何获得的,以及AI是否挤占了版权方的市场。
美国作家联盟等版权方曾指控Anthropic未经许可,使用出版书籍训练AI。法院认为,Anthropic可以购买实体书扫描或者爬取互联网信息,但在盗版网站下载书籍是非法行为。最终,Anthropic支付超过15亿美元与版权方达成和解。
这起案件判决后,类似诉讼继续增加。就在8月28日,索尼音乐、华纳音乐及多家音乐出版商再次向法院起诉Anthropic,指控其进行了“肆无忌惮的非法盗版、抓取和下载受版权保护作品的活动”,尤其指出Anthropic通过盗版网站获取音乐作品。
在国内,AI训练使用版权内容,尚未被明确规定为法定的“合理使用”。不过,从现有实践来看,我国大体采用“宽进严出”的思路:在训练的输入端,采取相对宽松包容的态度,以鼓励技术创新;而在输出端,要求严格限制输出侵权内容,比如限制AI生成奥特曼等IP形象。
(作者:肖潇 编辑:章驰,张明艳)
南方财经全媒体集团及其客户端所刊载内容的知识产权均属其旗下媒体。未经书面授权,任何人不得以任何方式使用。详情或获取授权信息请点击此处。

