美国政府站队OpenAI:支持用版权作品训练AI
在纽约时报诉OpenAI一案中,特朗普政府提交了一份20页的法庭之友意见书。立场很明白:支持OpenAI未经许可使用受版权保护的作品训练大语言模型。
意见书写道,美国有强烈兴趣继续发展强大且有竞争力的AI产业。简报还援引特朗普去年签署的行政命令,强调美国必须保持全球AI领导地位。
这场争议的根源在数据。ChatGPT、Claude、Gemini背后的模型,训练库里包含大量受版权保护的书籍、文章和其他媒体内容。这些作品未经许可就进了AI公司的数据库,纽约时报和许多出版商认为这不合法。
用版权材料训练AI是否合法,法律上不是黑白分明。争论的焦点是版权法里的“合理使用”原则。它允许在特定情形下,未经许可使用他人的版权作品。落到具体案件上,核心问题就一个:AI公司的使用够不够“变革性”,法官能不能据此判定合法。
目前的版权判例大多偏向AI公司。去年,法官William Alsup命令Anthropic向一群作家支付15亿美元版权和解金。但罚款落点在数据获取方式:Anthropic用了非法影子图书馆里的盗版书。Alsup把模型训练比作人类阅读:“就像任何渴望成为作家的读者一样,Anthropic的模型在这些作品上训练,不是为了赶超、复制或取代它们,而是为了拐过一道弯,创造不一样的东西。”
政府简报此刻进场,理由直接。它说,在误解合理使用原则的情况下限制大模型发展,会阻碍创造性和科学进步。美国的繁荣和经济流动性也会被拖累。
这份意见书不是裁决。案件正在纽约南区联邦地区法院审理,撰写简报的部门无权作出裁决。但这份表态分量不轻。至于这份表态能在多大程度上影响判决,目前没有答案。
判例已经偏向AI公司,如今政府也站到同一侧。AI公司在版权上的法律风险,正在被压低。只要不碰盗版,继续拿版权作品当训练材料的空间还在。模型能力的提升,不太会被版权诉讼拖慢。纽约时报和出版商想靠诉讼拿回作品控制权,面对的对手又多了一个。