在《纽约时报》对OpenAI提起的诉讼中,特朗普政府提交了一份20页的法律意见书,为ChatGPT开发商未经授权使用版权材料训练其大型语言模型(LLM)进行辩护。

该意见书指出:“美国有强烈的利益继续发展一个强大且具有竞争力的人工智能产业,该产业将成为全球人工智能使用规范和程序的标准……因此,美国必须‘保持在人工智能领域的全球领导地位’。”这段话引用了特朗普总统去年签署的一项行政命令。

驱动ChatGPT、Claude和Gemini等聊天机器人的大型语言模型,是基于庞大且难以理解的数据库训练的,这些数据库包含了包括版权书籍、文章及其他媒体在内的已发布作品,而AI公司在未获许可的情况下将这些内容输入数据库。许多出版商,包括本案中的《纽约时报》,主张AI公司使用其版权材料训练模型是违法的。

关于“是否可以使用版权材料训练AI模型”的问题并非黑白分明,因此引发了广泛的法律争论。这些讨论通常围绕“合理使用”原则展开,该原则是版权法中的一个例外条款,允许在某些情况下未经许可使用他人版权作品被判定为合法。在本案中,合理使用的争议焦点是AI公司使用版权作品是否具有足够的“转化性”,以使法官判定其合法。

意见书中写道:“基于对合理使用原则的误解限制大型语言模型的发展,将阻碍创造性和科学进步,同时妨碍美国的繁荣和经济流动性。”

迄今为止,关于AI训练和版权侵权的案件大多对AI公司有利。去年,法官威廉·奥尔萨普命令Anthropic支付15亿美元版权和解金,赔偿一群其AI模型训练所用作品的作者;但Anthropic并未因AI训练本身受到处罚,而是因使用非法的影子图书馆盗版训练书籍而被罚款。

奥尔萨普法官写道:“就像任何渴望成为作家的读者一样,Anthropic的大型语言模型训练这些作品,并非为了快速复制或取代它们,而是为了突破难关,创造出不同的东西。”他将大型语言模型的训练比作人类阅读书籍。

这份由特朗普政府提交的新意见书并非判决,因为该案正在纽约南区联邦地区法院审理,意见书的作者并无司法管辖权。然而,特朗普政府的介入仍可能产生重要影响。