摘要 / 我的正文
2026年9月1日,美国司法部(DOJ)向美国纽约南区联邦地区法院提交法庭之友意见书,主张使用受版权保护的书面作品训练大型语言模型(LLMs)构成合理使用。司法部认为,若判定相反结果,将扭曲版权法、抑制创新,并削弱美国的竞争力与国家安全。该意见书针对OpenAI面临的多地区版权诉讼提交,虽具体回应《纽约时报》的主张,但其 reasoning 也适用于涉及图书作者和出版商的相关案件。政府指出,生成式AI的训练过程与作品收集及输出生成不同,法院需对每项被指控的使用单独评估。意见书称,这些案件的影响可能远超当事人范畴,国内AI发展对经济增长和国家安全职能至关重要。政府认为,要求模型训练获得许可可能会制造只有最大科技公司才能承担的准入壁垒,导致LLM市场集中,并让拥有大型档案的传统媒体机构不成比例地受益。同时,政府强调其仅针对训练过程中对作品的使用发表意见,未主张政府授权任何被质疑的行为,也未涉及训练数据的获取、存储或复制受保护表达的输出所引发的单独版权问题。司法部的意见书聚焦于合理使用的第一和第四法定因素:被质疑使用的目的和性质,以及对版权作品市场的影响。政府主张,训练具有“极高的 transformative”,因为模型并非以作者预期的方式使用文章来娱乐或告知读者,而是将训练数据转换为数值表示,学习涉及词汇、语法和知识的统计关系,使模型能够预测文本并执行从编辑、翻译到生成新材料的各种任务。援引“Google v. Oracle”案和第二巡回法院“Authors Guild v. Google”案的裁决,司法部表示,当复制行为能够实现新的技术功能时,即使在中间步骤中复制了全部作品,也可能构成合理使用。政府补充称,OpenAI的商业目的应分量较轻,因为商业使用可以符合合理使用的条件,且随着使用的 transformative 增强,商业性的重要性会降低。政府承认,如果LLM重构并分发受版权保护的材料,特定输出可能会引发不同问题,但这些输出不应决定早期训练使用是否具有 transformative。同样,少量异常的、重构性的输出不能成为广泛限制模型训练或使所有LLM使用面临巨额 liability 的理由。关于市场损害,意见书认为,版权法认可的是来自重大替代性竞争的损害,而非抽象意义上的竞争。政府称,仅训练行为本身不会向公众提供受保护的表达,因此不会在法律相关意义上替代某一文章或损害其市场;即使输出与文章存在竞争,但只要未复制实质性相似的受保护表达,也不会仅因它们属于同一 genre 而成为版权替代品。政府还尖锐批评了2025年“Kadrey v. Meta Platforms”案的裁决,该案中法官暗示为训练LLMs而复制作品通常会被认定为侵权,尽管在该案中原告的论点未切中要害。司法部表示:“即使不考虑人类使用LLMs进行创作这一事实,Kadrey法院对第四合理使用因素的适用也存在严重缺陷。”政府认为,该法院的分析不当将训练和输出合并为一个连续的使用,并将一般性竞争视为可认知的市场损害。为说明其反对意见,意见书指出,琼·狄迪恩曾键入欧内斯特·海明威的故事以研究其句子结构。政府认为,根据Kadrey案的 reasoning,狄迪恩在其后来的写作在文学市场上竞争时可能欠海明威的债,这一结果与版权保护表达而非思想、方法、风格或影响力的原则不符。政府称,第四合理使用因素还需考虑公共利益。LLMs可以协助作家、研究人员、记者和国家安全官员,并帮助独立出版商与老牌媒体竞争。意见书还指出,《纽约时报》的记者据报道使用AI来构思和编辑文章。最终,司法部表示:“施加广泛的版权 liability,从而通常使AI模型的训练在未经许可的情况下不被允许,这将是有问题的——且在法律上是不正确的。”
关键要点
一句话结论
(可由AI生成:一句话讲清这条新闻对你意味着什么)
可借鉴点
(可由AI生成:这条新闻能迁移到哪些业务/审查/写作场景)
证据锚点
(如:判决法院/案号/专利号/关键时间点)
后续跟踪
(如:上诉进展/和解条款/监管动作/同类案件)
证据与引用
原文链接:https://ipwatchdog.com/2026/09/03/doj-sides-with-openai-warns-obstacles-to-ai-development-threaten-national-security/
来源:IPWatchdog
原文时间:2026-09-03 14:15:58 抓取:2026-09-03 16:01:17
来源:IPWatchdog
原文时间:2026-09-03 14:15:58 抓取:2026-09-03 16:01:17