摘要 / 我的正文
ChatGPT、Gemini、Claude等AI模型的训练数据包含数亿书籍、在线文章、学术论文等公开作品,多数作者在不知情或未同意的情况下为这些可能威胁其生计的AI工具发展做出了贡献。知识产权、版权与技术领域律师Cathy Gellis指出,该领域法律和技术问题复杂,各方情绪强烈。去年,Alsup法官在一项开创性裁决中,命令Anthropic向一组作家支付15亿美元版权和解金,但实际上裁定Anthropic的AI训练行为合法,处罚原因是其从非法在线影子图书馆盗版书籍。法官将LLM吸收数万亿文字比作作家研究文学,认为其目的是“创造不同事物”而非复制或取代原作。Gellis认为该裁决对AI公司更有利,15亿美元罚款对于预计2028年年度收入达2000亿美元的公司而言影响有限,关键在于法官将AI训练类比为“阅读受版权保护作品”而非“复制”,而版权法核心在于复制,而非使用、体验或消费作品。现行版权法自1976年以来未更新,法官需依据50年前的准则来处理可能塑造AI行业未来的法律问题。JWL International的IP与媒体业务创始人Jason Henderson表示,当前法律状况混乱,因AI模型训练数据庞大而法律未能跟上。相关问题常围绕合理使用原则,即对受版权保护作品的使用是否具有足够“ transformative( transformative )”。合理使用是版权法的例外,允许在未经明确许可的情况下使用版权材料,用于批评、 parody( parody )、教育等目的,法官会考虑使用目的和性质、使用数量及对市场的影响等因素。Henderson指出,版权旨在保护和发展市场,法院在AI案件中的推理不一,若训练目的是直接竞争则可能不被认可。例如,Thomson Reuters起诉Ross Intelligence案中,法院认为Ross使用其内容构建竞争性AI法律平台不具 transformative,不属于合理使用。尽管作者可能主张聊天机器人使用其作品生成新的合成书籍构成竞争,但该论点尚未在法庭上获胜。Gellis认为需区分AI训练的版权问题与AI生成内容的版权问题,如Thaler v. Perlmutter案中,法院裁定100% AI生成的作品不可版权化,但如何确定作品是否使用AI及使用比例仍是难题。多数AI公司仍深陷相关诉讼,短期内难有明确解决方案,初期裁决虽有影响,但可能被其他法院的不同决定推翻,后续诉讼阶段才能明确结果,而AI公司不会忽视这些裁决。
关键要点
一句话结论
(可由AI生成:一句话讲清这条新闻对你意味着什么)
可借鉴点
(可由AI生成:这条新闻能迁移到哪些业务/审查/写作场景)
证据锚点
(如:判决法院/案号/专利号/关键时间点)
后续跟踪
(如:上诉进展/和解条款/监管动作/同类案件)
证据与引用
原文链接:https://techcrunch.com/2026/08/23/is-it-legal-to-train-ai-models-on-copyrighted-books-its-complicated/
来源:TechCrunch
原文时间:2026-08-23 15:00:00 抓取:2026-08-23 15:53:02
来源:TechCrunch
原文时间:2026-08-23 15:00:00 抓取:2026-08-23 15:53:02