作者协会诉 OpenAI 案的解封文件,把这场美国版权诉讼的焦点从“有没有用盗版书训练”推向了“是不是明知故犯”。2026 年 9 月 21 日,美国作者协会(Authors Guild)在官网发布新闻稿,公开其诉 OpenAI 与微软版权案(Authors Guild v. OpenAI)中新解封的一批原告简报:文件引用的内部记录显示,两家公司的高管和员工早在模型训练初期就知道用盗版书籍训练 AI 模型可能违法,还明确预见到产品会威胁人类作家的生计。这批简报是原告方为申请部分即决判决而提交的,意味着案件正在从事实争执,转向对被告主观“明知”的法律定性。
这场官司的来龙去脉
诉讼全名 Alter v. OpenAI and Microsoft,是纽约曼哈顿多地区诉讼的一部分。原告方除了作者协会,还包括大卫·鲍尔达奇、约翰·格里森姆、乔治·R·R·马丁、乔迪·皮考特等十几位知名作家,指控 OpenAI 与微软违法使用受版权保护的图书训练 AI 产品。
本次公开的是原告方的《支持部分即决判决动议的法律备忘录》(Docket 1982)和《修正后的无争议重要事实陈述》(Docket 1987),9 月 17 日解封。注意:这些是原告单方简报中的主张和引用的内部记录,并非法院已经认定的事实。
新文件披露的六条关键内容
微软从一开始就知道 LibGen。 简报称,2019 年 4 月,萨姆·奥尔特曼和达里奥·阿莫迪向比尔·盖茨演示早期 GPT-3 时,就向盖茨和微软 CTO 凯文·斯科特披露了使用盗版图书数据库 LibGen 的情况。
高管担心的是“观感”,不是法律。 时任 OpenAI 研究总监的阿莫迪评价 LibGen“有点可疑”;研究员山姆·麦克坎德利什承认,自己只是担心 Hacker News 上出现“OpenAI 用了俄国可疑网站的版权数据”这样的标题“会很不幸”。
“Project Clear”:清除痕迹。 简报指控 OpenAI 在 2022 年夏天删除了系统中的 LibGen 文件。2022 年 6 月 15 日的 Slack 记录显示,员工 Paino 问“大家对 libgen 的提及有多担心”,研究副总裁鲍勃·麦格鲁当晚回复:“现在正是从我们的系统和存储中清除 Libgen 的好时机。”
2020 年就预见到取代作家。 政策总监杰克·克拉克在 2020 年 5 月的内部发言中称,AI 与创意方面的工作“将越来越创造出替代人类劳动的系统”,“我们的工作将让人们失业……总有一天一群艺术家会表达担忧,而我们很可能无视他们的担忧照样发布”。
“替马丁写完《冰与火之歌》”曾是正式研究任务。 2022 年,OpenAI 雇佣塔伦·戈吉内尼负责提升模型写作质量,他的“研究使命”是让 GPT 模型“有一天替马丁写完《冰与火之歌》最后两部”——他甚至想过“即使马丁早逝,GPT-5 也能替他续完系列,我就可以安心了”。
“可接受的经济破坏”。 戈吉内尼知道作者们抱怨“数据集是偷来的”,但他表示“没什么同情”,称之为“可接受的经济破坏”,还写道世界将迎来“读者之死”——“机器为更多机器制造垃圾”。
对案件走向意味着什么
这批简报的法律意义是叙事转向:原告不再只论证“用了盗版书”,而是把被告的“有罪明知”摆到叙事中心。部分即决判决一旦获批,意味着法院认定关键事实已无争议,可以直接裁决,这对被告是实质性压力。按作者协会的说法,未来两个月还会有更多简报提交,听证会预计在 2027 年初举行。
对写作者和中文读者意味着什么
这场诉讼的走向会直接影响“AI 公司能不能拿已出版作品训练模型”这条边界的划法,美国同类案件(包括《纽约时报》诉 OpenAI、微软案)都在同一诉讼框架下推进,这里的裁定会成为其他案件的参照。
但要冷静看待两点:目前公开的是原告方简报,OpenAI 与微软的回应、法院是否批准即决判决,才是真正的定性时刻;版权裁决通常只约束美国法域,对中文创作者的直接影响更多体现在行业惯例和平台政策上。接下来值得盯住三个节点:未来两个月的新简报、2027 年初的听证会、法院对即决判决动议的裁定。