- Published on
作者诉OpenAI/Microsoft案新解封文件:高管明知盗版书籍训练AI违法且会摧毁作者职业
- Authors
- Name
- papergirl
- authorsguild.org

案件背景
2026年9月21日,美国作家协会(Authors Guild)与多位知名作家联合起诉OpenAI和微软的版权侵权案(Authors Guild v. OpenAI)迎来重大进展。法庭解封了一批爆炸性文件,详细揭示了这两家科技公司的高管和员工在训练AI模型时,明知使用盗版书籍违法、明知会取代人类作者,却依然故意为之。该诉讼由作家协会牵头,原告包括大卫·鲍尔达奇(David Baldacci)、泰勒·布兰奇(Taylor Branch)、迈克尔·康奈利(Michael Connelly)、西尔维亚·戴(Sylvia Day)、乔纳森·弗兰岑(Jonathan Franzen)、克里斯托弗·戈尔登(Christopher Golden)、安德鲁·肖恩·格里尔(Andrew Sean Greer)、约翰·格里森姆(John Grisham)、黄哲伦(David Henry Hwang)、马修·克拉姆(Matthew Klam)、乔治·R·R·马丁(George R.R. Martin)、朱迪·皮考特(Jodi Picoult)、斯泰西·希夫(Stacy Schiff)、詹姆斯·夏皮罗(James Shapiro)等众多著名作家。原告提交的法律备忘录(Docket 1982)和事实陈述书(Docket 1987)成为本案的转折点,将被告公司的“明知故犯”和“鲁莽行为”置于叙事中心。
关键揭露:高管明知违法且漠视后果
明知会取代人类作者
文件显示,OpenAI和微软的高管早就清楚他们的AI系统会取代人类作家。2020年5月,OpenAI政策总监杰克·克拉克(Jack Clark)在一份内部沟通中直言:“我们在AI和创造力方面的工作,将越来越多地导致我们创造出替代人类劳动的系统……我们在GPT-X上做得越好,类型小说作者就越担心我们在亚马逊上取代他们。”他进一步强调:“我们在这个领域的工作会让人们失业……总有一天,一群艺术家会对我们的所作所为表示担忧,而我们很可能会无视他们的担忧,继续发布产品。”这些言论直接证明了被告公司对自身行为后果的清醒认知。
使用盗版书籍并试图掩盖
更令人震惊的是,OpenAI和微软从一开始就知道训练数据来自盗版网站。2022年,OpenAI聘请塔伦·戈吉内尼(Tarun Gogineni)负责提升模型写作质量。戈吉内尼公开表示他的“研究使命”是让GPT模型“完成乔治·R·R·马丁《冰与火之歌》的最后两本书”,甚至幻想“即使马丁早逝,GPT-5也能自动完成他的系列”。他还将作者们关于“数据集是偷来的”的投诉视为“可以接受的经济破坏”,并预言世界将经历“读者的死亡”,因为“机器为机器制造垃圾”。
更关键的是,微软早在2019年4月就知道OpenAI使用了LibGen(一个“有点可疑的俄罗斯网站”)的盗版书籍。当时OpenAI的萨姆·奥尔特曼(Sam Altman)和达里奥·阿莫迪(Dario Amodei)向比尔·盖茨(Bill Gates)和微软首席技术官凯文·斯科特(Kevin Scott)演示早期GPT-3时,就披露了使用LibGen的情况。OpenAI内部对此的担忧并非法律风险,而是“舆论影响”——研究员萨姆·麦坎德利什(Sam McCandlish)写道:“我只是担心舆论,比如‘OpenAI使用来自可疑俄罗斯网站的版权数据’出现在Hacker News上会很糟糕。”
为了掩盖证据,OpenAI在2022年夏天启动了名为“Project Clear”的行动,删除所有LibGen相关文件。2022年6月15日,OpenAI内部Slack频道中,员工帕伊诺(Paino)询问:“一般性问题:我们对提及LibGen的担忧程度如何?(它们遍布谷歌文档、Slack、GitHub……)”当晚,OpenAI研究副总裁鲍勃·麦格鲁(Bob McGrew)回复:“鉴于OpenAI现在如此频繁地出现在新闻中,现在是时候从我们的系统和存储中清除LibGen了。这需要做什么?”这些内部沟通直接证明了被告公司有组织地销毁证据。
对作者困境的冷漠与“可接受的经济破坏”
文件还揭示了OpenAI员工对作者生计的彻底漠视。戈吉内尼虽然知道作者抱怨“数据集是偷来的”且作者因AI竞争而失去工作,但他认为这些抱怨“并不值得同情”,并将其视为“可接受的经济破坏”。他甚至写道,世界将很快经历“读者的死亡”,因为“机器为机器制造垃圾”。这种态度与OpenAI政策总监克拉克的言论一脉相承:他们明知产品会让人们失业,却选择无视并继续发布。
作家协会首席执行官玛丽·拉森伯格(Mary Rasenberger)评论道:“这些文件揭示了被告对作家的惊人蔑视——他们反复、故意地决定偷书而不是付费,完全知道他们的产品会摧毁作者的职业生涯。OpenAI甚至在明确证据表明这样做会通过用AI垃圾取代人类作品来贬低美国文化、让成千上万作家失业的情况下,仍然推行其大规模盗版计划。”
原告与法律行动
本案是集体诉讼,由作家协会和书籍版权所有者提起,主审律师为Susman Godfrey律所的贾斯汀·A·尼尔森(Justin A. Nelson)。案件属于针对OpenAI和微软的多地区诉讼(MDL)的一部分,目前在曼哈顿联邦法院审理。原告方预计在未来几个月内提交更多法律文件,并于2027年初举行听证会。
作家协会是美国历史最悠久、规模最大的专业作家组织,拥有超过18000名会员。该协会致力于保护作家的言论自由、表达自由和版权,争取公平合同和作家维持生计的能力,并为小说、非虚构、诗歌和新闻领域的作家和翻译家提供社区支持。其教育和慈善分支——作家协会基金会——还为在职作家提供关于写作商业的免费课程,并组织公共活动,强调丰富、多元的美国文学文化及其贡献者的重要性。
后续进展与意义
此次解封的文件标志着案件进入新阶段。原告方成功将被告公司的“明知故犯”和“鲁莽行为”置于法庭和公众视野的中心。除了作家协会的诉状,新闻媒体组织也提交了同样严厉的独立文件。这些证据不仅可能影响本案的判决,还可能对整个AI行业的版权合规实践产生深远影响。如果原告胜诉,将迫使AI公司在训练数据获取上更加透明和合法,从而保护创作者的基本权益。
目前,案件仍在审理中。更多法律文件预计在未来几个月内提交,2027年初将举行听证会。作家协会呼吁公众关注这一案件,并加入协会以支持保护作家权利的工作。正如拉森伯格所言:“这些文件揭示了令人震惊的蔑视——但我们也感谢整个法律团队揭露并讲述了这一关键故事。”
原标题:Unsealed Briefs in Authors’ Case v. Microsoft/OpenAI。 HN 原始发布时间:2026年9月27日星期日。当前记录为 607 分、596 条评论。