诉状怎么写:一案打包 19 家出版物
10 月 8 日,USA Today Co. 与旗下 13 家关联实体向纽约南区联邦法院递交诉状,案件编号 1:26-cv-08892,被告列了 OpenAI 基金会、OpenAI OpCo 等多个关联主体。原告方覆盖 19 家出版物,除 USA TODAY 本报外还包括《底特律自由报》《亚利桑那共和报》、The Tennessean、Indy Star、Milwaukee Journal Sentinel、The Columbus Dispatch、The Oklahoman 等一批地方大报。诉讼请求包括逾 2.5 亿美元损害赔偿、永久禁令,以及依据版权法销毁含其内容的 GPT 模型与训练数据集,并要求陪审团审理。代理律师是 Rothwell, Figg, Ernst & Manbeck 的史蒂文·利伯曼。
三项诉由与赔偿算法
诉状铺了三层请求权基础:直接版权侵权、帮助侵权,以及《数字千年版权法》第 1202 条下的版权管理信息(CMI)条款——后者指向 OpenAI 在复制文章时剥离署名、标题与版权标识的行为。赔偿按法定口径计算:每项故意侵权最高 15 万美元,每项 CMI 违规最高另加 2.5 万美元。CMI 这条线此前在出版商诉讼里出现得不多,若被法院认可,后续案件大概率会把它当作标配诉由,因为它绕开了「训练是否构成合理使用」这个尚无定论的大战场,打的是一个更窄、罚则更明确的点。
数字证据:从 WebText 到 C4
原告没有停留在「大规模复制」的定性上,而是给出了可核对的计数:OpenAI 用于训练 GPT-2 的 WebText 语料中,来自原告域名的内容条目超过 16 万条,其中仅 usatoday.com 就有 83,266 条;2019 年的 C4 数据集快照中,与这些出版物相关的文本标记超过 1.22 亿个,usatoday.com 占逾 2300 万个。诉状还指 OpenAI 最新模型能按提示生成与原始报道高度相似的详细摘要与复述,并称其此前的付费授权合作恰恰说明公司清楚新闻内容需要许可。
与既往案件的最大差别:打到了输出端
过去的出版商诉讼大多围绕训练数据展开,这份 79 页的诉状专门开辟篇幅处理输出:原告用同一段提示词对 GPT-5.6 逐条实测——给一个标题,要求给出深度摘要——得到的回复在结构与内容上都与原文高度重合,且篇幅远超搜索引擎快照;诉状的论点是,附一个链接并不能把读者带回原文,长摘要本身就是报道的替代品,直接侵蚀订阅与流量。这个「摘要即替代品」的框架把 ChatGPT 的搜索与摘要功能拉进了被告席,影响面比训练数据之争更贴近日常产品形态。
程序走向与同类案件背景
原告同日提交了关联性声明,请求把本案并入同院已经在处理的一批合并 OpenAI 版权诉讼,而非另起炉灶。在它之前,《纽约时报》、The Intercept、Ziff Davis 以及一个由近 400 家地方报组成的联盟都已就类似诉求起诉 OpenAI;OpenAI 方面的一贯抗辩是训练构成合理使用。截至 10 月 9 日,OpenAI 未就本案公开置评。顺带一提,各家媒体对原告范围的表述略有出入(18 家关联报纸、13 家关联实体等),以诉状所列 19 家出版物、13 家关联实体为准。
观察点:维权与授权并行的新常态
值得留意的是,USA Today 集团并非拒绝 AI——它同时在试验面向机器抓取的友好版式,探索授权生意。一边打官司、一边谈合作,正在成为出版行业对待 AI 公司的标准姿态:诉讼划底线,授权谈价钱。本案走向将检验「摘要替代品」论点能否成立,这比赔偿数字本身更值得跟踪。官方及行业暂未披露更多细节,后续将持续跟进迭代动态。