《纽约时报》于近日向法院提交了一份经大量编辑删改的申请文件,请求修改其针对OpenAI和微软的版权侵权诉状。修改后的诉状进一步明确了相关指控——微软专门为OpenAI建造了一台跻身全球最强之列的定制超级计算机,并以此主动鼓励OpenAI窃取《纽约时报》的版权内容。
修改诉状的背景
《纽约时报》此次修改诉状,源于美国最高法院在索尼诉Cox通信公司一案中的最新裁决。在该案中,索尼主张Cox通信作为互联网服务提供商,应对用户的音乐盗版行为承担连带责任,但最终未获法院支持。这一裁决确立了认定"辅助侵权"的新标准:原告必须证明被告方存在主动诱导他人实施侵权行为的故意。
有鉴于此,《纽约时报》希望修订其诉状,使对微软的辅助侵权指控符合上述新的法律标准。
"今天,我们已请求法院批准提交修订后的诉状。修订内容将依据新的法律标准和在案件调查过程中发现的新证据,进一步强化我们对微软的辅助侵权指控,"《纽约时报》发言人Graham James在声明中表示。
除厘清部分指控外,《纽约时报》还同意主动撤回对所有被告的两项指控,分别涉及辅助版权侵权和商标淡化。
对此,微软方面回应称,该修订诉状不过是"原告在最近其他裁决形成不利先例后,为挽救自身索赔而做出的最后挣扎"。
《纽约时报》在申请文件中则指出,允许修订诉状不会对微软或OpenAI造成任何损害。当法律标准发生变化时,允许原告修改论点是合理且必要的。此外,修订案件说明不会拖延庭审进程,因为"《纽约时报》不要求为支持修订后的索赔进行任何额外取证"。
"正如我们长期以来所主张的,微软主动鼓励OpenAI窃取我们受版权保护的作品,"James表示,"我们的核心主张与提起诉讼之日相比没有任何改变——微软和OpenAI窃取了数百万篇《纽约时报》享有版权的文章,以此与我们的产品竞争,并从中非法牟利。"
矛头直指微软超级计算机
2023年,《纽约时报》成为首家起诉OpenAI的主流媒体机构。该报指控ChatGPT在未经授权的情况下,以其文章作为训练数据,逐字逐句输出其版权内容,并通过将ChatGPT定位为《纽约时报》订阅服务的替代品,对其造成市场损害。与此同时,ChatGPT还曾错误地将捏造内容归咎于《纽约时报》的报道,对其声誉造成伤害。此外,ChatGPT生成的Wirecutter产品评测摘要,使读者无需点击原始链接即可获取内容,导致该媒体旗下评测栏目作者损失联盟营销佣金。
在原始诉状中,《纽约时报》将微软的超级计算系统描述为普通的云计算服务。而修订后的诉状则明确指出,该超算系统是专门为协助OpenAI实施侵权行为而定制建造的,其目的就是在未经授权的情况下,利用受版权保护的内容训练人工智能模型。诉状还称,由于两家公司都希望以最高质量的新闻内容来训练模型,以便其输出内容能够自信地模仿相应的写作风格,《纽约时报》的文章在该系统中被赋予了更高的权重。
通过建造这台"异常复杂"的机器,微软不仅参与了侵权内容的筛选,还为在未经授权的情况下获取版权作品提供了技术手段,《纽约时报》如此指控。
"微软专门为此建造了这台超算,目的是利用几乎整个互联网——其中《纽约时报》的内容被不成比例地大量纳入——来训练有史以来能力最强的大语言模型,"《纽约时报》在诉状中写道。
而如今,微软正借此坐享渔翁之利。
"在过去一年里,微软凭借融入了《纽约时报》训练数据的大语言模型产品线,市值暴涨了一万亿美元,"《纽约时报》在诉状中指出。
模型输出结果证明市场损害
对于《纽约时报》而言,在案件取证阶段获取的模型输出内容——包括大量用户的ChatGPT对话记录——是证明OpenAI和微软侵权行为的有力证据。这些输出内容显示,相关工具通过生成与《纽约时报》版权内容近乎相同的文本,实质上充当了其替代品。
在某些案例中,用户明确告知ChatGPT他们意图绕过付费墙,并通过不断要求查看"下一段",成功获取了大量文章内容。在另一些案例中,模型无需任何特殊操作便"直接输出了数个完整段落"。为证明订阅替代所造成的市场损害,《纽约时报》在诉状中提供了并排对比示例及涉嫌侵权的输出截图。
同样令《纽约时报》忧虑的是,微软和OpenAI的模型还存在"幻觉"问题——错误地将其从未发表过的内容归咎于《纽约时报》。诉状中列举了若干典型案例:Bing Chat曾捏造史蒂夫·福布斯之女莫伊拉·福布斯的虚假言论;ChatGPT则伪造了一篇从未存在的《纽约时报》文章,声称该文将非霍奇金淋巴瘤与饮用橙汁关联起来。
"当用户询问搜索引擎《纽约时报》就某一话题发表了哪些文章时,他们理应获得的是指向原文的链接,而不是未经授权的复制版本,更不是虚假伪造的内容,"《纽约时报》在诉状中强调。
微软和OpenAI希望法院认定以《纽约时报》文章训练AI属于合理使用。OpenAI发言人Drew Pusateri再次重申了该公司一贯立场:"我们的模型推动创新发展,训练数据来自公开可获取的信息,且符合合理使用原则。"
然而,《纽约时报》显然对其掌握的替代性证据颇具信心,这对两家科技公司而言未必是好兆头。值得注意的是,此前一项最早认定AI训练属于合理使用的裁决,正是因为原告未能证明市场损害而作出的。去年6月,一位联邦法官明确阐述了可能推翻AI训练合理使用认定的论点框架,表明这一法律问题远未盖棺论定。
在本案中,OpenAI援引的理由是"ChatGPT并非《纽约时报》订阅服务的替代品",原因在于"他们对原始材料进行了不同用途的转化处理"。
然而,一旦《纽约时报》能够说服法院认定ChatGPT的使用方式与原报纸内容并无实质差异,最极端的判决结果可能要求OpenAI和微软删除现有模型、从头重新训练。
此外,《纽约时报》还申请永久禁令,要求被告停止一切未来的侵权行为,并索取大额赔偿,坚称"被告通过侵权行为,从其并不拥有的版权作品中非法获取了巨额利益"。
Q&A
Q1:《纽约时报》为什么要修改对微软的侵权诉状?
A:因为美国最高法院在索尼诉Cox通信公司一案中确立了辅助侵权的新认定标准,要求原告必须证明被告存在主动诱导侵权的故意。《纽约时报》为了使其对微软的指控符合这一新标准,申请修订诉状,同时补充了取证阶段发现的新证据,进一步明确了微软为OpenAI定制建造超算的目的。
Q2:微软为OpenAI建造的超级计算机与版权侵权有什么关系?
A:《纽约时报》在修订诉状中指控,微软建造的超级计算机并非普通云计算设施,而是专门为在未经授权的情况下用版权内容训练大语言模型而定制的。该系统在训练过程中对《纽约时报》的文章给予了更高权重,使得模型能够模仿其写作风格输出内容,并由此帮助微软市值在一年内增长了约一万亿美元。
Q3:如果《纽约时报》胜诉,OpenAI和微软会面临什么后果?
A:若法院认定ChatGPT对《纽约时报》内容的使用不构成合理使用,且确实对其造成了市场替代损害,最严重的后果是法院可能要求OpenAI和微软删除现有模型并从头重新训练。此外,《纽约时报》还申请了永久禁令和大额赔偿,要求被告停止一切未来侵权行为,并赔偿因侵权行为所获得的非法利益。
好文章,需要你的鼓励
英国国家医疗服务(NHS)正将无人机纳入常规医疗物流体系。自今年2月起,无人机每天在雷恩斯公园和圣乔治医院之间运送血液等诊断样本,飞行仅需3分钟,比公路运输快约85%,且碳排放减少高达98%。目前已有逾2000名患者受益。NHS计划将该服务扩展至圣赫利尔、克罗伊登等多家医院,最终惠及约180万名患者。该网络由英国医疗初创公司Apian与谷歌旗下Wing合作运营。
AgentLens是Explyt公司联合俄罗斯学术机构开发的AI编程助手评测基准,通过分析完整人机交互轨迹而非仅看最终结果,从五个维度评估代码智能体的真实表现。
边缘AI计算厂商Aetina宣布,将在其DeviceEdge AIE-KT风冷系列和新款AIE-PT无风扇平台上支持英伟达全新Jetson T3000和T2000模块。T3000基于Blackwell GPU,最高提供865 FP4 TFLOPS算力,功耗70W;T2000则提供400 FP4 TFLOPS,面向视觉AI代理和自主移动机器人等场景。两款模块预计2027年第一季度上市,支持Nemotron、Cosmos 3等英伟达AI软件生态。
韩国梨花女子大学提出Splash框架,通过识别AI模型中的"休眠参数"并只在其中训练触觉能力,让小型多模态AI在学会感知材质触感的同时,完整保留原有视觉语言推理能力。