《纽约时报》起诉微软与OpenAI的版权纠纷案出现新进展。据科技媒体Tom’s Hardware报道,原告方已于近日向法院申请简易判决,并提交新的法律摘要,进一步披露了两家被告公司的内部材料。这些材料显示,微软与OpenAI的内部人员早在2023年初就已意识到,使用受版权保护内容训练大语言模型可能引发严重的法律与商业伦理问题。
这起版权纠纷可追溯至2023年年底。《纽约时报》指控微软和OpenAI未经许可,使用其数千篇新闻报道训练ChatGPT和Copilot等产品,构成版权侵权。此次申请简易判决,意味着原告方主张案件不存在影响裁判结果的重大事实争议,无需完整庭审即可依据现有证据作出裁定。法院可以批准、驳回或部分批准该申请,获批并不代表所有关联争议均已结束。
法律摘要中引用了微软应用科学总监布伦特·赫克特于2023年1月撰写的一份内部备忘录。赫克特在备忘录中写道:“全球数百万人很快就会认为,大型模型‘吞噬’他们所有的劳动成果是一种前所未有的惊人盗窃。”他将这一现象称为“人类历史上规模最大的劳动成果盗窃”。另一份微软文件也指出:“几乎没有人希望自己创作的内容被以这种方式使用,他们也没有因此获得任何补偿。”
内部数据进一步揭示了AI产品对内容出版商的实际冲击。随着ChatGPT在2023年迅速走红,微软自身的数据显示,与Bing搜索相比,Copilot导致《纽约时报》的点击率最高下降93%。赫克特在另一份备忘录中将此称为“恶性循环”,并表示这将“同时损害我们模型的性能和整个互联网”。他在文件中写道:“最终产品威胁到其关键供应商的经济基础,这种情况极为罕见,但这正是我们 LLM 业务在‘内容供应链’方面造成的局面。”
OpenAI方面的内部沟通同样被纳入法律摘要。ChatGPT负责人尼克·特利在内部表示,AI聊天机器人对出版商构成“生存威胁”,因为它们“在很大程度上是替代性的”,而且随着技术进步,这种替代性会越来越强。另一位OpenAI工程师则直言:“无论我们如何醒目地展示链接,用户都不会点击。”此外,OpenAI研究员尼克·莱德曾向公司总裁格雷格·布罗克曼透露一个“绕过《纽约时报》付费墙的技巧”,布罗克曼对此回应称:“啊,不错。”
这些内部材料的曝光,为外界理解AI公司与内容出版商之间日益紧张的关系提供了新的视角。一方面,大语言模型的训练高度依赖高质量文本数据,新闻媒体是其中重要的内容来源;另一方面,AI产品在直接回答用户问题时,往往不再引导用户访问原始内容页面,导致出版商的流量与广告收入受到实质性冲击。这种结构性矛盾正在全球范围内引发一系列版权诉讼与监管关注。
从行业影响来看,本案的走向可能对AI训练数据的获取方式、版权授权模式以及内容生态的可持续性产生深远影响。若法院支持《纽约时报》的主张,AI公司可能需要重新评估其数据来源的合规性,并探索与内容提供方建立更加透明的授权与补偿机制。与此同时,微软和OpenAI内部早已存在的担忧表明,行业对上述风险的认知并非始于诉讼之后,而是在产品大规模推广之前就已形成。
目前,该案仍在审理过程中,法院是否批准简易判决申请尚待观察。无论结果如何,这起诉讼已成为AI时代版权制度如何适应技术变革的标志性案例之一。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。