OpenAI与微软高管自认犯下"史上最大规模劳动窃取"
《纽约时报》等多家媒体针对OpenAI与微软提起的知识产权侵权诉讼迎来关键节点——两大科技巨头的高层人员公开表态,承认人工智能技术对新闻行业构成了"生死攸关的挑战"。
根据澎湃新闻9月18日的消息,近日曝光的庭审文书披露了多位企业核心人物的原话。微软应用科学部门负责人布伦特·赫希特直言,当前AI模型的训练过程堪称"人类文明史上最严重的劳动力窃取行为"。负责运营ChatGPT的尼克·特利则警告称,依赖新闻素材进行训练的商用产品正在给出版机构制造"存续危机",他同时预判,随着技术迭代加速,聊天机器人的"替代效应将持续增强"。
早在2020年,OpenAI总裁兼创始成员格雷格·布罗克曼便在一封邮件中指出,AI"在续写新闻报道方面表现出异常突出的能力",例如让系统补全《纽约时报》稿件中被截断的语句时,"几乎总能精准地接上后半句"。
以上表述均出自微软与OpenAI公司内部档案。在这桩由《纽约时报》牵头的版权维权案件中,这些内部记录已被原告方作为核心论据写入起诉书。
双方的冲突根源可追溯至2022年末。彼时ChatGPT迅速走红,《纽约时报》内部测评发现,该系统能够成篇复现报纸原文,实质上可以取代付费订阅服务向读者供稿。此后,《纽约时报》数次致函OpenAI,要求其终止爬取行为并签署内容使用许可合同,但协商始终未能达成共识。
2023年12月27日,《纽约时报》正式向纽约曼哈顿联邦地区法院递交诉状,指控OpenAI与微软构成版权侵害。这使其成为美国首个对AI科技企业发起此类诉讼的主流大报。随后,其他数家媒体也跟进提起了类似诉求,曼哈顿联邦法院遂将相关案件予以合并审理。
诉状中,《纽约时报》指认两家公司在未获授权的情况下,大量调用其新闻内容构建AI产品,涵盖ChatGPT及微软旗下各项智能工具。诉讼文件强调,这些产品曾基于数以百万计的《纽约时报》文章进行训练,再以此为基础为用户生成回答,由此严重侵蚀了该报的线上访问量,进而冲击其广告营收、内容授权及订阅业务。
基于此,《纽约时报》请求法院判令被告立即停用涉案内容、删除含有本报素材的训练数据集,并赔偿相应经济损失。OpenAI方面则抗辩称,利用公开网络资源训练模型属于"合理使用"范畴,且这一做法由来已久,既保障了创作者的权益,也是推动技术创新不可或缺的前提。
今年7月9日,《纽约时报》联合其他新闻出版单位再度向曼哈顿联邦法院提交补充指控,指责OpenAI在证据开示环节蓄意作伪陈述、欺骗法庭与社会公众。导火索在于,原告方要求OpenAI借助检索功能调取涉及复制媒体稿件的对话记录及训练数据,但对方声称不具备该项检索能力。至此,这场聚焦AI训练数据的版权争端,已从"无偿使用受保护内容是否正当"扩展至"训练数据能否被追踪溯源、能否接受司法审查"的新维度。
央视评论指出,此案看似一桩版权纷争,实则折射出AI时代数据治理格局的深层博弈。掌控数据即意味着掌控模型实力,而有权界定数据使用边界的主体,将在未来AI生态中占据更主动的话语位置。
光明网的分析认为,本案判决不仅关乎各大模型厂商是否需要就其语料来源支付巨额补偿,更将影响人工智能在法律框架下的定性。该媒体还提到,此前Facebook与澳大利亚传统报业之间的争议,或许能为本案提供某种参照。
2021年开春,澳大利亚政府通过立法,强制要求Facebook就新闻内容向当地纸媒支付费用,理由是社交平台大量引用了传统媒体报道的同时还分食了其广告市场。Facebook随即以"封禁"回应,禁止澳大利亚用户在其平台上分享新闻链接。最终,仅隔五天,澳大利亚政府选择让步,修订了相关法案,风波得以平息。