微软高管:AI抓取是“人类史上最大规模的劳动窃取”

微软高管:AI抓取是“人类史上最大规模的劳动窃取”
最新曝光的微软与OpenAI内部邮件显示,微软一位高管将AI对互联网内容的大规模抓取称为“人类历史上最大规模的劳动窃取”。邮件还揭示两家公司对“末日循环”的恐惧:AI摘要与聊天机器人夺走新闻网站流量,媒体收入崩塌、原创内容萎缩,最终连AI赖以训练和检索的高质量数据也会枯竭。这场围绕版权、流量与生存权的博弈,正在重塑整个内容产业。

据Ars Technica报道,最新曝光的一批微软与OpenAI内部邮件,撕开了生成式AI与新闻业之间那层心照不宣的默契。邮件显示,微软一位高管曾把AI对互联网内容的大规模抓取直接称为“人类历史上最大规模的劳动窃取”(the largest theft of labor in human history)。更值得玩味的是,这批邮件同时暴露出两家公司对一种“末日循环”(doom loop)的深层恐惧:如果AI持续无偿吞噬新闻内容并取而代之,新闻机构将失去收入与生存空间,而AI自己赖以运转的高质量语料也会随之枯竭。

“最大规模的劳动窃取”:措辞为何如此刺耳

“劳动窃取”这个说法之所以刺耳,是因为它把争议从法律层面的“版权侵权”拉回到了更根本的价值层面:记者、摄影师、编辑和自由撰稿人投入时间与专业能力生产的内容,被模型以近乎零成本的方式吸收,转化为可售卖的产品能力,而创作者本人既未获得授权,也未得到分成。

长期以来,AI公司的公开话术更偏向“合理使用”(fair use)与“技术中立”。但这批内部邮件的语气显然不同——在私下讨论中,连身处产业链上游的公司员工都承认,这种做法在道德上站不住脚。这种“公开一套、私下另一套”的反差,恰恰是监管者与原告律师最想抓住的把柄。

当你的产品价值建立在别人的无偿劳动之上,你就不能一边享用这份馈赠,一边假装它不存在。

“末日循环”:AI正在吃掉自己的食物来源

所谓“末日循环”,是一个自我强化的恶性循环:AI搜索摘要与聊天机器人让用户不再点击新闻网站 → 媒体流量与广告收入下滑 → 编辑部裁员、原创报道收缩 → 互联网上可抓取的高质量人类内容减少 → 模型训练与实时检索的数据质量下降 → 用户更加依赖AI给出的现成答案。

这一循环的终点不是AI战胜新闻业,而是双方共输。近年多项行业研究显示,AI概览类功能上线后,新闻网站的自然搜索点击率明显下滑,部分品类的降幅达到两位数。对依赖搜索流量变现的中小型媒体来说,这几乎是釜底抽薪。

更微妙的是,AI公司本身也清楚这一点。模型需要时效性强、事实准确、经过专业核实的内容,而这恰恰是新闻机构的核心产出。一旦新闻业被“榨干”,AI将不得不转向低质、同质甚至由AI生成的语料——这正是业界担心的“模型崩塌”(model collapse)风险的温床。

从法庭到谈判桌:新闻业的双重反击

面对这场不对称的博弈,新闻机构大致走了两条路。一条是对簿公堂:《纽约时报》等媒体先后起诉OpenAI与微软,指控其未经授权复制并利用受版权保护的作品训练模型,相关案件的证据开示过程,正是这批内部邮件得以曝光的渠道。

另一条是握手言和:过去两年,OpenAI等公司陆续与新闻集团、美联社、金融时报、阿克塞尔·施普林格、时代周刊等机构签署内容授权协议,以付费换取合法语料。但这类交易规模有限、条款不透明,且往往只覆盖少数头部媒体,难以解决整个行业的结构性困境。

编者按:谁为“人类劳动”买单

这批邮件真正的价值,不在于它揭穿了某家公司的虚伪,而在于它把一个行业都心知肚明却不愿明说的问题摆上了台面:当AI把全人类的集体知识产出当作免费原料时,谁为这些劳动买单?

短期内,答案取决于三股力量的角力:法院如何界定“合理使用”的边界、监管是否会强制建立内容授权与补偿机制、以及广告与订阅模式能否找到不依赖搜索流量的新出路。长期看,如果“末日循环”无法被打破,受损的将不只是新闻业,而是整个社会赖以判断真伪、形成共识的信息基础设施。

技术本身没有原罪,但“免费午餐”总有结束的一天。

本文编译自Ars Technica。