《纽约时报》能否从AI霸主手中拯救新闻业?

《纽约时报》能否从AI霸主手中拯救新闻业?
2023年,《纽约时报》起诉OpenAI和微软侵犯版权,指控其未经授权使用数百万篇新闻报道训练AI模型。至今,该报已为这场诉讼花费逾2000万美元,出版人A.G. Sulzberger誓言不会退缩。这不仅是法律纠纷,更是关乎新闻业生存的战役——当AI吞噬内容,传统媒体如何捍卫创作价值?本文深度解析诉讼背景、行业影响与未来走向。

2023年深秋,一场震动科技与媒体界的诉讼在纽约联邦法院拉开帷幕。《纽约时报》正式起诉OpenAI及其主要投资者微软,指控这两家公司未经授权使用其数百万篇新闻报道来训练人工智能模型,包括GPT系列和Copilot工具。这场官司被业界视为“新闻业对抗AI霸权的第一次重大战役”。

诉讼的起因:当AI学会“抄袭”

根据《纽约时报》提交的诉状,OpenAI和微软在训练其大型语言模型时,系统性地复制了大量受版权保护的新闻内容。这些模型不仅能够生成与原文高度相似的摘要,有时甚至逐字复制整篇文章,却未提供署名或来源链接。更关键的是,AI生成的回答可能包含错误信息,但却打着“智能助手”的幌子,损害了新闻机构的品牌声誉和读者信任。

“这是对我们的原创报道的公然盗窃。新闻记者花数月甚至数年时间调查、核实、撰写内容,而AI公司却免费取用,并以此牟利。”——《纽约时报》出版人A.G. Sulzberger在接受采访时表示。

诉状指出,OpenAI和微软的行为构成了直接侵权、间接侵权和不当得利。截至目前,该报已在诉讼上投入超过2000万美元,包括聘请顶尖律师、聘请技术专家进行取证分析等。Sulzberger明确表示,公司没有计划停止这场法律战:“我们愿意承担高昂成本,因为如果我们的内容可以被随意拿来训练AI,那么整个新闻业的商业模式将彻底崩溃。”

行业背景:从合作到对抗

事实上,AI公司与新闻机构之间的关系经历了一个快速演变的过程。2023年初,部分媒体曾尝试与OpenAI达成内容授权协议,例如美联社与OpenAI签署了为期多年的许可合作。然而,更多中小型新闻机构发现自己陷入了“被免费利用”的尴尬境地。

据行业分析机构估算,自2022年底ChatGPT发布以来,新闻网站流量下降了约15%,因为用户更倾向于直接向AI提问获取信息,而非访问原始来源。这一趋势在谷歌发布AI搜索摘要功能后进一步加剧。对于依赖广告收入和订阅收入的新闻业而言,这不啻为一场生存危机。

《纽约时报》的诉讼并非孤例。2024年初,一批作家和视觉艺术家也对AI公司提起了集体诉讼。尽管科技公司辩称“训练属于合理使用”,但法院尚未就此达成明确共识。部分法学家认为,如果AI训练涉及大规模复制受保护作品,且输出内容与原作品形成市场替代,那么合理使用抗辩可能难以成立。

编者按:一场决定未来的法律博弈

从战略角度看,《纽约时报》选择此时起诉,一方面是为了争取先发制人的法律地位,另一方面也是在倒逼国会出台更明确的AI版权法规。目前,美国版权局已开启关于AI生成内容的新规制定程序,但立法速度远不及技术迭代。

值得关注的是,这场诉讼的结果可能重塑数字时代的内容价值链。如果法院判定AI公司未经授权使用新闻内容构成侵权,那么未来所有大模型训练都可能需要获得版权许可,并支付合理费用。这无疑会增加AI开发成本,但也为创作者保护自己的劳动成果提供了法律武器。

然而,历史告诉我们,媒体的维权之路从来不会一帆风顺。2005年,Google Books项目被美国作家协会起诉,最终在2016年达成和解,谷歌获得了扫描图书的合法地位。但不同于图书扫描案,AI模型并非简单复制,而是从数据中学习模式并生成衍生内容,这使得法律适用更为复杂。

可能的结局与深远影响

目前该案仍在前期取证阶段,预计最早要到2027年才会进入庭审。分析人士预测,双方最终可能达成和解,例如OpenAI同意支付高额授权费并建立内容使用规范。但Sulzberger的强硬态度表明,他更希望看到司法裁决,从而为整个行业树立先例。

无论如何,这场诉讼已经迫使所有AI公司重新审视其训练数据的来源。微软和OpenAI已开始主动与部分出版商签订付费协议,例如2024年中期,OpenAI宣布与包括Politico和Business Insider在内的多家媒体达成内容许可合作。但这对于数以万计的独立新闻网站来说,仍是遥不可及的“豪门特权”。

正如《纽约时报》在诉状中所言:“新闻业不是AI的饲料,而是民主的基石。”当技术巨头用算法吞噬信息时,我们是否还能保留一个真实、可信、独立的信息环境?这场诉讼的答案,或许将决定未来几十年人类知识的公共性。

本文编译自WIRED