《西雅图时报》与《新闻日报》起诉OpenAI和微软侵权

《西雅图时报》与《新闻日报》起诉OpenAI和微软侵权
《西雅图时报》与长岛《新闻日报》成为最新起诉OpenAI与微软的新闻机构,指控两家公司未经授权大规模使用其新闻报道训练人工智能模型,损害了内容生产者的收益与权益。继《纽约时报》等媒体之后,版权与AI训练数据的争议再度升级。案件走向或将为数字内容时代的技术与版权边界树立重要判例。

美国当地时间9月6日,《西雅图时报》与长岛《新闻日报》(Newsday)正式对OpenAI及微软提起诉讼。两家新闻机构指控,两家科技巨头未经授权,将大量受版权保护的新闻报道用于训练其人工智能模型,侵犯了新闻出版商的合法权益。

这并非首次有传统媒体以法律手段对抗AI公司。早在2023年底,《纽约时报》就已起诉OpenAI与微软,指控其未经许可复制并使用了数以百万计的版权文章。此后,《芝加哥论坛报》《纽约每日新闻》等多家美国报纸也相继发起类似维权行动。此次《西雅图时报》与《新闻日报》出手,意味着针对AI训练数据使用方式的司法抗议,正在新闻出版行业中加速扩散。

诉讼指控的焦点是什么?

据TechCrunch报道,两家媒体认为,OpenAI和微软在ChatGPT及必应等产品中,系统性利用了从新闻网站抓取的文本数据来训练和优化大规模语言模型,并让模型在生成回答时涉及新闻报道中的事实与表达。原告方指出,这种操作没有得到内容所有者的授权,也未提供任何形式的补偿,依靠的是对被报道者劳动成果的事实上的搭便车行为。

更重要的是,当AI工具能够直接将新闻内容转化为即时答案后,用户访问新闻原始页面的动机会明显下降,依赖订阅和广告收入的新闻业将受到侵蚀。因此,这不仅是历史版权问题的追溯,更关乎媒体未来的商业模式。

版权之战何以越演越烈?

在生成式AI发展初期,许多科技公司默认互联网上可公开访问的数据都属于合法训练集。然而,随着模型生成能力增强,越来越多内容权利人意识到,这些系统的核心价值——包括对新闻事实的理解、概括与重新组织——在相当程度上建立在人类记者的劳动之上。长期来看,若不加以约束,新闻采集和生产的经济基础将受到动摇。

事实上,类似纠纷的解决方式已经出现分化。部分出版集团选择与OpenAI等公司签订授权合作,例如美联社和德国施普林格集团等。合作模式通常包括:允许AI公司使用其历史内容训练模型,同时在生成摘要时提供来源归还与链接;作为交换,科技公司支付授权费用并提供流量合作。但《西雅图时报》和《新闻日报》选择站在诉讼一方,表明并非所有内容提供者都满意于这种交易安排。

与其说这只是一场侵权诉讼,不如说这是一场关于“谁拥有AI知识底座”的规则争论。训练数据应当被视作一般公共资源,还是包含特定主体创造性劳动的财产?这正是双方激烈争夺的法律界限。

合理使用原则将成为案件胜负手

在美国司法体系中,判断此类AI训练是否构成侵权的核心问题,在于其是否符合版权法“合理使用”的四项要素:使用的目的与性质、原始作品的性质、使用的数量与实质性程度,以及对原作品市场的潜在影响。

OpenAI和微软预计会主张,训练AI模型属于“转换性使用”,并未直接替代原始新闻内容;而新闻媒体则可能会指出,AI生成的答案与新闻原文的高度重合会使读者绕开原平台,对版权持有者的广告和订阅市场造成可感知的负面影响。

法律专家认为,这些案件将很大程度上定义人工智能产业与内容产业在未来十年的关系。如果法院支持媒体方,科技公司可能需要重新设计训练路径,或建立更庞大的授权系统;如果支持AI公司,则意味着内容创作者必须接受内容被机器“消化”且无法获得报偿的现实。

编者按:内容生态需要新的契约

在编者看来,新闻机构迈向法庭,不只是一个维权姿态,更是对长期规则缺口的直接回应。人类记者奔赴现场、核查事实、撰写稿件,其成本与风险远高于算法生成一段文本。如果AI企业可以在不承担这些成本的前提下,借助这些成果创造高额收入,那么未来新闻业不仅会丧失议价能力,也会削弱持续输出深度内容的动力。

当然,鼓励技术创新同样重要。合理的路径不应是让AI停止学习,而是让权利人与使用者在透明的基础上达成平衡。无论是通过集体授权、内容补偿还是技术性限制,一个成熟的AI时代,最终需要为创造性劳动建立可持续的回报机制。

截至目前,OpenAI与微软尚未对此次最新诉讼做出公开回应。此案后续如何进展,对整个AI新闻生态具有指标意义。

本文编译自TechCrunch