亚马逊默认用Twitch主播内容训练AI,主播可退出

亚马逊默认用Twitch主播内容训练AI,主播可退出
亚马逊宣布将默认使用Twitch主播的直播内容训练AI模型,主播需主动选择退出。Twitch首席产品官Mike Minton在直播中承认,若采用“选择加入”模式,几乎无人会主动参与,因此选择了默认开启。此举引发创作者对版权和隐私的担忧,也再次将AI训练数据伦理问题推向台前。

亚马逊日前宣布,将默认使用Twitch平台主播的直播内容来训练其AI模型,除非主播主动选择退出。这一政策立即在创作者群体中引发强烈反响。Twitch首席产品官Mike Minton在回应网友质疑的直播中直言:“如果这是选择加入,没有人会加入。说实话,这就是答案。”

默认开启的“数据馈送”

根据新政策,Twitch主播的直播录像、聊天记录等内容将默认纳入亚马逊AI训练的数据池。主播可以在设置中关闭这一权限,但若不主动操作,即视为同意。这种“默示同意”机制被批评为将退出的责任推给创作者,而平台则规避了主动获取授权的成本。

“如果这是选择加入,没有人会加入。说实话,这就是答案。”——Twitch CPO Mike Minton

Minton的言论虽然直白,却也暴露了科技巨头在数据获取上的普遍逻辑:当逐案获得授权变得不现实时,就默认全量获取,再允许少数知情者退出。这一做法并非Twitch首创,但鉴于游戏直播内容的复杂版权结构——涉及主播、游戏发行方、音乐版权方和观众——其争议性尤为突出。

行业背景:AI训练数据版权之争

近年来,AI公司大量抓取网络内容用于训练大模型,引发了一系列诉讼和许可协议。Reddit、Stack Overflow等平台纷纷与AI公司签订数据授权合同,而Twitch此次选择“内部消化”——将内容用于母公司亚马逊自己的AI研发,既绕开了外部授权谈判,也避开了公开市场的定价压力。

然而,创作者并非完全反对AI训练,而是反对“被代表”。许多主播在直播中投入的原创内容——包括即兴表演、教程和社群互动——具有明显的个人创意价值。默认贡献给AI模型,且无法分享模型收益,使得创作者感到自己的劳动被无偿“征用”。

编者按:选择退出的悖论

“选择退出”看似给了创作者控制权,实则设置了高昂的“认知税”。绝大多数主播可能不会注意到繁复的设置菜单,更不用说理解AI训练条款的法律含义。这与欧洲GDPR强调的“明确同意”原则背道而驰。更值得警惕的是,一旦AI模型完成训练,即便主播后续退出,数据可能已不可逆地融入模型参数之中。

或许,问题的症结不在于“默认开启”还是“默认关闭”,而在于平台是否愿意真心尊重创作者的自主权。就像Minton无意中透露的那样,如果正面征求同意,答案将是一边倒的拒绝。技术公司显然深知这一点,所以他们选择了另一条路——让沉默成为默认的许可。

本文编译自TechCrunch