2026年8月,艺术社区Cara正经历一场前所未有的攻击。一群网络喷子利用自动化脚本,将平台上大量创作者的原创作品批量下载,随后在社交媒体上公开展示,以此嘲讽这个以“拒绝AI训练”为旗帜的平台。Cara创始人团队紧急部署防护策略,却发现攻击手段远比想象中复杂——这些脚本能够模拟真人操作,绕过基础的速率限制和验证码。
然而,最令人意外的是,一位曾经站在艺术家对立面的“对手”主动联系了他们。数年前,他曾是某大型AI数据公司的算法工程师,主导过从互联网上大规模抓取图像数据的项目,其中就包含许多后来被用于训练图像生成模型的作品。那时,他认为这些公开上传的画作是“免费的学习资料”,直到他看到艺术家们的集体抗议和控诉邮件。
从盗猎者到守护者
“我意识到,我犯了一个根本性的错误。”他在接受WIRED采访时坦言,“技术上的‘公开’并不等于道德上的‘同意’。我亲手破坏了无数创作者赖以生存的生态,却从未想过他们会有多痛。”而如今,他用自己最熟悉的攻击技术,反过来为Cara构建一道新的防线。
“我意识到,我犯了一个根本性的错误。技术上的‘公开’并不等于道德上的‘同意’。”——匿名数据工程师
据Cara团队透露,这位工程师与平台方合作开发了一套动态指纹识别系统。该系统会在每件上传的艺术品中植入肉眼不可见的数字水印,并在加载页面时加入基于客户端行为的实时检测。一旦检测到可疑的批量抓取模式,服务器会立即返回经过“污染”的图像数据——这些数据虽然视觉上与原始作品无异,但内部特征已被打乱,若被用于AI训练,将显著降低模型的学习质量。
AI数据伦理的转折点?
这并非个例。随着AI生成工具的普及,越来越多艺术平台开始采用对抗性技术来保护创作者的权益。此前,Glaze和Nightshade等工具已允许艺术家在作品上添加扰动噪声,干扰AI模型的风格学习。而Cara这次的合作,独特之处在于引入了“内部人”视角——一个熟悉商业AI公司数据采集流程的工程师,能精准识别出那些连防火墙都难以捕捉的抓取逻辑。
“我们不想成为AI的敌人,我们只是想要一个选择的权利。”Cara的一位社区代表表示,“如果AI必须学习艺术,那么至少应该让艺术家知道,并给予他们公平的补偿。”这次合作或许标志着一个新趋势:AI产业链上的技术工作者,开始反思自己所建造的系统,并主动寻找与创作者共存的路径。
编者按:技术的双刃剑
这个故事最令人深思的地方,在于同一个人的技能既可以成为伤害的源头,也可以成为修复的工具。当那些曾为AI挖掘数据的人转头成为数据保护者,行业必须重新审视“数据集”的概念。算法不会自带道德属性,真正需要监管的是企业和个人的选择。Cara的案例给所有内容平台提了个醒:与其等待监管落地,不如从技术层面建立起内生的防御机制。
目前,Cara已将该反抓取工具的部分逻辑开源,供其他小型艺术社区使用。虽然无法彻底杜绝所有恶意抓取,但至少让创作者感受到,技术并非总是站在他们对立面。
本文编译自WIRED
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接