Meta承包商伪装未成年人向竞品发送4.5万有害提示测试安全护栏

Meta通过承包商Covalen实施Cannes项目,2025年8月单轮测试向ChatGPT、Gemini和Character.AI发送超4.5万条有害提示,承包商伪装未成年人使用虚拟账户生成自杀、自残、饮食障碍及性话题内容。Meta称此为标准安全基准测试,未用于训练自家模型,但引发承包商不适及竞品条款争议。文章从事实还原、机制拆解、产业影响和战略判断角度分析AI安全评估的伦理困境与竞争格局变化。

AI安全测试 Meta 竞品评估
514