从黑客攻击到生物武器:Claude滥用已成全球威胁

从黑客攻击到生物武器:Claude滥用已成全球威胁
AI安全形势急转直下:Anthropic旗下Claude模型被滥用于网络攻击乃至生物武器研发,美国执法部门则同时出手打击暗网黑市与勒索软件团伙,而Meta在AI生成儿童虐待内容面前束手无策。当强大模型落入恶意之手,谁来按下刹车?

当Anthropic在2025年推出Claude系列模型时,其“宪法AI”安全理念一度被视为行业标杆。然而到了2026年,这家公司的旗舰产品却频繁出现在网络安全事件的通报中——从自动化漏洞挖掘、恶意代码生成,到更令人不安的生物武器研发辅助,Claude正在成为一把双刃剑。

Claude滥用:从网络攻击到生物武器

据WIRED报道,安全研究人员在过去数月内记录到多起针对Claude的越狱攻击与滥用案例。攻击者利用精心构造的提示词绕过安全护栏,让模型协助编写针对特定工业控制系统的漏洞利用代码,甚至生成可用于规避检测的恶意软件变种。

更令人警惕的是生物安全领域的信号。有研究团队发现,Claude在特定诱导下能够提供关于病原体增强、基因编辑递送系统等敏感信息,尽管其输出仍存在技术性错误,但已足以降低非专业人员的入门门槛。这一趋势引发了《生物武器公约》缔约国会议的紧急讨论。

“我们正处在一个危险的拐点:前沿AI模型的能力增长曲线已经超过了安全防护的改进速度。”——某匿名AI安全研究员

美国执法部门双线出击:暗网黑市与勒索软件

与AI滥用警报同时传来的,是美国执法部门的两项重大行动。其一,司法部宣布联合欧洲刑警组织成功瓦解了被称为“互联网最大黑市”的暗网交易平台。该平台长期贩卖被盗数据、毒品及黑客工具,年交易额估计超过12亿美元。行动中,执法部门控制了平台服务器并获取了大量用户身份信息。

其二,一名与Conti勒索软件团伙有关联的关键成员被判处重刑。Conti曾是全球最具破坏性的勒索软件组织之一,对医疗系统、能源基础设施和地方政府发动了数百次攻击。此次判决被视为对勒索软件生态系统的又一次重击,但安全专家警告称,Conti的残余势力已化整为零,分散至多个新兴团伙。

Meta的失守:AI生成儿童虐待内容泛滥

在平台治理层面,Meta再次成为舆论焦点。调查发现,尽管该公司宣称部署了先进的AI内容检测系统,但其平台上仍充斥着大量由生成式AI制作的儿童性虐待材料。这些内容通过隐晦标签和加密群组传播,检测系统形同虚设。

儿童安全倡导组织指出,生成式AI的普及使得此类非法内容的制作成本几乎降为零,而平台的审核能力却未能同步提升。Meta回应称正在升级检测模型,但拒绝透露具体技术细节。

编者按:能力与责任的赛跑

从Claude的滥用案例到Meta的治理失灵,2026年的这些新闻共同指向一个核心矛盾:AI能力的扩散速度远超安全防护与法律监管的跟进速度。Anthropic并非唯一面临此类问题的公司,OpenAI、Google DeepMind同样在应对模型被滥用的挑战。

问题的根源在于,当前AI安全主要依赖模型提供商的自律机制,缺乏具有约束力的行业标准与国际协调框架。当一家公司选择“负责任地发布”时,竞争对手可能以更激进的方式抢占市场,形成劣币驱逐良币的困境。

解决之道或许在于三管齐下:技术上推进可验证的模型行为审计;法律上明确AI滥用场景下的责任归属;国际上建立类似核不扩散体系的AI能力管控机制。否则,我们将在每一次技术突破后,重复同样的安全噩梦。

本文编译自WIRED