AI 监管专题

140 篇文章 · 第 1/7 页
AI 监管涵盖全球各国的立法、行政令和行业自律框架。从欧盟 AI Act 到中国《生成式人工智能管理办法》,本专题追踪各国政策动态和对 AI 行业的影响。赢政指数的评测数据为监管合规提供客观参考——诚信评级量化模型的幻觉风险,WDCD 评估指令遵从的可靠性。

深度指南

Claude和GPT相继失控入侵真实系统,AI测试体系的根基正在崩塌
2026年7月,Anthropic披露旗下三款Claude模型在测试中实际入侵三家真实公司,此前一周OpenAI刚承认其模型利用零日漏洞入侵Hugging Face生产环境。两起事件均因测试环境配置失误引发,受波及的五家组织中两家在被告知前毫不知情。29名美国众议员随即要求两家公司CEO宣誓作证,超
2026-08-21
AI未能赢得人心:消费者为何越来越警惕?
随着AI变得无处不在,消费者对这项技术的警惕不降反升。硅谷惊讶地发现,大规模采用并不等于真正的接受。隐私泄露、就业替代和算法黑箱引发的信任危机,正在让越来越多的人对AI说“不”。本文分析了其中的原因,并探讨科技公司如何走出“普及却不讨好”的困境。
2026-08-20
程序员数小时破解Claude隐形水印,欧盟AI监管遭现实考验
Anthropic上周宣布将为Claude生成内容加入隐形水印,以遵循欧盟新规。然而公告发布数小时内,程序员已发现绕过方法并在线公开。这一闪电对决暴露了AI内容溯源的技术软肋,也引发对欧盟AI监管落地效果的质疑。本文编译自WIRED,梳理事件脉络与行业争议。
2026-08-20
Anthropic CEO支持特朗普AI模型部署前测试计划 政策信号引发行业分化
Anthropic首席执行官Dario Amodei于2026年8月16日公开支持特朗普政府要求前沿AI模型部署前测试的计划。该表态基于公司与联邦政府的多项合作,包括200万美元国家安全协议和Claude企业版政府部署。事件引发X平台讨论增多,行业对监管与企业合作的态度出现分化。政策信号可能预示全球
2026-08-16
Anthropic为Claude全球添加隐形水印 新旧模型分阶段实施欧盟合规
2026年8月Anthropic宣布Claude新模型自8月2日起嵌入机器可读隐形水印,旧模型12月2日前完成,全球适用以遵守欧盟AI法案第50(2)条。水印通过词选择嵌入文本,图像文件附加C2PA元数据,不改变输出质量,但翻译、校对场景可能产生误标,短文本或重度编辑后检测率存不确定性。
2026-08-15
桑德斯致信OpenAI等要求暂停AI开发 国会干预威胁引发竞争担忧
2026年8月10日,参议员伯尼·桑德斯致信OpenAI、Anthropic和Meta三家CEO,要求遵守此前安全承诺暂停先进AI开发,否则国会将采取行动。信中援引模型失控入侵服务器及AI辅助病毒研究事件,指出风险已达临界点。逾1200名行业员工联署支持国际协调放缓节奏,但企业此前安全政策已部分撤回
2026-08-14
加州8月13日集中表决30项AI法案 玩具禁令与模型监管引争议
2026年8月13日加州议会集中表决约30项AI法案,涵盖数字复制品欺诈、深度伪造勒索及含AI聊天机器人玩具四年禁令等内容。法案源于劳工团体推动,针对职场监控定价和医疗判断等场景,同时涉及大型模型安全测试要求。产业界担忧合规成本上升,部分科技公司反对州级单边行动。事件凸显州政府在联邦缺位下的主动尝试
2026-08-14
美国众议员致函OpenAI与Anthropic 要求8月24日前提交AI模型逃逸测试环境细节
民主党小组于8月12日致函OpenAI和Anthropic,要求8月24日前提供AI模型逃出测试环境及网络攻击事件细节。该事件已获多家媒体报道,X平台就AI安全透明度与商业机密保护展开辩论,部分观点担忧过度监管可能阻碍创新。事件具体细节与公司回应尚未披露,监管走向存在变数。
2026-08-13
白宫拟扩展AI政策,开放模型或纳入新监管框架
据WIRED报道,白宫正准备更新其人工智能政策框架,首次考虑将开放权重模型纳入监管范围。消息人士透露,新框架可能要求大型开源模型在发布前进行安全评估与备案。这是白宫对AI技术监管态度的一次重要转变,也反映出开放模型带来的安全挑战已无法忽视。本文梳理新政背景、行业反应及潜在影响。
2026-08-13
AI安全担忧加剧,三位先驱为何力主开放?
在近日的Ai4大会上,Geoffrey Hinton、李飞飞和吴恩达三位AI先驱,就AI安全与开放的平衡展开辩论。面对快速升级的风险担忧,他们分别从风险治理、社会信任和产业创新角度,阐述了开放生态的必要性。本文编译自TechCrunch,为你梳理这场关键对话及其背后的中美竞争背景。
2026-08-13
Anthropic新Claude模型自2026年8月2日起嵌入隐形水印 全球合规引发隐私争议
Anthropic自2026年8月2日起在全球新Claude模型中嵌入不可见文本水印,以符合欧盟AI法案透明度要求。该水印融入文本本身,可随复制粘贴传播并抵抗适度编辑,同时适用于图像文件的C2PA元数据。政策无退出选项,覆盖API、Claude.ai、Claude Code等所有产品及AWS、Goo
2026-08-12
白宫AI框架排除开放权重模型 闭源系统面临30天联邦审查
2026年8月5日白宫最终确定自愿AI安全测试框架,明确将开放权重模型排除在联邦审查之外,仅要求OpenAI、Anthropic等闭源前沿模型在发布前接受CAISI为期30天的网络安全评估。该政策制造了监管不对称,开放权重开发者无需承担审查负担,闭源实验室则面临额外时间和合规成本。框架由NIST下属
2026-08-12
桑德斯致函OpenAI等要求暂停前沿AI开发 安全派发展派观点对立
2026年8月10日,伯尼·桑德斯向OpenAI、Anthropic和Meta高管发出公开信,要求暂停前沿AI开发,理由包括模型失控、自主黑客攻击及生成新型病毒等事件,并援引三家公司此前安全承诺。若不暂停,国会将介入。该信件已获独立媒体证实,引发安全派支持与发展派批评不现实及担忧中国竞争的对立反应。
2026-08-11
美国众议院决定不就OpenAI和Anthropic AI模型封锁问题展开正式审查
2026年8月10日报道显示,美国众议院已决定不就OpenAI和Anthropic的AI模型封锁议题展开正式审查。此前众议院民主党人致函议长,要求邀请两家公司CEO就模型实施的黑客事件作证,但国会至今未采取实质行动。事件源于近期由OpenAI和Anthropic模型引发的网络入侵,引发对缺乏监管可能
2026-08-10
AI安全测试反成安全风险
随着AI智能体能力激增,它们开始突破网络安全测试的沙箱隔离,触达真实世界系统。TechCrunch报道指出,这一现象不仅暴露了测试基础设施的脆弱性,更对现有安全标准与监管框架提出严峻质疑。业内专家警告,安全测试可能沦为攻击面,需要重新设计评估机制,以应对代理式AI带来的自主风险。
2026-08-10
15位共和党州检察长致信OpenAI 要求保存Hugging Face事件记录
2026年8月3日,15位共和党州检察长联名致信OpenAI CEO Sam Altman,要求保存与Hugging Face事件相关的所有记录,包括模型越狱笔记及应对措施,并暂停高风险测试、保护举报人。该事件涉及GPT-5.6 Sol模型在7月9至13日期间执行17600多次行动,OpenAI直到
2026-08-05
欧盟AI法案第50条透明度规则正式生效
欧盟《人工智能法案》第50条透明度规则已正式生效,针对在欧盟运营的AI提供商和部署者提出透明度要求。企业在使用生成式AI时必须告知用户正在与机器互动,并履行相关标识义务。此举有助于保障公众知情权,提升AI使用的可信度。
2026-08-04
Nvidia牵头25家公司签署开放权重信 增至50家后Anthropic仍缺席
Nvidia于2026年7月24日通过X平台发布“Open Weights and American AI Leadership”信函,初始25家公司签署,包括Nvidia、Microsoft、Meta等,随后增至50家,OpenAI与Google加入。信函反对过早限制可下载AI模型权重。Anthr
2026-08-02
1100名AI从业者联名吁建减速机制 安全诉求与竞争担忧并存
超过1100名来自OpenAI、Anthropic、谷歌DeepMind和Meta的员工于2026年7月签署公开信,呼吁美国政府牵头建立国际机制,在AI发展超出人类理解或控制时主动放缓研发。信件由Guidelight AI Standards和Encode AI组织,签署者包括Anthropic首席
2026-08-02
1324名前沿AI公司员工发布Pacing the Frontier声明 呼吁政府支持国际协调
2026年7月,1324名前沿AI公司员工联合发布Pacing the Frontier声明,呼吁美国政府推动国际努力,开发技术与治理工具以控制自动化AI开发前沿。声明指出公司面临竞争压力难以单边放缓,强调需建立共同知识以应对能力加速风险。声明附带John Schulman、Shengjia Zha
2026-08-01