MLCommons代理可靠性框架入围全球监管黑客马拉松

MLCommons代理可靠性框架入围全球监管黑客马拉松

如何判断AI代理是否会严格遵守其权限范围?这是金融机构及其监管机构目前难以自信回答的问题,也是MLCommons金融服务工作组推出的Agent Reliability Profile的核心议题。该框架已成功入围C:>DIR全球“Agentic Regulator”黑客马拉松决赛。

为何重要

AI代理不仅能回答问题,还能执行实际操作,这使其功能强大,但也要求机构和监管者必须找到可靠方法,明确代理被允许执行的操作范围,以及是否真正遵守这些限制。目前的代理身份标准可以证明代理“是谁”,却无法说明代理连接到金融数字基础设施后“应该被授权做什么”,这一缺失被称为授权与监督空白。

Agent Reliability Profile是工作组的旗舰项目,旨在通过标准化、与监管兼容的框架,描述、验证并基准测试金融服务中代理部署的可靠性,从而填补这一空白。

C:>DIR黑客马拉松

C:>DIR由剑桥大学数字创新与监管倡议主办,获得BIS创新中心、全球金融创新网络(GFIN)以及数字监管合作论坛等35家以上机构支持。这是一场面向监管机构和行业的全球竞赛,旨在构建实用、可部署的原型,以增强代理AI的信任与问责机制。

竞赛规模彰显了业界对该问题的关注:共收到来自65个国家以上的336份提交,最终36支团队(每个问题领域6支)晋级决赛。

我们的提交

由工作组联合主席Mike Hsu和Medha Bankhwal提交的作品,角逐了解你的代理(KY-A)、数字验证与数字公共基础设施赛道。该提交展示了基于Agent Reliability Profile构建的两款工具:

  • Profile Builder:读取机构的自身证据(设计文档、配置导出、政策),将其编译为Level 1断言配置文件,并突出显示所述意图与实际构建配置之间的差异。
  • Profile Validator:将配置文件作为测试规范,针对真实系统行为进行证伪测试,最终生成Level 2验证配置文件。

演示在开放银行数据共享与同意场景中应用这两款工具,测试代理是否严格遵守客户实际同意的数据共享范围,这是对授权与监督空白的真实、高风险检验。

后续安排

决赛构建阶段为9月1日至8日。现场演示和由剑桥监管访问学者计划监管研究员组成的评审团评判将于9月15-16日进行。获奖结果将于2026年9月18日在C:>DIR峰会上公布。

本文来自 MLC 博客,赢政天下(winzheng.com)进行了全文翻译。 点击这里查看原文 如果转载中文,请注明出处,谢谢支持!