AIエージェントが自身の権限範囲を厳守しているかどうかをどのように判断するか――これは金融機関とその監督当局が現時点では自信を持って答えられない問いであり、MLCommonsの金融サービスワーキンググループが発表したAgent Reliability Profileが取り組む中心的なテーマでもある。同フレームワークは、C:>DIRグローバル「Agentic Regulator」ハッカソンの決勝への進出を果たした。
なぜ重要か
AIエージェントは質問に答えるだけでなく、実際の操作を実行することができる。これがエージェントを強力にする一方で、機関と監督当局は、エージェントに許可されている操作の範囲と、エージェントが実際にその制限を遵守しているかを確認するための信頼できる方法を見つけることが求められる。現在のエージェントID標準は、エージェントが「誰であるか」を証明できるが、エージェントが金融デジタルインフラに接続した際に「何を行う権限を持つべきか」を示すことができない。この欠如は認可と監督のギャップと呼ばれている。
Agent Reliability Profileはワーキンググループの旗艦プロジェクトであり、標準化された規制適合フレームワークを通じて、金融サービスにおけるエージェント展開の信頼性を記述・検証・ベンチマークすることで、このギャップを埋めることを目指している。
C:>DIRハッカソン
C:>DIRはケンブリッジ大学のDigital Innovation and Regulationイニシアティブが主催し、BISイノベーションハブ、グローバル金融イノベーションネットワーク(GFIN)、デジタル規制協力フォーラムなど35以上の機関から支援を受けている。これは監督当局と業界を対象としたグローバルな競技であり、エージェント型AIの信頼と説明責任を強化するための実用的かつ展開可能なプロトタイプの構築を目指している。
競技の規模はこの問題への業界の関心を示している。65か国以上から336件の応募が寄せられ、最終的に36チーム(各問題領域から6チーム)が決勝に進出した。
応募内容
ワーキンググループの共同議長であるMike HsuとMedha Bankhwalによる応募作品は、「Know Your Agent(KY-A)」、デジタル検証とデジタル公共インフラ部門を競っている。この応募では、Agent Reliability Profileをベースに構築された2つのツールを紹介している。
- Profile Builder:機関自身のエビデンス(設計文書、設定エクスポート、ポリシー)を読み取り、Level 1アサーションプロファイルにコンパイルし、意図された仕様と実際の構築設定との乖離を明示する。
- Profile Validator:プロファイルをテスト仕様として用い、実際のシステム動作に対して反証テストを実施し、最終的にLevel 2検証済みプロファイルを生成する。
デモでは、オープンバンキングのデータ共有と同意シナリオにおいてこの2つのツールを適用し、エージェントが顧客の実際の同意範囲内でデータ共有を厳守しているかを検証した。これは認可と監督のギャップに対する、リスクの高い実際的な検証となっている。
今後のスケジュール
決勝の構築フェーズは9月1日から8日に行われる。現地でのデモとケンブリッジ規制アクセス奨学者プログラムの規制研究員で構成される審査員による評価は9月15〜16日に実施される。受賞結果は2026年9月18日のC:>DIRサミットで発表される予定だ。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接