米中、AI国家安全インシデント通報メカニズムの設立を協議

米中、AI国家安全インシデント通報メカニズムの設立を協議

WIREDの報道によると、米国と中国の当局者は近日、珍しいテーマについて意見を交わした。国家安全保障を脅かす可能性のあるAIインシデントが発生した際に、両国が速やかに相互通知できる二国間通報メカニズムの構築である。この構想が実現すれば、AIリスクに特化した米中間初の制度化されたコミュニケーションチャンネルとなる。

報道によれば、関連協議はまだ初期段階にあり、メカニズムの適用範囲、発動条件、情報共有の深度についていまだ合意には至っていない。しかし、この問題を正式に議題として取り上げたこと自体、複数の観察者からシグナルとみなされている。チップ、算力、モデル能力をめぐる競争が激化する中でも、両国は少なくとも一つの共通前提を認めた——特定のAIリスクは国境によって止まらない、という認識だ。

「AIインシデント」に対応するホットライン

通報メカニズムの論理は、冷戦時代の米ソ間の核リスク低減ホットラインに部分的に似ているが、対象がミサイルからモデルに変わっている。想定される典型的なシナリオには以下が含まれる。大規模な自動化サイバー攻撃にAIが関与している兆候を一方が発見した場合、重要インフラがAIの制御不能や誤判断により異常を来した場合、先進モデルの能力パラメータや重みが予期せず流出した場合、そして軍事・諜報目的への利用が懸念されるAIシステムで深刻な障害が発生した場合だ。こうした事態が生じた際、相手国はしばしば潜在的な被害者であると同時に、確認と被害封じ込めを支援できる唯一の当事者でもある。

従来の軍備管理問題と異なるのは、AIインシデントの境界が極めて曖昧な点だ。モデルのジェイルブレイク、訓練データへのポイズニング、自動化された脆弱性探索が、サイバーセキュリティ上の出来事なのか、商業上の紛争なのか、それとも国家安全保障上の脅威なのか、各者の判断基準は一致していない。つまり、通報メカニズムが最初に解決すべきは定義の問題だ。何を「インシデント」と呼ぶか、誰が認定する権限を持つか、認定後は誰に報告するか、である。

通報メカニズムの核心は技術の共有ではなく、「事故」の共有だ。AIガバナンスにおいて、透明性と国家安全保障の境界線は一度も明確になったことはなく、まさにその境界線がメカニズムの射程を決める。

なぜ今なのか

AIをめぐる米中間の公式接触は今に始まったことではない。2023年のサンフランシスコ首脳会談後、両国は人工知能の安全性とリスクについて政府間対話を行うことで合意し、その後ジュネーブなどで複数回の会談を実施した。議題は主に、核兵器の指揮統制におけるAI、自律型兵器システム、AIセキュリティのベストプラクティスに集中していた。一方で、米国は先進チップと半導体製造装置の対中輸出規制を強化し続け、中国は重要鉱物の輸出管理と国産代替案で応じており、技術競争という基調は変わっていない。

こうした背景の中で通報メカニズムが「現実的」とみなされているのは、最も難しい部分を迂回しているからだ。いずれの側にも自国のモデル能力の制限を求めず、輸出規制政策の変更も求めない。極端な状況下での最低限の情報流通を維持するだけでよい。誤判断を避けたいが競争において弱さを見せたくない双方の政府にとって、これは比較的コストを抑えられた選択肢だ。

メカニズムで解決できることと、できないこと

支持者は、AIリスクの特殊性はその速度にあると主張する。自動化システムによる大規模攻撃やモデルの重みの流出は、数時間、場合によっては数分以内に国境を越えた波及効果を生む可能性があり、従来の外交チャンネルの対応速度では到底追いつかない。常時利用可能な通報チャンネルがあれば、技術的な事故を意図的な攻撃と誤認する確率を下げ、危機を沈静化させる時間的余裕を生み出せる。

しかし、反論も説得力を持つ。第一に、何を「重大なAIインシデント」とみなすか、誰が認定するのか。認定権が一方的に握られていれば、メカニズムは世論操作の道具として使われる余地が生まれる。第二に、通報そのものが能力情報の暴露を伴う可能性がある——例えば、特定の攻撃帰属能力や特定モデルの存在を事実上認めることになり、諜報面での新たなリスクを生む。第三に、メカニズムは非国家行為体を拘束できない。真に危険なAIインシデントは、いかなる政府も直接指揮しない攻撃者から生じる可能性が高く、こうした主体は二国間の枠組みに最も組み込みにくい。

より根本的な問題は信頼だ。通報メカニズムの前提は、相手が提供する情報がおおむね真実かつ完全だと双方が信じることだが、これこそ現在の米中関係で最も乏しい資源だ。メカニズムが構築されても長期にわたって機能不全に陥れば、リスクを低減するどころか「リスクはすでに管理下にある」という錯覚を生み出しかねない。そうなれば、各自が防衛能力と独自の検証能力の構築に引き続き投資する動機が削がれてしまう。

注目すべき次の三つのシグナル

第一に、この議題が実務レベルの協議から正式な二国間文書や共同声明へと格上げされるかどうか。第二に、相互不信を和らげるため、国際原子能機関に類する技術機関や学術的な中立チャンネルといった第三者の役割がメカニズムに導入されるかどうか。第三に、通報の範囲が政府間に限定されるのか、それとも主要なAI研究機関をある種の報告義務やインシデント開示の枠組みに組み込むかどうかだ。

最終的にどのような結果になるにせよ、この協議自体が示しているのは、AIガバナンスが企業の自主規制や学術的な提言から、国家間リスク管理という深みへと移行しつつあるという事実だ。この領域において、最大のリスクはしばしば、一方が速く進みすぎることではなく、双方が相手の動向を把握できていないことにある。

本稿はWIREDを翻訳・編集したものです。