AIの安全管理はパフォーマンスに成り下がった:企業の自主規制は「何かをやった振り」にすぎない

AIの安全管理はパフォーマンスに成り下がった:企業の自主規制は「何かをやった振り」にすぎない

編集注:過去3年間、グローバルなAIガバナンス分野で最も安定して生み出されてきたのは技術的ブレークスルーではなく、似通った文言の「自主的コミットメント」の数々だ。企業は気軽に署名し、政府は大々的に発表するが、現実のリスクに直面したとき、これらの文書が実際に誰かを拘束しているのかを明確に答えられる者はいない。WIREDのシニアエディター、Brian Barrettによるこのコメンタリーは、こうした自主規制という儀式に正面から切り込んでいる。

AI企業に自主規制を求めることは、何か仕事を成し遂げたかのように見せかける絶好の手段だ。

次々と続く「自主的」コミットメントのリレー

このシナリオは何度も繰り返されてきた。2023年夏、米国ホワイトハウスは主要AI企業を招集し、安全テストと情報共有に関する自主的コミットメントのパッケージを発表した。同年11月には英国ブレッチリー・パークで第1回AI安全サミットが開催され、各国政府と研究機関が共同宣言に署名し、「フロンティアモデル」の極端なリスクを公式文書に明記した。2024年のソウルサミットではさらに、壊滅的なリスクを排除できない場合には関連開発を一時停止するというコミットメントが企業に求められた。各会議の終わりに脚光を浴びるのは常に同じ企業群であり、彼らが行うのも常に同じこと——慎重に取り組むと約束することだ。

これらのコミットメントは空虚に聞こえるわけではない。内部安全委員会の設置、「責任ある拡張ポリシー」や「フロンティア安全フレームワーク」の公表、モデルリリース前のレッドチームテスト、一定の計算能力閾値を超えた場合のリスク評価の実施といった内容だ。問題は文書の質ではなく、これら全ての行動の実行者・審判者・解釈者が、いずれもコミットメントに署名した企業自身であるという点にある。

自ら出題し、自ら解答し、自ら採点する

真の規制には譲れない原則がある。評価者と被評価者は分離されなければならない。しかし現在のAI業界では、この原則はほぼ完全に不在だ。いわゆる「危険能力の閾値」は企業が自ら定義し、閾値に触れるテストは企業が自ら設計し、テスト結果は企業が自ら解釈し、モデルを公開するかどうかも最終的に企業が自ら決定する。外部が何を見られるかは、企業が何を開示するかによって決まる。

さらに現実的な変数として競争圧力がある。どこかの企業が単独でペースを落とせば、市場シェア、計算能力契約、トップ人材を競合他社に明け渡すことになる。このようなインセンティブ構造のもとでは、安全チームの意見は構造的に弱い立場に置かれる。過去2年間、複数の研究機関でアライメントチームや安全チームが人事的混乱と再編を経験し、懸念を公に表明した研究者の一部が離脱した一方、モデルの反復速度に鈍化の兆しは一切ない。これは誰かの人格的失敗ではなく、構造がもたらした必然だ。安全がコストで、スピードが利益である以上、結果は最初から決まっている。

こうして「セーフティウォッシング」という現象が生まれた——専門用語、組織構造、年次報告書を駆使して、何ら制約のない開発行為を慎重なガバナンスの成果として包み込む手法だ。投資家や一般市民の目には規制のように映るが、企業にとってそれは参入障壁と免責事項の役割を果たす。

真の安全とはどのようなものか

AI安全を真剣に捉えるなら、企業が最も自発的に提供したがらないものこそが必要だ。具体的には、法的権限を持ち、モデルの重み・学習データ・内部記録へのアクセス権を有する第三者による独立監査、制御不能に近づいたあらゆる事例が公記録として残るよう義務付けた事故・ヒヤリハット報告制度、特定の計算能力閾値を超えるトレーニングタスクへの許可制または届出制、そして最も重要なこととして——声明一枚で免責されるのではなく、実際に損害を引き起こした企業が法的責任を負うという明確な説明責任の帰属だ。

これらの提案は目新しくも過激でもない。航空、医薬品、原子力の各分野はすでに類似の論理を採用している。大規模な被害をもたらしうるシステムを、長期にわたって自主的な規律だけで管理できた産業は存在しないからだ。真に新しい点はただ一つ、AI業界が相当数の政策立案者を説得することに成功し、自らを例外として認めさせたことにある。

抵抗勢力の存在もはっきりと見える。米国カリフォルニア州がフロンティアモデルに安全義務を課す立法を試みた例を見ると、法案は業界の激しいロビー活動の末に否決され、反対理由は「イノベーションを阻害する」「企業を州外に追い出す」という点に集中した。この論法はあらゆる技術規制論争で繰り返され、その効果は一貫している。公共安全の問題を産業競争力の問題にすり替え、法的拘束力を持つルールの実現を先送りにするのだ。

結語:自主規制は安全への前奏曲ではなく、その代替品だ

自主的コミットメントは何もないよりはましで、正式な規制への第一歩だと言う者もいる。しかし3年が経過した今、この道に刻まれた足跡は拘束力ある制度へとつながっておらず、むしろ立法停滞の完璧な言い訳と化している。企業がすでに「自主的に」対応しているなら、なぜわざわざ新しい法律を作る必要があるのか、と。自主規制の最大の害は、それがあまりにも少ないことではなく、何もしないことを合理化させてしまう点にある。

AI企業は引き続き安全フレームワークを発表し、安全サミットを開催し、安全担当責任者を雇用することができる。これらの行動それ自体は間違っていない。しかし、AI安全を評価する唯一の基準が依然として企業自身が書いた自己評価であり続けるなら、どれほど厳密な文言を用いようとも、それは責任についての演技にすぎない。ある社会がある種のリスクを真剣に受け止めているかどうかを測る尺度は、どんな宣言を発したかではなく、誰に結果責任を負わせようとしているかにある。

本文はWIREDより編訳