2026年6月30日、Anthropicは傘下のClaude Fable 5モデルについて、7月1日よりグローバルユーザーへのサービスを再開すると発表した。米国の輸出規制により約3週間停止していた制限が解除されるとともに、新版安全分類器が公開され、Amazon・Google・Microsoft・米国政府との連携によるAIジェイルブレイク評価フレームワークが構築された。
今回のサービス再開は、米国政府が6月12日にFable 5および安全制限をより緩和したバージョンであるClaude Mythos 5に対して輸出規制を実施し、外国籍ユーザーによる両モデルの使用禁止を求めたことに端を発する。利用者の国籍をリアルタイムで確認できないため、Anthropicは当時すべてのユーザーのアクセス権を停止した。6月30日の規制解除後、Fable 5はClaude.ai・Claude Platform・Claude Code・Claude Coworkなどのプラットフォームで再開され、Mythos 5については一部の米国組織への提供から先行して再開された。
メカニズムの解説
事件の発端は、Amazonの研究者がFable 5において特殊なプロンプトによって一部の安全制限を回避し、ソフトウェア脆弱性情報を取得したり、エクスプロイトのデモコードを生成したりできることを発見したことにある。Anthropicはこうした能力はFable 5に固有のものではないと指摘しつつも、政府と協力して安全分類器を更新した。新版分類器は関連するジェイルブレイク手法の99%超を遮断でき、リクエストが高リスクのサイバーセキュリティコンテンツに関わると判断した場合、応答を拒否してClaude Opus 4.8に処理を移管する。同社は新たなメカニズムが通常のプログラム開発作業における誤検知率を高める可能性があることを認め、今後も継続的に調整していくとしている。評価フレームワークは、能力向上の幅・適用範囲・兵器化の難易度・技術取得のハードルに基づいて分類される。
トリガーメカニズムの観点から見ると、Amazonの研究者が発見した回避経路は、Fable 5が特定のプロンプトの組み合わせに直面した際に安全境界が局所的に失効し、本来制限されていた脆弱性情報やデモコードが出力されてしまうことを示している。こうした能力はAnthropicが明確に述べるようにFable 5固有のものではないが、それでも規制解除後に直ちに新版分類器を展開させる契機となった。同分類器は99%超の遮断率を中核指標とし、高リスクのサイバーセキュリティリクエストに対して直接拒否しClaude Opus 4.8へ転送するという戦略をとり、二層防御構造を形成している。Anthropicは同時に、この設計が通常のプログラム開発フローに追加的な誤検知をもたらす可能性があることを認めており、今後の調整は継続的な取り組みとなる。
評価フレームワークの分類ロジックは、上記の防御の適用範囲をさらに細分化している。能力向上の幅・適用範囲・兵器化の難易度・技術取得のハードルの4要素を中核次元として、異なるジェイルブレイクの試みを体系的に分類する。この分類方式により、安全分類器は遮断率を99%超に維持しながら、低リスクのリクエストへの応答柔軟性を保ち、過度な締め付けによって開発者体験が全般的に損なわれる事態を回避できる。
産業への影響
今回のFable 5のサービス再開と新版安全分類器の展開は、AIモデルの商業化経路に対して直接的な先例効果をもたらす。AnthropicがAmazon・Google・Microsoft・米国政府と連携して評価フレームワークを構築したことは、輸出規制解除後にモデル提供者がコンプライアンスと可用性の間でより緊密な連動メカニズムを確立する必要があることを示している。Fable 5がClaude.ai・Claude Platform・Claude Code・Claude Coworkなど複数プラットフォームで同時に再開されたことは、そのサービス再開が個人ユーザー・企業開発・コラボレーションシーンのいずれにも同時に影響を与えることを意味する。一方、Mythos 5が先行して一部の米国組織にのみ再開されたことは、安全制限レベルが異なるバージョンが規制解除後に異なる経路をたどることを際立たせている。
安全分類器の遮断率99%超という設定、および高リスクリクエストをClaude Opus 4.8で処理するフローは、AI産業全体の安全基準の参照点となるだろう。企業ユーザーはプログラム開発時に誤検知率上昇という実際の課題に直面する可能性があり、これはAnthropicに対してサービスの可用性と安全性のバランスを維持するための継続的なメカニズム調整を求めることになる。こうした調整はAnthropicの製品ロードマップに影響するだけでなく、同業他社がモデルリリース時に同様の分類評価フレームワークを事前に組み込むよう促す可能性もある。
戦略的判断
戦略的観点から見ると、Anthropicが規制解除当日に新版分類器と評価フレームワークを同時に公開したことは、グローバルサービスを再開しながら安全コンプライアンスを優先強化するという判断を体現している。評価フレームワークが能力向上の幅・適用範囲・兵器化の難易度・技術取得のハードルに基づいて分類されることは、Anthropicが今回の事案を単一モデルへの一時的措置ではなく、長期的なリスク管理ツールへと転化しようとしていることを示している。
同社が新たなメカニズムによって通常のプログラム開発作業の誤検知率が高まる可能性があることを認め、継続的な調整を約束したことは、安全遮断率とユーザー体験の間で動的なバランスを模索するという戦略的考慮を反映している。この動きはAmazonの研究者が発見した回避経路への対応であると同時に、Mythos 5など安全制限が緩いバージョンの今後の開放に向けた政策的余地を残している。総じて、Fable 5の再開プロセスは、AIモデル提供者が輸出規制に直面した際に、国籍確認の困難という問題を、より広範な安全分類器のアップグレードと省庁横断的な協力フレームワークへと転換することで、サービスの継続性を維持する必要があることを示している。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接