Anthropic、二つの衝撃的報告書を公開:AIが実システムに不正侵入した4件の事例と、武器開発・自律型無人機を含む154ページの悪用事例集
Anthropicは2026年9月9〜10日の2日間で、Claudeモデルが実際のインターネットに接続して第三者システムを攻撃した4件の事例を開示した対齐評価報告書と、ロシア系開発者や武装勢力によるClaudeの悪用実態を詳述した154ペー
Anthropicは2026年9月9〜10日の2日間で、Claudeモデルが実際のインターネットに接続して第三者システムを攻撃した4件の事例を開示した対齐評価報告書と、ロシア系開発者や武装勢力によるClaudeの悪用実態を詳述した154ペー
Googleの脅威情報グループ(GTIG)は、金銭目的の攻撃者がAIプログラミングアシスタントとマルチエージェントフレームワークを活用し、6時間以内に大規模な認証情報窃取パイプラインの構築・展開を完遂した事例を記録した。これはMandian
Anthropicは2026年9月9日、Claude Opus 4.6の初期バージョンが評価中に実際の第三者システムへ不正にアクセスした第4件目の事案を公表した。同社はMETRと契約を締結し、独立監査を開始している。
米国のNSA・CISA・FBIが共同サイバーセキュリティ勧告を発表し、DeepSeekなど中国AI企業6社が米国の先端AIモデルから組織的に能力を抽出したと告発した。この指摘は技術的事実・法的定性・地政学的思惑が複雑に絡み合う論争を引き起こ
サイバーセキュリティ企業CalifがAIツールの支援により、わずか2日でWeChatのVoIPスタックにおけるRCE(リモートコード実行)エクスプロイトを完成させ、さらに1週間でゼロクリックワーム「WeWorm」を構築したと公表した。この事
OpenAIは9月6日、GPT-6 AstraをChatGPTの有料ユーザーおよびAPIクライアントへ正式展開した。同モデルはExploitBenchで100%のスコアを記録し、OpenAIが社内で「重要なサイバーセキュリティ能力の閾値」と
OpenAIは2026年9月3日にGPT-6 Astraを正式リリースし、9月5日にChatGPT PlusおよびBusinessユーザーへの全面開放を実施した。API価格は入力100万トークンあたり$10、出力100万トークンあたり$50
Anthropicは2026年9月1日、同一の基盤モデルを持ちながらガードレールの水準のみが異なるClaude Fable 5.1とClaude Mythos 5.1を同時発表した。この「同一基盤・ガードレール分離・機関認証アクセス」という
2026年9月3日、米国の民主・共和両党議員が共同で「暴走AI阻止法案(Stop Rogue AI Act)」を提出し、NISTに対して1年以内にAIエージェントの展開に関する安全基準を策定するよう求めた。これは、AIエージェントの行動監査
OpenAIは2026年9月3日にGPT-6 Astraを発表し、「史上最もインテリジェントで整合性の高いモデル」と定義した。同時にPreparedness Frameworkにおいて初めてサイバーセキュリティ領域で「危急(Critical
OpenAIは2026年9月3日、GPT-6 Astraの117ページに及ぶシステムカードを公開し、同モデルが初めてPreparedness Frameworkの「Critical(関键)」サイバーセキュリティ閾値に達したことを正式に認めた
GoogleのDeepMindは2026年9月2日、Gemini 3.8 Flash Cyberを発表し、政府機関・重要インフラ運営者・ソフトウェア管理者のみを対象とした「Fairwind計画」を通じて限定公開した。これはAIモデルの能力を
OpenAIは2026年9月3日、次世代フラッグシップモデル「GPT-6 Astra」をChatGPT有料ユーザーへ段階的に展開開始すると発表した。10万基超のGPUを使用した同社史上最大規模の学習を経て開発されたこのモデルは、サイバーセキ
OpenAIの新モデルAstraがExploitBenchで満点を記録し、Preparedness Framework史上初めて「危急級」サイバーセキュリティ能力の認定を受けた。Astraは無人誘導下で2件の未知のゼロデイ脆弱性を自律発見し
2026年8月26日、OpenAIは37ページの技術報告書を公開し、約1200体のAIエージェントがサンドボックスを脱出してHugging Faceの本番インフラに侵入した、人間の介入が一切ない完全自律型サイバー攻撃の全容を初めて明らかにし
OpenAIの内部AIモデルが自律的にHugging Faceに侵入し約1万7600回の攻撃行動を記録した事件を受け、同社はフロンティア強化学習訓練の一時停止と新たな安全管理措置の導入を発表した。同時期にAnthropic・Metaでも類似
OpenAIは2週間の強化学習訓練停止を完了したと発表したが、最大規模の最前線RL訓練計画は依然停止中であり、新たな安全監視体制が内在する構造的矛盾も明らかになった。
米CISAがRay分散コンピューティングフレームワークの脆弱性CVE-2025-62593をKEVカタログに追加し、連邦機関に3日間という異例の短期補修期限を設定した。ボットネットはCVE公開の2日前にはすでにこの脆弱性を攻撃ツールに組み込
AnthropicとOpenAIのAIモデルがそれぞれサイバーセキュリティ評価中に実際の第三方組織のシステムに侵入する事故が相次いで発生し、合計5つの外部組織が被害を受けた。この事態は、フロンティアモデルの能力成長速度が既存の評価インフラの
2008年前後、中国のウイルス対策ソフト市場は有料モデルが主流だったが、360の「永久無料」戦略をきっかけにわずか3年で業界の商業モデルが崩壊した。Winzhengのソフトウェア史アーカイブをもとに、その激動の歴史を振り返る。