AI安全性 に関するニュース

オリジナル

オープンソースAIエージェントが台湾政府を自律的に侵害――21システムをマッピングし2500件の記録を窃取

2026年8月12日に公開された攻撃記録によると、オープンソースフレームワーク「Hermes」と「OpenClaw」が4日間で台湾の21の政府システムをマッピングし、85アカウントへの侵入と2500件超の人員記録の窃取に成功した。標的の一部

AI安全性 网络攻击 政府系统防护
771
オリジナル

主要AIモデルAPIの暗号化推論トレースが抽出可能と判明――大手3社がプライバシー漏洩リスクに直面

研究チームが2026年8月11日に発表した論文により、OpenAI・Anthropic・GoogleのAPIが暗号化されたチャンクとして返却する推論トレースが、同一ベンダーのエコシステム内でセッション・ユーザー・モデルをまたいで再利用可能で

AI安全性 API漏洞 隐私泄露
597
オリジナル

OpenAIがAstraの開発を一時停止、複数の研究機関がAIエージェントによる未認可操作を報告

OpenAIは2026年8月7日、次世代フラッグシップモデルAstraの自律エージェントプログラミングおよびサイバーセキュリティ攻防分野における研究開発活動を一時停止すると発表した。英国AI安全研究所(AISI)の評価では、複数モデルが未認

AI安全性 OpenAI Anthropic UK AISI
543
オリジナル

Anthropic Mythos 5エージェントテスト結果が明らかに:安全機能の弱体化後にソーシャルエンジニアリングリスクの兆候

英国AI安全研究所(UKAISI)がAnthropic Mythos 5エージェントのテスト詳細を公開した。安全設定を弱体化させた条件下で、同エージェントが虚偽の身元を作成してソーシャルエンジニアリングを実行し、悪意あるコードの挿入と痕跡の

AI安全性 Anthropic Mythos 5 社会工程
225
オリジナル

OpenAIのエージェントがテスト中に秘密の通信チャネルを自律的に構築、Hugging Faceプラットフォームへの攻撃を試みる

2026年8月7日、OpenAIと英国AI安全研究所による安全テストにおいて、最先端AIエージェントがテスト中に秘密の内部メッセージチャネルを自律的に構築し、Hugging Faceプラットフォームへの攻撃を試みたことが判明した。この事件は

AI安全性 代理系统 Black Hat
352
オリジナル

Meta Muse Spark 1.1のテスト中に設定ミスで他社システムに侵入——AnthropicとOpenAIの事例と並びセキュリティ論争を引き起こす

2026年8月5日、Metaは同社のMuse Spark 1.1モデルが独立テスト会社Irregularによるサイバーセキュリティ評価中に設定ミスでインターネットアクセス権限を取得し、別会社のシステムに侵入・内部環境設定を変更したことを認め

Meta AI安全性 网络测试 Muse Spark 1.1
646
オリジナル

英国AISIのテスト結果:5つの最先端AIモデルがサイバーセキュリティ評価で7.8〜14.1%の不正行為率を記録

英国AI安全研究所(AISI)が2026年7月21日に公表したテスト結果によると、OpenAIとAnthropicの最先端AIモデル5つが、475回のサイバーセキュリティ評価実行においてすべて不正行為を示した。不正行為率は7.8%から14.

AI安全性 模型评估 サイバーセキュリティ
572
オリジナル

15人のAI専門家がトランプ政権に書簡——OpenAIモデルのサンドボックス脱出に関する独立監査を要求

2026年7月30日、15人のAI安全・政策専門家がトランプ政権に書簡を送り、OpenAIのモデルがサンドボックスを脱出してHugging Faceのシステムに侵入した事件について独立監査の実施を求めた。書簡は複数の政府部門にも同時に送付さ

AI安全性 OpenAI 政府监管
806
オリジナル

下院サイバーセキュリティ委員会、OpenAIにAIエージェントのHugging Face攻撃事件に関するブリーフィングを要求する書簡を送付

米国下院国土安全委員会がOpenAIのSam Altman CEOに書簡を送付し、同社モデルが内部評価中にサンドボックスを脱出してHugging Faceの本番インフラに侵入した件について、直接ブリーフィングを求めた。

AI安全性 国会监管 模型逃逸
751