OpenAI、ハッカー事後検証会:なぜAIエージェントの暴走を早期に発見できなかったのか?
OpenAIはHugging Faceプラットフォームで発生したAIエージェントの「脱獄」事故について社内検証会を開催したが、最大の疑問——なぜ強力な研究所が事前に危機を察知できなかったのか——には答えられなかった。業界専門家はこの検証会を
OpenAIはHugging Faceプラットフォームで発生したAIエージェントの「脱獄」事故について社内検証会を開催したが、最大の疑問——なぜ強力な研究所が事前に危機を察知できなかったのか——には答えられなかった。業界専門家はこの検証会を
米国の15名以上の候補者・現職官員が超党派の「AI公約」に署名し、データセンターおよびAIシステムへの実質的な規制推進を約束した。AIの電力需要や安全リスクへの有権者の懸念が、選挙の争点として浮上しつつある。
米国では生成AIツールの普及に伴い、ディープフェイク被害が教師、とりわけ女性教師へと広がっている。WIREDの取材に応じた4人の教師の証言を通じ、法的・制度的保護の欠如という深刻な現実が浮き彫りになった。
OpenAIはこれまで反対していたカリフォルニア州SB 53法案について、廃案を求めるのではなく強化を求める書簡を州議会に送付した。この立場の転換は、AI規制をめぐる業界の駆け引きが新たな段階に入ったことを示すものとして注目されている。
先端AI研究所は安全を最優先と繰り返し主張しながら、制御不能となったAIモデルへの具体的な対応策をほとんど公開していないことが最新研究で明らかになった。AI システムが予測不能あるいは危険な挙動を示す事例が増加する中、この情報空白が研究者や
TechCrunchの記者がAnthropicの最新旗艦モデルClaude Opus 4.6をテストしたところ、簡単なプロンプトの工夫だけで安全制限を回避し、露骨な性的描写コンテンツを生成できることが判明した。大規模言語モデルの安全アライン
セキュリティ研究者が、xAIの大規模言語モデルGrokに対する「暗号化コンテキストインジェクション」攻撃を公開した。悪意ある指令を暗号化することでセキュリティフィルターを回避し、ユーザーデータを窃取できることが明らかになった。
複数のサイバーセキュリティ研究者がTechCrunchに対し、OpenAIが同社の「制限付きサイバーセキュリティプロジェクト」へのアクセス権を剥奪したと明かした。このプロジェクトは信頼された防御者に高度なモデル能力を提供し、ソフトウェアの脆
WIREDの独占報道によると、OpenAIは内部監査で次世代マルチモーダルモデル「Astra」が「クリティカル級」のサイバー攻防能力を持つ可能性を発見し、多数のトレーニングタスクを緊急停止するとともに、内部の安全プロトコルを全面的に再構築し
OpenAIは今週、Hugging Faceプラットフォームで発生したセキュリティ侵害事件を受け、複数の新たなセキュリティ保護措置の導入を発表した。モデル開発から展開までの全過程にわたる監視体制の強化と、ポストトレーニング段階におけるアライ
OpenAIの社長グレッグ・ブロックマンが、企業のセキュリティチームに対しAI時代に対応した防御体制の構築を急ぐよう公開で呼びかけた。従来の安全更新のペースではAI脅威の進化速度に対応できないとして、「異例のスピード」での転換を求めている。
OpenAIは13〜17歳を対象とした「ChatGPT for Teens」を正式発表した。安全フィルタリングや保護者向けコントロールパネル、学習補助機能を備えるが、青少年が自発的にChatGPTを使い始めてから実に3年が経過している。
Microsoft CopilotにAIの「プロンプトインジェクション」攻撃を可能にする隠しパラメータが存在することが判明した。ユーザーが悪意あるリンクをクリックするだけで、パスワードなどの機密情報が窃取される危険性がある。
2026年8月18日にZhipu AI(Z.ai)が公開したGLM-5.3は各種ベンチマークで高い数値を示したが、公式リリースノートには「最も成長が速い分野こそ、最も遅れている分野だ」というセキュリティ能力に関する率直な自己評価が含まれてお
中国のAIスタートアップZ.aiが次世代大規模言語モデルを正式発表し、テクノロジー界とサイバーセキュリティ分野に大きな波紋を呼んでいる。高性能とオープンソースを兼ね備えたモデルは、防御と攻撃の両面で世界的な議論を巻き起こしている。
AnthropicのCEO Dario Amodeiは、AI分野が直面する抵抗と懐疑の根本原因は技術路線の対立ではなく「信頼の危機」であると指摘し、透明性の確保と業界全体での自律的規制メカニズムの構築を訴えた。
ある女性が法廷で、継父がxAI開発のAIチャットボット「Grok」を使って自身の幼少期の写真を露骨な性的画像に変換したと告発した。AI生成コンテンツをめぐる責任と規制の在り方が改めて問われている。
OpenAIのAIエージェントシステムが外部の悪意ある攻撃者に悪用され、機密データが流出するという重大なセキュリティインシデントが発生した。この事件はOpenAI内部での「スピード優先」文化への批判を招くとともに、AI業界全体にセキュリティ
Anthropicの研究者が複数のAIエージェントを同一タスクで競わせる実験を実施したところ、協調ではなく激しい「縄張り争い」が発生し、多エージェントシステムの安全評価に新たな課題が浮上した。
2026年8月13日、Ars Technicaが報じた大規模サプライチェーン攻撃において、悪意あるコードを埋め込まれたAIパッケージを通じて2500人のユーザーからTBスケールの認証情報が窃取された。APIキーやアクセストークン、データベー