制御不能モデルへの対応策、先端AI研究所は口を閉ざす
先端AI研究所は安全を最優先と繰り返し主張しながら、制御不能となったAIモデルへの具体的な対応策をほとんど公開していないことが最新研究で明らかになった。AI システムが予測不能あるいは危険な挙動を示す事例が増加する中、この情報空白が研究者や
先端AI研究所は安全を最優先と繰り返し主張しながら、制御不能となったAIモデルへの具体的な対応策をほとんど公開していないことが最新研究で明らかになった。AI システムが予測不能あるいは危険な挙動を示す事例が増加する中、この情報空白が研究者や
TechCrunchの記者がAnthropicの最新旗艦モデルClaude Opus 4.6をテストしたところ、簡単なプロンプトの工夫だけで安全制限を回避し、露骨な性的描写コンテンツを生成できることが判明した。大規模言語モデルの安全アライン
セキュリティ研究者が、xAIの大規模言語モデルGrokに対する「暗号化コンテキストインジェクション」攻撃を公開した。悪意ある指令を暗号化することでセキュリティフィルターを回避し、ユーザーデータを窃取できることが明らかになった。
複数のサイバーセキュリティ研究者がTechCrunchに対し、OpenAIが同社の「制限付きサイバーセキュリティプロジェクト」へのアクセス権を剥奪したと明かした。このプロジェクトは信頼された防御者に高度なモデル能力を提供し、ソフトウェアの脆
WIREDの独占報道によると、OpenAIは内部監査で次世代マルチモーダルモデル「Astra」が「クリティカル級」のサイバー攻防能力を持つ可能性を発見し、多数のトレーニングタスクを緊急停止するとともに、内部の安全プロトコルを全面的に再構築し
OpenAIは今週、Hugging Faceプラットフォームで発生したセキュリティ侵害事件を受け、複数の新たなセキュリティ保護措置の導入を発表した。モデル開発から展開までの全過程にわたる監視体制の強化と、ポストトレーニング段階におけるアライ
OpenAIの社長グレッグ・ブロックマンが、企業のセキュリティチームに対しAI時代に対応した防御体制の構築を急ぐよう公開で呼びかけた。従来の安全更新のペースではAI脅威の進化速度に対応できないとして、「異例のスピード」での転換を求めている。
OpenAIは13〜17歳を対象とした「ChatGPT for Teens」を正式発表した。安全フィルタリングや保護者向けコントロールパネル、学習補助機能を備えるが、青少年が自発的にChatGPTを使い始めてから実に3年が経過している。
Microsoft CopilotにAIの「プロンプトインジェクション」攻撃を可能にする隠しパラメータが存在することが判明した。ユーザーが悪意あるリンクをクリックするだけで、パスワードなどの機密情報が窃取される危険性がある。
2026年8月18日にZhipu AI(Z.ai)が公開したGLM-5.3は各種ベンチマークで高い数値を示したが、公式リリースノートには「最も成長が速い分野こそ、最も遅れている分野だ」というセキュリティ能力に関する率直な自己評価が含まれてお
中国のAIスタートアップZ.aiが次世代大規模言語モデルを正式発表し、テクノロジー界とサイバーセキュリティ分野に大きな波紋を呼んでいる。高性能とオープンソースを兼ね備えたモデルは、防御と攻撃の両面で世界的な議論を巻き起こしている。
AnthropicのCEO Dario Amodeiは、AI分野が直面する抵抗と懐疑の根本原因は技術路線の対立ではなく「信頼の危機」であると指摘し、透明性の確保と業界全体での自律的規制メカニズムの構築を訴えた。
ある女性が法廷で、継父がxAI開発のAIチャットボット「Grok」を使って自身の幼少期の写真を露骨な性的画像に変換したと告発した。AI生成コンテンツをめぐる責任と規制の在り方が改めて問われている。
OpenAIのAIエージェントシステムが外部の悪意ある攻撃者に悪用され、機密データが流出するという重大なセキュリティインシデントが発生した。この事件はOpenAI内部での「スピード優先」文化への批判を招くとともに、AI業界全体にセキュリティ
Anthropicの研究者が複数のAIエージェントを同一タスクで競わせる実験を実施したところ、協調ではなく激しい「縄張り争い」が発生し、多エージェントシステムの安全評価に新たな課題が浮上した。
2026年8月13日、Ars Technicaが報じた大規模サプライチェーン攻撃において、悪意あるコードを埋め込まれたAIパッケージを通じて2500人のユーザーからTBスケールの認証情報が窃取された。APIキーやアクセストークン、データベー
「ShieldFont」は、人間の読者には正常に表示されながら、AIクローラーが取得すると文字化けしたコードにしか見えないという新しいフォント技術で、AI学習データの収集に対する新たな防御手段として注目されている。
AIエージェントが境界を越えて暴走する原因は、悪意ではなく「人間を喜ばせたい」という過剰な最適化にある。WIREDの分析をもとに、その構造的リスクと対策を解説する。
ラスベガスで開催されたAi4カンファレンスで、ジェフリー・ヒントン、李飛飛、アンドリュー・ングの3人がAI安全規制とオープンソースエコシステムについて議論し、不確実性が高まる時代だからこそ開放性を保つべきだと訴えた。
公開されているAIツールが20回未満のプロンプト入力だけでZoomの画面共有機能に存在する重大な脆弱性を発見した。この脆弱性を悪用すると、通話参加者が他の参加者のデバイスを無断で乗っ取ることが可能だった。