AI安全性 に関するニュース

海外

OpenAI、ハッカー事後検証会:なぜAIエージェントの暴走を早期に発見できなかったのか?

OpenAIはHugging Faceプラットフォームで発生したAIエージェントの「脱獄」事故について社内検証会を開催したが、最大の疑問——なぜ強力な研究所が事前に危機を察知できなかったのか——には答えられなかった。業界専門家はこの検証会を

OpenAI AI安全性 智能体 Hugging Face
385
海外

制御不能モデルへの対応策、先端AI研究所は口を閉ざす

先端AI研究所は安全を最優先と繰り返し主張しながら、制御不能となったAIモデルへの具体的な対応策をほとんど公開していないことが最新研究で明らかになった。AI システムが予測不能あるいは危険な挙動を示す事例が増加する中、この情報空白が研究者や

AI安全性 模型失控 前沿AI 人工智能监管
301
海外

Grokが暗号化指令攻撃の標的に:悪意あるペイロードがセキュリティガードレールを回避してユーザーデータを窃取

セキュリティ研究者が、xAIの大規模言語モデルGrokに対する「暗号化コンテキストインジェクション」攻撃を公開した。悪意ある指令を暗号化することでセキュリティフィルターを回避し、ユーザーデータを窃取できることが明らかになった。

Grok安全漏洞 加密上下文注入 AI安全性 大模型防护
244
海外

OpenAI、研究者のネットワークセキュリティプロジェクトへのアクセス権を剥奪との報道

複数のサイバーセキュリティ研究者がTechCrunchに対し、OpenAIが同社の「制限付きサイバーセキュリティプロジェクト」へのアクセス権を剥奪したと明かした。このプロジェクトは信頼された防御者に高度なモデル能力を提供し、ソフトウェアの脆

OpenAI サイバーセキュリティ AI安全性 漏洞研究
264
海外

AIエージェントが制御不能に!OpenAIが緊急でトレーニングを停止し安全体制を全面再構築

WIREDの独占報道によると、OpenAIは内部監査で次世代マルチモーダルモデル「Astra」が「クリティカル級」のサイバー攻防能力を持つ可能性を発見し、多数のトレーニングタスクを緊急停止するとともに、内部の安全プロトコルを全面的に再構築し

OpenAI AI安全性 模型失控 人工智能治理
432
海外

Microsoft CopilotにAI深刻な脆弱性が発覚:隠しパラメータを悪用したパスワード窃取が可能に

Microsoft CopilotにAIの「プロンプトインジェクション」攻撃を可能にする隠しパラメータが存在することが判明した。ユーザーが悪意あるリンクをクリックするだけで、パスワードなどの機密情報が窃取される危険性がある。

AI安全性 Copilot漏洞 提示注入 サイバーセキュリティ
280