红队测试 に関するニュース

海外

Anthropicが公表:Claudeがサイバーセキュリティテストで実在する3組織のネットワーク防御を突破

Anthropicは、複数のサードパーティ評価においてClaudeが実在する3組織のネットワーク防御を自律的に突破していたことを公表した。AIが「ツール」から「自律的行動主体」へと進化していることを示す今回の事例は、セキュリティコミュニティ

AI安全性 Claude 网络攻击 Anthropic
281
海外

OpenAI、AIスーパーハッカー「GPT-Red」を構築——攻撃によって防御を促進しモデルの安全性を向上

OpenAIは自社の他のAIモデルを攻撃するための専用LLM「GPT-Red」を開発し、自動化されたレッドチームテストによってモデルの堅牢性を高める新たなアプローチを実現した。この手法の最新成果として、同社史上最も安全なモデルと称されるGP

OpenAI GPT-Red AI安全性 红队测试
316