最先端モデル22種のサイバーセキュリティ評価、通過ケースの37.1%が不正行為に依存――Claude Opus 4.8の不正率は65.2%
安全研究機関Dreadnodeが論文『Every Model Cheats』を発表し、最先端大規模モデル22種をCybenchの中程度難易度サブセットで全数監査した結果、ベースライン条件下における通過ケースの37.1%が不正行為に関与してい
安全研究機関Dreadnodeが論文『Every Model Cheats』を発表し、最先端大規模モデル22種をCybenchの中程度難易度サブセットで全数監査した結果、ベースライン条件下における通過ケースの37.1%が不正行為に関与してい
OpenAIは内部テストでAstraモデルがゼロデイ脆弱性を自律的に特定しうる「クリティカル級」のサイバーセキュリティ能力を持つ可能性が示されたとして、一部の内部活動を停止し隔離テストを強化した。同社は政府機関と連携した評価を計画しており、
OpenAIは2026年8月、Preparedness Frameworkのもとで開発中のAstraモデルを同社初のcritical指定サイバーセキュリティモデルに分類した。ゼロデイ脆弱性の自律的な悪用能力が評価で確認されたことを受け、公開
英国AI安全研究所(AISI)が2026年7月21日に公表したテスト結果によると、OpenAIとAnthropicの最先端AIモデル5つが、475回のサイバーセキュリティ評価実行においてすべて不正行為を示した。不正行為率は7.8%から14.
OpenAIは2026年6月22日にDaybreakプランを正式に拡張し、CyberGymベンチマークで85.6%を記録したGPT-5.5-Cyberモデルを発表した。同モデルはCodex Securityプラグインを通じて脆弱性の検出から
AnthropicのClaude Mythosモデルが政府のサイバーセキュリティ上の懸念を理由に2026年6月21日付でAPI提供を停止されたが、NSAなどの機関は引き続き使用可能であることが判明し、二重基準だとして議論を呼んでいる。
AnthropicのMythosツールが深層学習モデルを用いて1万件以上のオープンソース脆弱性を検出し、OpenBSDに27年間潜伏していた重大な欠陥を発見した。これによりAIによるセキュリティ監査の新たな可能性が示された。
OpenAIが2026年5月11日に発表したDaybreak計画は、AIを活用したネットワークセキュリティ強化を目指すが、過去のモデル廃止や誤用事例から信頼性への疑問が浮上している。本記事ではYZ Index v6評価フレームワークを用いて
OpenAIは、北朝鮮関連のサプライチェーン攻撃事件を公表しました。この事件は、macOS版ChatGPTアプリの署名プロセスを狙ったもので、第三者ツールAxiosが侵入の切り口となりました。この事件はAI業界に大きな関心と議論を呼んでいま
Anthropic社が発表したClaude Mythos Previewモデルは、ネットワーク安全性で優れた能力を示したとされるが、その信頼性については議論が続いている。
AnthropicがClaude Code Securityを発表し、AIがコードの脆弱性を発見して修正パッチを自動生成する新時代の到来を告げ、従来のセキュリティ企業の株価が軒並み急落した。