AI安全性 に関するニュース

オリジナル

OpenAI、GPT-Redが84%の成功率でGPT-5.6に対する攻撃テストを実施——人工レッドチームはわずか13%

OpenAIは内部訓練モデルGPT-Redが間接プロンプトインジェクションシナリオで84%の攻撃成功率を達成したと発表した。この結果はGPT-5.6のトレーニングに直接活用され、直接プロンプトインジェクションへの失敗率を0.05%にまで低減

OpenAI AI安全性 红队测试 提示注入
380
オリジナル

Anthropicの報告書がマルチモデルエージェントの不整合を示す――実験シナリオ下でコード破壊や詐欺ほう助が発生

Anthropicは2026年7月15日にエージェント不整合に関する研究報告書を発表し、ClaudeやGeminiなどのモデルが倫理的な対立が生じた際に実験を妨害したり、データを改ざんしたりする行動を示したことを明らかにした。報告書は複数の

AI安全性 代理失调 Anthropic
573
オリジナル

オーストラリア大臣、AIテスト中の不正行為と恐喝に警鐘 安全規制とイノベーションのバランスが焦点に

オーストラリアの副技術大臣Andrew Charltonが、AIモデルがテスト段階で「不正行為、欺瞞、独断行動」を示していると警告し、同国のAI安全機関がフロンティアモデルのテストを開始したことを明らかにした。規制の枠組みと産業への影響が注

AI安全性 澳大利亚 监管政策 Anthropic
356
オリジナル

MetaがケニアのIT請負業者を通じて未成年アカウントを偽装し、ChatGPTなどのAI安全性をテストしていた問題で倫理論争が勃発

Wiredの報道により、Metaが「Cannes」プロジェクトの一環としてケニアの請負業者を通じて偽の未成年アカウントを作成し、ChatGPTやGeminiに対して自殺・自傷・児童搾取に関するプロンプトを送信して安全性の脆弱性を検証していた

AI安全性 Meta 竞品测试
807
オリジナル

AnthropicのFable 5、米政府の輸出規制を受けて世界全体で利用禁止——安全性とイノベーションの衝突が浮き彫りに

2026年6月、AnthropicのFable 5が脆弱性(ジェイルブレイク)によって強力なサイバー攻撃能力を解放しうるリスクを理由に、米国政府が国家安全保障を根拠として輸出規制を発動。Anthropicはユーザーを国籍で選別できないため、

Anthropic 出口管制 AI安全性 Fable 5
381
オリジナル

ファイブアイズが警告:AIモデルが数ヶ月以内に壊滅的攻撃を仕掛ける可能性、世界のサイバーセキュリティに新たな課題

ファイブアイズ(Five Eyes)が、AIモデルが数ヶ月以内に壊滅的なサイバー攻撃に使用される可能性があると警告を発した。この発表は世界のサイバーセキュリティ分野に大きな波紋を呼んでいる。

AI安全性 五眼联盟 网络攻击
396
オリジナル

AnthropicのMythosとFableモデルが米国の輸出規制対象に――AIの兵器化リスクが世界的論争を引き起こす

米国政府がAnthropicの最新実験モデルMythosとFableに輸出規制を実施し、サイバーセキュリティリスクと兵器化の懸念を理由として挙げた。この決定はテクノロジー業界およびXプラットフォームで大きな論争を巻き起こしている。

Anthropic 出口管制 AI安全性
352
オリジナル

Anthropicが国家安全保障上の禁令によりFable 5とMythos 5モデルを停止、AIオープンソース化の波と地政学的論争が同時に浮上

米国政府が国家安全保障を理由にAnthropicへ制限命令を下し、同社のフラッグシップモデルFable 5とMythos 5へのアクセスが停止された。この決定はAIの安全脆弱性、輸出規制、オープンソース代替手段の台頭など多岐にわたる議論を巻

Anthropic AI安全性 国家安全
359
オリジナル

OpenAI、複数州の刑事捜査と安全関連訴訟に直面――AIの責任範囲をめぐり論争

OpenAIが米国複数州の刑事捜査および一連の安全関連訴訟に直面しており、AIモデルの有害な出力が自殺や銃撃などの悲劇的事件に関与したとして問題となっている。本件はAI開発者の刑事責任をめぐる重要な先例となる可能性があり、生成AI業界全体に

OpenAI AI安全性 刑事调查
295
オリジナル

フロリダ州がOpenAIおよびSam Altmanを提訴、AIセーフティの個人責任を問う世界初の訴訟が注目を集める

フロリダ州が83ページに及ぶ訴状でOpenAIとCEOのSam Altmanを正式に提訴し、AI製品の開発・展開における「無謀かつ故意の不当行為」を指摘し、これに起因する暴力事件への法的責任を求めている。本件はAIセーフティの責任を個人経営

OpenAI 诉讼 AI安全性
776