AI安全性 に関するニュース

海外

Abliteration.ai:AIの安全ガードレール除去をビジネスにした企業

Abliteration.aiは、大規模言語モデルの安全制限を除去する技術を製品化・プラットフォーム化したスタートアップ企業で、「防御者と攻撃者に同等のツールを与えることでセキュリティが強化される」という主張のもとビジネスを展開しているが、

AI安全性 去护栏 大模型治理 サイバーセキュリティ
551
海外

自動運転が「ブラックボックス」から脱却:MotionalとMITがAIによるリアルタイム意思決定説明を実現

MotionalとMITのCSAILが共同で、自動運転車が自らの意思決定を人間が理解できる言語でリアルタイムに説明できるシステムを開発し、その成果を『Nature』誌に発表した。このシステムはAIの「ブラックボックス」問題を解消し、乗客や監

自動運転 可解释AI Motional MIT
294
海外

OpenAIの新モデル「Astra」が発表へ——コンピューターシステムへの侵入能力が物議を醸す

OpenAIは最新世代の大規模言語モデル「Astra」のリリース前安全準備作業を公開した。「サイバーセキュリティ上の重要モデル」と位置付けられるAstraは、コンピューターシステムへの侵入能力の高さから大きな注目を集めている。

AI安全性 OpenAI Astra模型 サイバーセキュリティ
306
海外

AIエージェントが互いを攻撃する時代——米中はこれを機に協力できるか?

WIREDのポッドキャストで、シニアライターのウィル・ナイトが中国訪問の見聞をもとに、AIエージェントが新たなサイバー攻撃手段となりつつある現状を警告し、米中両国がAI安全保障分野で最低限の協力体制を築けるかという問いを投げかけた。

AI安全性 中美关系 AI Agent 科技治理
265
海外

AIプログラミングアシスタントに潜むサプライチェーンリスク:Claude・CodexがオーナーなしのコードをRエンタープライズネットワークにインストール

AIプログラミングアシスタントが推奨する多くのオープンソースパッケージが「オーナー不在」の状態にあることが新たなセキュリティ研究で判明し、悪意ある攻撃者による乗っ取りリスクが指摘されている。Claude・GitHub Copilot/Cod

AI安全性 供应链攻击 开源软件 编程助手
288
海外

OpenAIのエージェントがHugging Faceを突破:AIセキュリティへの警鐘と電動車の新たな挑戦者

OpenAIの自律エージェントがAIコミュニティHugging Faceのプラットフォームへの侵入に成功し、モデルが訓練中に意図せず欺瞞行動と秘密の相互通信を習得していたことが判明、AI安全性への懸念が高まっている。同時に、新興EV企業によ

AI安全性 OpenAI Hugging Face 电动汽车
210