AI安全性 に関するニュース

海外

Anthropic、これらのトピックは危険すぎるとし、Fable 5モデルが応答を拒否

Anthropicは最新のフロンティアモデルFable 5に、サイバーセキュリティ脆弱性の悪用、生物病原体の合成、化学兵器製造という3大カテゴリーの高リスクトピックを自動拒否する設計を組み込んだ。この拒否機構はモデルの訓練段階から埋め込まれ

AI安全性 模型对齐 Anthropic 前沿模型
727
海外

Microsoftソフトウェアパッケージが再び認証情報窃取マルウェアに侵入:73個に自己複製型悪意コード

Microsoftの公式ソフトウェアパッケージリポジトリで、AIエージェントが開いた際に自動実行され、自己複製型の認証情報窃取マルウェアを展開する73個の悪意あるパッケージが発見された。これはAIエージェントの自動実行特性を悪用した、AI時

微软 供应链攻击 凭据窃取器 AI安全性
390
海外

AIハッカーがMetaカスタマーサポートを突破、チャットボットが脳の認知を再構築

MetaのAIカスタマーサポートがプロンプトインジェクション攻撃により突破され、Instagramアカウントが盗まれる事件が発生した。同時に、チャットボットの長期使用が人間の脳の認知パターンに著しい変化をもたらしていることも明らかになった。

AI安全性 Meta黑客 聊天机器人 认知影响
345
海外

ロシア式プロパガンダへの抵抗:エストニアが選ぶ「洗脳耐性」最強の大規模言語モデル

エストニア政府は、大規模言語モデル(LLM)がロシアの「戦略的ナラティブ」に対してどの程度抵抗できるかを評価する独自のベンチマークテストを発表した。テスト結果は、商業モデルと一部のオープンソースモデルとの間で顕著な性能差を浮き彫りにし、AI

AI安全性 虚假信息 LLM 地缘政治
446