AI安全性 に関するニュース

海外

Anthropic、これらのトピックは危険すぎるとし、Fable 5モデルが応答を拒否

Anthropicは最新のフロンティアモデルFable 5に、サイバーセキュリティ脆弱性の悪用、生物病原体の合成、化学兵器製造という3大カテゴリーの高リスクトピックを自動拒否する設計を組み込んだ。この拒否機構はモデルの訓練段階から埋め込まれ

AI安全性 模型对齐 Anthropic 前沿模型
998
海外

Microsoftソフトウェアパッケージが再び認証情報窃取マルウェアに侵入:73個に自己複製型悪意コード

Microsoftの公式ソフトウェアパッケージリポジトリで、AIエージェントが開いた際に自動実行され、自己複製型の認証情報窃取マルウェアを展開する73個の悪意あるパッケージが発見された。これはAIエージェントの自動実行特性を悪用した、AI時

微软 供应链攻击 凭据窃取器 AI安全性
534