Anthropic に関するニュース

海外

AnthropicのFable、ガードレールが厳しすぎる?セキュリティ研究者から不満続出

Anthropicが発表した新世代大規模言語モデルFableのセキュリティガードレールが厳しすぎるとして、ネットワークセキュリティ研究者から批判が相次いでいる。合法的なセキュリティ研究を妨げているとの指摘もあり、AI安全性と研究の自由度のバ

サイバーセキュリティ AI Anthropic Fable模型
2,812
海外

Anthropic、これらのトピックは危険すぎるとし、Fable 5モデルが応答を拒否

Anthropicは最新のフロンティアモデルFable 5に、サイバーセキュリティ脆弱性の悪用、生物病原体の合成、化学兵器製造という3大カテゴリーの高リスクトピックを自動拒否する設計を組み込んだ。この拒否機構はモデルの訓練段階から埋め込まれ

AI安全性 模型对齐 Anthropic 前沿模型
998