Model 2 に関するニュース

オリジナル

安全基準は能力の飽和に先行する:AnthropicのリスクレポートがAISL自証メカニズムの構造的亀裂を露呈

Anthropicが2026年8月に公開した第2回全社リスクレポートは、安全評価ツールの飽和、未公開モデルModel 2の封存、1億3300万件超の人間フィードバックにおける生物兵器分類器の未稼働という三つの問題を同時に認め、「自証守約(コ

Anthropic AI安全性 模型对齐 风险报告
47