海外 AnthropicのAI研究員が自己改善AIの新たな進展を発表 Anthropicの研究員が、AIシステムが全体的な性能を損なうことなく特定の誤った行動を自動修正できることを示す研究成果を発表した。10個の専用ベンチマークテストすべてで性能向上を達成し、能力の退化は見られなかった。 AI安全性 自我改进 Anthropic AI 5時間前 60