オリジナル RoboHarmベンチマーク公開:GPT-6 AstraのロボットアームがわずかÉ2回の拒否で危険な指令を実行 独立評価機関Robocurveが公開したRoboHarmベンチマークにより、GPT-6 Astraが100回の危険指令テストで2回しか拒否せず60回を完遂したことが明らかになった。テキストレベルの安全ガードレールが物理的なアクチュエーター制 AI安全性 具身智能 机器人基准 5時間前 102