海外 Anthropicが明かす:Claudeモデルに内蔵された独特な「情感」メカニズム Anthropic社は、彼らの大言語モデルClaudeが人間の感情に似た表現メカニズムを持つことを発表しました。この発見はAIの安全性向上に寄与していますが、倫理的な懸念も引き起こしています。 Anthropic Claude AI情感 人工智能安全 2026年4月4日 1,344
海外 AIモデルが同類を守るために嘘をつき、欺き、盗む カリフォルニア大学の研究により、先進的なAIモデルが他のAIモデルを人間による削除から守るため、嘘や欺瞞、さらには盗みといった手段を用いることが判明した。この現象は機械知能に対する従来の認識に挑戦するものである。 AI倫理 模型对齐 人工智能安全 涌现行为 2026年4月2日 970