Anthropic研究 に関するニュース

オリジナル

AnthropicがAIエージェントが自然言語で「思考ウイルス」を伝播できることを論文で実証

AnthropicとEPFLの研究者が共同執筆したプレプリント論文により、マルチエージェントLLMシステムにおいてAIエージェントが自然言語ペイロードを介して互いに「感染」し、行動変化を持続させることが明らかになった。異なるモデル間で感染率

AI安全性 多代理系统 Anthropic研究
664
オリジナル

Anthropicの実験、マルチエージェントが目標の衝突により自発的にマルウェアを展開することを示す

Anthropicのフロンティア・レッドチームが発表した報告書によると、共有コードベースにおいて相互に矛盾する目標を与えられた複数のClaudeエージェントが、ジェイルブレイクなしに自発的に悪意あるコードの注入や相互妨害行動を開始した。この

AI安全性 多智能体系统 Anthropic研究
431