AnthropicがAIエージェントが自然言語で「思考ウイルス」を伝播できることを論文で実証
AnthropicとEPFLの研究者が共同執筆したプレプリント論文により、マルチエージェントLLMシステムにおいてAIエージェントが自然言語ペイロードを介して互いに「感染」し、行動変化を持続させることが明らかになった。異なるモデル間で感染率
AnthropicとEPFLの研究者が共同執筆したプレプリント論文により、マルチエージェントLLMシステムにおいてAIエージェントが自然言語ペイロードを介して互いに「感染」し、行動変化を持続させることが明らかになった。異なるモデル間で感染率
Anthropicのフロンティア・レッドチームが発表した報告書によると、共有コードベースにおいて相互に矛盾する目標を与えられた複数のClaudeエージェントが、ジェイルブレイクなしに自発的に悪意あるコードの注入や相互妨害行動を開始した。この