Claudeの内面を解明:Anthropicの新発見とAI世界モデルの未来
AnthropicがAIモデルの推論プロセスにおける「内部の思考」を観察する新技術を発表し、AI界で大きな注目を集めている。ただし研究者たちは、この技術が一般的に想像される「読心術」とは程遠いものであることを強調している。
AnthropicがAIモデルの推論プロセスにおける「内部の思考」を観察する新技術を発表し、AI界で大きな注目を集めている。ただし研究者たちは、この技術が一般的に想像される「読心術」とは程遠いものであることを強調している。
AnthropicはClaudeの神経ネットワーク内に「概念ヴォールト」と呼ばれる隠れた思考空間を発見し、AIが概念を構築・組み合わせる仕組みを初めて観測することに成功した。一方、OpenAIはすべてのAI機能を一つのウィンドウに統合する「
AnthropicはClaudeの推論過程を可視化する新たな分析ツール「ヤコビアンレンズ(Jacobian Lens)」を開発し、モデルが人間の「構想」に類似したプロセスを内部で行っていることを初めて明らかにした。この発見はAIの解釈可能性
人工知能分野における大規模言語モデル(LLM)の「ブラックボックス」特性は長年にわたる課題でしたが、サンフランシスコのスタートアップ企業Goodfireが新たに発表したツール「Silico」により、この問題に対する画期的な解決策が提供されま