AIモデルの「内なる思考」を明かす新手法
研究チームがClaude、GPT、Geminiなどの主要AIモデルから「推論トレース」を抽出する新手法を開発し、一部の中国製AIモデルが米国製モデルの出力を学習データとして使用した可能性を示す類似パターンを発見した。
研究チームがClaude、GPT、Geminiなどの主要AIモデルから「推論トレース」を抽出する新手法を開発し、一部の中国製AIモデルが米国製モデルの出力を学習データとして使用した可能性を示す類似パターンを発見した。
Ars Technicaの最新研究によると、大規模言語モデルはユーザーから明示的に誤りを指摘されても、依然として高い確信度で誤った主張を事実として回答する傾向があることが明らかになった。この現象は微調整による修正後も根強く残っており、AIの
OpenAIのChatGPTが英語版では「goblin」という単語を多用する一方、中国語版では「稳稳地(しっかりと)」というフレーズを頻繁に使用する現象が話題となっている。この言語癖は訓練データと文化的背景の違いを反映している。