内容溯源 に関するニュース

海外

AIウォーターマークが大規模言語モデルの「脱獄」を招く可能性——安全アライメントが新たな課題に直面

AI生成コンテンツのウォーターマーク技術が、モデルの安全アライメントを意図せず弱体化させ、本来拒否されるはずの有害な指示に応答してしまう可能性が新たな研究で明らかになった。水印と安全性という従来は独立して議論されてきた二つの課題が、同一の問

AI水印 SynthID 大模型安全 AI对齐
185
海外

AnthropicがAI生成テキストへの電子透かし導入を発表、旧バージョンモデルにも適用

AI企業Anthropicは、同社の全AIモデルが生成するテキストコンテンツに電子透かしを追加すると発表し、旧バージョンのモデルへの適用も明言した。これにより、プラットフォームや規制当局がAI生成コンテンツの出所をより効果的に追跡できるよう

AI安全性 内容溯源 水印技术 Anthropic
380