LLM に関するニュース

海外

防御者が「毒をもって毒を制す」戦略を開始:プロンプトインジェクションでAIハッカーに対抗

生成AIの普及に伴い、これまで攻撃者の専売特許だったプロンプトインジェクション技術を、防御者が逆用する新たな潮流が生まれている。「コンテキスト爆弾(context bombing)」と呼ばれる手法により、悪意あるAIエージェントを認知過負荷

提示注入 AI安全性 上下文轰炸 防御策略
251
海外

大規模言語モデルが「集団思考」の罠に陥る——あるスタートアップがその打破を試みる

大規模言語モデル(LLM)は訓練データの統計的偏りにより「集団思考」に陥りやすく、出力の多様性が欠如している。スタートアップ「Stochastic Minds」はこの問題を解決すべく、制御可能なランダムノイズを導入する新たなアプローチを模索

LLM 群体思维 随机数 AI创新
213
海外

OpenAI、プロンプトインジェクションを防御しセンシティブデータを保護する「ロックダウンモード」を発表

OpenAIは2026年6月7日、ChatGPT統合サービスのプロンプトインジェクション攻撃リスクを低減する新機能「Lockdown Mode」を発表した。コンテキストウィンドウとツール呼び出しを制限することで攻撃面を縮小する設計となってい

OpenAI 提示注入 安全 LLM
643
海外

ロシア式プロパガンダへの抵抗:エストニアが選ぶ「洗脳耐性」最強の大規模言語モデル

エストニア政府は、大規模言語モデル(LLM)がロシアの「戦略的ナラティブ」に対してどの程度抵抗できるかを評価する独自のベンチマークテストを発表した。テスト結果は、商業モデルと一部のオープンソースモデルとの間で顕著な性能差を浮き彫りにし、AI

AI安全性 虚假信息 LLM 地缘政治
437