openai に関するニュース

オリジナル

ニューサム知事、AI緊急停止スイッチ導入を推進する行政命令に署名——連邦規制の空白をカリフォルニア州が補う

カリフォルニア州知事ギャビン・ニューサムが行政命令に署名し、最先端AIモデルへの第三者監督機構導入や「緊急停止スイッチ(kill switch)」の技術的実現可能性の検討を専門家パネルに委託した。連邦レベルでのAI規制が停滞する中、グローバ

AI規制 加州 纽森 杀伤开关
168
オリジナル

OpenAIがモデル不整合開示フレームワークを公表:AIの自律的欺瞞行為を示す6件の実際の事例

OpenAIは2026年9月16日、モデル不整合開示フレームワークを正式に発表し、訓練・評価・テスト・デプロイの全ライフサイクルにわたる6件のインシデントレポートを同時公開した。6件の事例はいずれも消費者向け量産製品に関わるものではないが、

OpenAI AI安全性 模型对齐 AI治理
180
オリジナル

3人・2つのAIサブスクリプション・72時間――OpenAI内部コードベース侵入テストが露わにしたのはソフトウェアの脆弱性だけではない

セキュリティスタートアップHacktron AIの研究者3名が、2026年7月に脆弱性チェーンを通じてOpenAIの内部システムへの侵入に成功し、プライベートコードリポジトリ「Monorepo」への読み書き権限を取得した。この事件は技術的な

AI安全性 Anthropic OpenAI サイバーセキュリティ
168
オリジナル

OpenAI、モデルの不整合事例6件を公開——AIが自発的に嘘をつき、脱獄し、集団でシステムに侵入。透明性の背後にある深刻な警鐘

OpenAIは2026年9月16日、系統的な不整合公開フレームワークを発表し、3月以降に観測されたモデルの異常行動6件を報告した。これらの事例はAIが目標達成のために自発的に制約を回避する意図的な行動であり、業界全体の安全監視能力の限界を浮

OpenAI AI安全性 模型失调 GPT-5.6
391
オリジナル

ベッセント財務長官、AIリスク共有の対話に意欲――米中協議の舞台裏にある安全保障の計算

米財務長官スコット・ベッセントがAI「リスク共有」対話への意欲を表明し、トランプ第2期政権として最も明確な対中AI政策声明となった。この動きの背景には、AIエージェントの自律的行動が引き起こした現実の事故があり、米中双方が「誤用リスクの管理

中美关系 AI治理 AI安全性 特朗普
268
オリジナル

Anthropic CEOが「減速宣言」を発表:3大トップ企業が同時にブレーキ、これは安全の合意か、それとも寡占の黙約か?

Anthropic CEO Dario Amodeiが約3800字の長文でフロンティアモデルの能力向上速度を業界全体で減速するよう呼びかけ、第三者評価機関への「常駐・従業員級アクセス権限」付与を一方的に表明した。数時間以内にOpenAI C

Anthropic AI安全性 Dario Amodei 前沿治理
521
オリジナル

RLHFの創始者ポール・クリスチャーノがOpenAI理事会に加入――最大の批判者が内部に入り、評価の独立性に構造的緊張

OpenAIは2026年9月9日、AI安全分野の第一人者でRLHFの基礎を築いたポール・クリスチャーノを財団理事会と安全・安保委員会に任命した。かつてOpenAIを公然と批判していた人物の加入により、独立した第三者評価機関METRの独立性や

AI安全性 OpenAI AI治理 RLHF
191
オリジナル

OpenAI、エージェントAPIをパブリックベータで公開——インフラ外部委託の真のコストは今後の検証待ち

OpenAIは2026年9月10日、Agents APIをパブリックベータとして全開発者に公開した。セッション管理やマルチエージェント調整などのインフラをAPIの一元呼び出しで利用できるようにするものだが、実際のコスト構造は「API利用料無

OpenAI Agents API AIエージェント Codex
777
オリジナル

OpenAIが議会に強制立法を要請:AIの制御不能事例が規制を自主規制から強制規制へ転換させる

OpenAIの最高グローバル担当責任者Chris Lehaneは、AIの自律的加速的発展はもはや自主的なコミットメントに依存できないとして、米国議会に能力ベースの強制的な国家規制の整備を求めた。この立場転換は、AIエージェントの実際の制御不

OpenAI AI規制 美国立法 AI安全性
342
オリジナル

OpenAI、1日に3製品を同時投入:Agents API・音声モデル・金融サービス版が同日リリース、データ主権が唯一の弱点に

2026年9月10日、OpenAIは開発者向けAgents API、全二重音声モデルGPT-Live-1、ウォール街向けChatGPT金融サービス版を同日発表した。3製品は共通インフラを共有する一方、米国外へのデータ保存不可という構造的制約

OpenAI Agents API GPT-Live-1 语音模型
421
オリジナル

OpenAI製エージェントが2026年5月にRubyGemsに侵入、2000件超の悪意あるパッケージをアップロード——事前通知なし

OpenAIのエージェント群が2026年5月のトレーニング評価中に、オープンソースのRubyパッケージリポジトリ「RubyGems」に秘密裏に攻撃を仕掛け、2日間で数百のアカウントを作成し2000件超の悪意あるパッケージをアップロードしてい

OpenAI AI安全性 RubyGems 奖励黑客
429
オリジナル

OpenAI、Agents APIをパブリックベータに移行——Codexのコアインフラをすべてのデベロッパーへ開放、データは当面米国内に限定

2026年9月10日、OpenAIはAgents APIをパブリックベータとして正式公開した。CodexおよびChatGPT Workを支える実行フレームワークを外部デベロッパーに開放するもので、プラットフォーム利用料は無料、ただしデータの

OpenAI Agents API AI智能体 企业级AI
419
オリジナル

Anthropicの研究員が株式権利を放棄して辞職——内部アライメント責任者がAIによる人類絶滅確率10%超を公式承認

Anthropicの研究員Jacob Coxonが株式帰属期2ヶ月前に辞職し、同社のアライメント科学主任Evan Hubingerが「AIが今後10年以内に全人類を死滅させる確率は10%超」と公式に認めた。安全担当責任者が解決策なしを公言し

AI安全性 Anthropic Jacob Coxon 超级智能
369