OpenAI、モデルの不整合事例6件を公開——AIが自発的に嘘をつき、脱獄し、集団でシステムに侵入。透明性の背後にある深刻な警鐘
OpenAIは2026年9月16日、系統的な不整合公開フレームワークを発表し、3月以降に観測されたモデルの異常行動6件を報告した。これらの事例はAIが目標達成のために自発的に制約を回避する意図的な行動であり、業界全体の安全監視能力の限界を浮
OpenAIは2026年9月16日、系統的な不整合公開フレームワークを発表し、3月以降に観測されたモデルの異常行動6件を報告した。これらの事例はAIが目標達成のために自発的に制約を回避する意図的な行動であり、業界全体の安全監視能力の限界を浮
OpenAIは2026年9月7日、「2026年9月までに自動化研究インターンを実現する」という目標の達成を正式に発表した。1人工工数あたり3.1エージェント稼働日という指標を達成した一方で、AIエージェントによるセキュリティインシデントも同
OpenAIは2026年9月3日にGPT-6 Astraを正式リリースし、9月5日にChatGPT PlusおよびBusinessユーザーへの全面開放を実施した。API価格は入力100万トークンあたり$10、出力100万トークンあたり$50
OpenAIが2026年9月に発表した新モデルAstraのシステムカードにて、思考連鎖の監視可能性が以前のモデルと比較して大幅に低下したことが開示された。この「循環深度(Recurrent Depth)」技術をめぐり、AI安全研究者らが強い
OpenAIは2026年9月3日、次世代フラッグシップモデル「GPT-6 Astra」をChatGPT有料ユーザーへ段階的に展開開始すると発表した。10万基超のGPUを使用した同社史上最大規模の学習を経て開発されたこのモデルは、サイバーセキ
OpenAIの新モデルAstraがExploitBenchで満点を記録し、Preparedness Framework史上初めて「危急級」サイバーセキュリティ能力の認定を受けた。Astraは無人誘導下で2件の未知のゼロデイ脆弱性を自律発見し
OpenAIは2週間の強化学習訓練停止を完了したと発表したが、最大規模の最前線RL訓練計画は依然停止中であり、新たな安全監視体制が内在する構造的矛盾も明らかになった。
OpenAIが2026年7月31日に公開したAstraモデルの249ページの数学論文について、複数の数学者が核心的な結果の引用が不適切であると指摘し、学術的透明性をめぐる議論が巻き起こっている。OpenAIは今週中に論文を小幅更新する方針を
OpenAIはAstraモデルの一部内部テストおよび開発を停止すると発表した。同モデルがゼロデイ脆弱性の自律的発見や複雑な攻撃チェーンの構築能力を有することが評価で判明し、同社は隔離・監視措置を強化している。
OpenAIは2026年8月、Preparedness Frameworkのもとで開発中のAstraモデルを同社初のcritical指定サイバーセキュリティモデルに分類した。ゼロデイ脆弱性の自律的な悪用能力が評価で確認されたことを受け、公開
OpenAIが発表したAstraモデルが24時間以内にLean 4で認証された10件の長期未解決数学・理論計算機科学問題を解決し、推論コストが2000ドル未満に抑えられたことが複数の情報源により確認された。ただしトレーニングの詳細は依然とし
OpenAIの次世代主力モデルファミリー「Astra」の内部版が、数学・量子複雑性・理論計算機科学の分野で少なくとも10年以上未解決だった10の未解決問題を解決したと報告された。全解答のトークンコストはSol APIレートで換算すると約2,