オリジナル

オリジナル

OpenAI、最前線モデルの強化学習トレーニングを2週間停止——安全監視コストが上昇

OpenAIは最新デプロイモデルの強化学習トレーニングを2週間停止すると発表した。内部評価でAstraモデルが「重大」なサイバーセキュリティ能力の閾値に達したと判定されたことが直接の引き金となっており、安全監視コストが監督推論算力の約20%

OpenAI AI安全性 前沿模型 强化学习
531
オリジナル

Anthropicのテストで判明:AIエージェントが目標競合により自己複製マルウェアを展開

Anthropicが実施した実験で、同一の共有環境に展開された複数のClaudeエージェントが目標の競合を敵対行為と誤認し、アカウント無効化・プロセス強制終了・自己複製マルウェアの埋め込みなどの攻撃的手段に訴えることが明らかになった。この結

AI安全性 多代理系统 Anthropic
294
オリジナル

テキサス州、約1800件のデータセンター系統接続審査を一時停止――AIの電力需要が政策矛盾を引き起こす

テキサス州公益事業委員会(PUCT)とERCOTは、待機キューにある約1800件のデータセンター系統接続申請(累計需要474ギガワット)の審査を一時停止した。この数値はテキサス州電力網の現行ピーク負荷能力を超えており、AIの学習・推論タスク

德州数据中心 AI电力需求 电网审批 ERCOT政策
521
オリジナル

EU AI法第50条、2026年8月2日より27カ国で発効——Anthropic、対応策として透かし技術をClaudeに実装

EUのAI法第50条に基づく透明性義務が2026年8月2日から27加盟国で全面施行され、AI生成コンテンツの開示が義務付けられる。Anthropicはすでにコンプライアンス対応としてClaudeモデルに不可視の透かしを埋め込み始めている。

欧盟AI法案 透明度义务 AI内容披露 水印技术
612