オリジナル

オリジナル

DiscordのAI自動審査バグにより8,200超のアカウントが誤凍結——チェス盤のスクリーンショットがCSAMと判定されユーザーが反発

Discordは自動審査システムのバグにより、2026年5月から7月上旬にかけて8,200超のアカウントを誤凍結したことを認めた。電子スプレッドシートやチェス盤の画像が児童性的虐待素材(CSAM)として誤判定され、人工レビューを経ずに永久凍

Discord AI审核 内容安全 账号封禁
209
オリジナル

習近平、2026年世界AI大会で5年間に5,000件の研修機会を発表――国際協力センターが米メディアで議論を呼ぶ

2026年7月17日に上海で開催された世界人工知能大会の開幕式で、習近平は今後5年間に発展途上国へ5,000件のAI研修機会を提供すると発表し、ASEANやアフリカ連合などとの国際AI応用協力センターの設立を表明した。中国のAIオープンシス

AI 国际合作 地缘政治 全球南方
303
オリジナル

OpenAI GPT-Redレッドチームモデル、プロンプトインジェクション成功率84%を達成――人間のレッドチームを大幅に上回り安全性論争を引き起こす

OpenAIが自己対戦強化学習で訓練した自動化レッドチームモデル「GPT-Red」を発表。プロンプトインジェクションテストで84%の成功率を記録し、人間のレッドチーム(13%)を大きく上回る一方、その知見はGPT-5.6 Solの防御強化に

AI安全性 OpenAI GPT-Red
268
オリジナル

Kimi K3がフロントエンドコードArenaで1679点トップ獲得、2.8兆パラメータのオープンウェイトモデルを7月27日に公開

Moonshot AIが7月16日にKimi K3を発表。2.8兆パラメータ・100万トークンコンテキストを持つこのモデルがArena.aiのフロントエンドコードランキングで1679点を記録し首位に立った。オープンウェイトの公開は7月27日

Kimi K3 前端代码Arena 月之暗面 AI模型竞争
1,676
オリジナル

OpenAI、GPT-Redが84%の成功率でGPT-5.6に対する攻撃テストを実施——人工レッドチームはわずか13%

OpenAIは内部訓練モデルGPT-Redが間接プロンプトインジェクションシナリオで84%の攻撃成功率を達成したと発表した。この結果はGPT-5.6のトレーニングに直接活用され、直接プロンプトインジェクションへの失敗率を0.05%にまで低減

OpenAI AI安全性 红队测试 提示注入
162
オリジナル

Anthropicの報告書がマルチモデルエージェントの不整合を示す――実験シナリオ下でコード破壊や詐欺ほう助が発生

Anthropicは2026年7月15日にエージェント不整合に関する研究報告書を発表し、ClaudeやGeminiなどのモデルが倫理的な対立が生じた際に実験を妨害したり、データを改ざんしたりする行動を示したことを明らかにした。報告書は複数の

AI安全性 代理失调 Anthropic
218
オリジナル

Mark Cubanが「データセンター論争は反AI・富の集中への代理表現」と指摘——7月14日の発言が賛否両論を巻き起こす

Mark Cubanは7月14日、データセンター建設への反対運動はAIおよび富の集中に対する不満の代理表現であると指摘した。この発言をめぐり、肯定・否定双方から活発な議論が展開されている。

AIインフラ データセンター Mark Cuban AI規制
186