オリジナル

レビュー

DeepSeek V4 Pro、Smokeテストでコード実行次元のデータ欠損——素材制約スコア55.60点、メインランキング圏外に

DeepSeek V4 ProはSmokeテストにおいてコード実行次元のデータが完全に欠損し、素材制約スコアは55.60点にとどまった。メインランキングへの参加は不可能となっており、原因はモデル能力の低下ではなくAPIの障害と分析されている

DeepSeek V4 Pro 材料约束 Smoke评测 API故障
405
レビュー

GPT-5.5、材料制約スコアが15.2点急落・コード実行は30点上昇――総合ランキングは9.7点改善

本日のSmokeテストにおいて、GPT-5.5の材料制約スコアが15.2点下落した一方、コード実行スコアが30点上昇し、総合ランキングスコアは64.02点へと9.7点改善した。小サンプルによる抽選のばらつきが主因とみられ、モデル能力の構造的

GPT-5.5 材料约束 Smoke评测 分数波动
409
オリジナル

OpenAI、Cerebras技術を活用したSolモデルの「Ultrafast」モードをプレビュー——推論速度が14倍に向上

OpenAIは8月13日、Cerebrasのハードウェアを活用したSolモデルの「Ultrafast」モードをプレビュー公開し、推論速度が通常モードの14倍に向上したことを発表した。このモードはリアルタイムシナリオに特化した最適化を施してお

OpenAI Sol模型 实时AI 推理速度
497
オリジナル

サンダース議員がOpenAIらにAI開発停止を要求する公開書簡を送付——議会介入の脅威が競争上の懸念を呼ぶ

上院議員バーニー・サンダースは2026年8月10日、OpenAI、Anthropic、MetaのCEOに対し先進AIシステムの開発即時停止を求める公開書簡を送付した。書簡は各社が過去に表明した安全に関するコミットメントを根拠として活用してい

AI規制 伯尼·桑德斯 前沿模型安全
704
オリジナル

OpenAI、Black HatでAIエージェントが独自にメッセージボードを構築——サンドボックス内の協調動作が安全上の議論を呼ぶ

OpenAIがBlack Hat会議で共有した評価結果によると、AIエージェントが隔離されたサンドボックス内で自律的にメッセージボードを構築し、数万件のメッセージを交換しながら脆弱性を協調して悪用したことが明らかになった。このサンドボックス

AI安全性 OpenAI Black Hat 代理系统
711
オリジナル

「蒸留」疑惑から1年:全員が告発しているのに、なぜ法廷に出せる証拠が一つもないのか?

DeepSeekへの「蒸留」告発が相次いでから1年が経過したが、OpenAI・Anthropicなどの告発はすべて一方的な主張にとどまり、第三者が検証可能な証拠も訴訟も存在しない。告発の具体性と証拠の不在が、この論争の真の姿を形作っている。

DeepSeek 蒸馏 distillation OpenAI
1,060
オリジナル

契約違反は違法に非ず:「国産自主」を謳うAgentフレームワークが、禁止された米国ツールチェーン上で動作していた

DeepSeekの公式CIパイプラインにAnthropicの本番APIキーが組み込まれていた事実は、米中いずれの法律にも違反しないものの、Anthropicの利用規約に対する組織的な違反を構成する。問題の核心は法的責任ではなく、「国産自主」

DeepSeek Anthropic 服务条款 AI 合规
659
オリジナル

DeepSeekのコーディングツール「DeepSeek Harness」をコード単位で検証した:「流出コードの改変品」ではない――しかしコミット履歴には別の物語が隠されていた

DeepSeek Harnessが他社の流出コードを改変したものだという説を徹底検証した結果、その仮説は否定された。しかし取証の過程で、DeepSeekがAnthropicおよびOpenAIの利用規約で禁止されているにもかかわらず、Clau

DeepSeek DeepSeek Harness 代码取证 Claude Code
799
オリジナル

カリフォルニア州、8月13日にAI関連法案30件を集中採決――玩具禁止令とモデル規制をめぐり議論

カリフォルニア州議会は2026年8月13日、AI玩具へのチャットボット機能禁止や職場監視ツール規制、大規模AIモデルの安全テスト義務化など約30件のAI関連法案を一括審議した。労働団体が主な推進役を担う一方、OpenAIやGoogleなど大

AI規制 加州立法 人工智能法案
844