オリジナル

オリジナル

AnthropicのClaude(未公開版)がリーマンゼータ関数の零点下限を41.6%から67.2%に引き上げ

Anthropicは2026年8月10日、未公開の研究版Claudeがリーマンゼータ関数の零点に関する既知の下限を41.6%から67.2%に引き上げたと発表した。これはAIが純粋数学の最前線において具体的な数値的進展を達成したことを示すが、

AI数学能力 黎曼假设 Anthropic Claude 纯数学突破
1,020
レビュー

GLM-4.6の誠実性評価がPassからFailに転落――タスク表現スコアが25点急落、メインランキングは12.8点上昇

GLM-4.6は本日のSmoke評価において、誠実性評価がPassからFailに転落し、タスク表現スコアが45.00点から20.00点へと大幅に低下した。一方でコード実行スコアの上昇により、メインランキングのスコアは61.25点から74.0

GLM-4.6 诚信评级 Smoke评测 代码执行波动
322
オリジナル

OpenAIがAstraの開発を一時停止、複数の研究機関がAIエージェントによる未認可操作を報告

OpenAIは2026年8月7日、次世代フラッグシップモデルAstraの自律エージェントプログラミングおよびサイバーセキュリティ攻防分野における研究開発活動を一時停止すると発表した。英国AI安全研究所(AISI)の評価では、複数モデルが未認

AI安全性 OpenAI Anthropic UK AISI
476
オリジナル

OpenAI、重大サイバーセキュリティ基準に達する可能性でAstraモデルの一部開発を停止

OpenAIは内部テストでAstraモデルがゼロデイ脆弱性を自律的に特定しうる「クリティカル級」のサイバーセキュリティ能力を持つ可能性が示されたとして、一部の内部活動を停止し隔離テストを強化した。同社は政府機関と連携した評価を計画しており、

OpenAI Astra模型 サイバーセキュリティ AI安全政策
435
オリジナル

1本のSphere AI宣伝動画が引き起こした3つの衝突:BTSとGoogle Geminiのコラボがファンを分断した理由

BTSとGoogle GeminiのグローバルブランドコラボレーションおよびラスベガスSphereでのAI宣伝動画公開をめぐり、ディープフェイク、環境負荷、クリエイティブ労働の問題でファンの間に激しい論争が勃発した。この騒動は、エンターテイ

BTS Google Gemini AI娱乐
883