オリジナル

オリジナル

11日間・1300万行:ClaudeがFermatの最終定理の初のコンピュータ検証可能な証明を完成——しかし「自律」という言葉は精査が必要

Anthropicは2026年9月4日、内部研究モデルが11日間でFermatの最終定理の完全なLean形式化証明(1300万行、3万件超の中間定理)を作成したと発表した。これは史上初のコンピュータによる完全検証だが、「自律」の実態や数学的

Anthropic Claude 费马大定理 形式化证明
500
オリジナル

米司法省が初めて公式見解を表明:AI学習への著作権保護コンテンツ利用はフェアユース——ただし文書自体に重大な利益相反

米国司法省は2026年9月1日、ニューヨーク・タイムズ対OpenAI訴訟において、著作権保護されたテキストを用いた大規模言語モデルの学習はフェアユースに該当するとの政府見解を初めて正式に表明した。ただし、この文書の提出をめぐっては、Open

AI版权 合理使用 美国司法部 OpenAI
402
オリジナル

OpenAIの新モデルAstraで思考連鎖の監視可能性が低下、首席科学者が監視不能な軍拡競争の阻止に乗り出す

OpenAIが2026年9月に発表した新モデルAstraのシステムカードにて、思考連鎖の監視可能性が以前のモデルと比較して大幅に低下したことが開示された。この「循環深度(Recurrent Depth)」技術をめぐり、AI安全研究者らが強い

OpenAI Astra AI安全性 思维链监控
464
オリジナル

シアトル・タイムズとNewsday、OpenAIとマイクロソフトを提訴:流量47%急落が引き起こした著作権をめぐる攻防

シアトルとニューヨーク・ロングアイランドを拠点とする2つの民間新聞社が、OpenAIとマイクロソフトによる無断コンテンツ利用を訴える38ページの訴状をマンハッタン連邦裁判所に提出した。本件は著作権侵害に加え、商標権侵害も併せて訴求した初のケ

版权诉讼 OpenAI 微软 新闻媒体
2,237
オリジナル

arXivの新論文がAI欺瞞メカニズムを解析する因果フレームワークを提案——既存の誠実性評価の妥当性に疑問

2026年9月3日に提出されたarXiv論文が、「出力における欺瞞」と「メカニズムにおける欺瞞」を区別する因果分類フレームワークを提案。実験により、欺瞞的出力は欺瞞メカニズムが存在しなくても生じ得ること、また欺瞞メカニズムが存在してもモデル

AI安全性 诚信评测 因果框架
289
オリジナル

SWE-Gateベンチマーク:機能テストを通過したAIコード修正の34%がコードレビュー制約に違反

2026年9月3日にarXivで公開されたSWE-Gate論文によると、機能テストを通過したAIによるソフトウェア修正の34%がコードレビュー制約に違反しており、既存のベンチマークがAIエージェントの能力を過大評価していることが示された。

AI软件工程 代码审查 基准测试
161