この夏のAIハイプに騙されるな

この夏のAIハイプに騙されるな

編集注:2026年のこの夏、AI業界では毎週のように新たな「ブレークスルー」が演じられている。しかしTimnit GebbruとEmily Bender――現代最も著名な二人のAI批評家――がこのニュースの流れを精査すると、見えてくるのは技術の飛躍ではなく、成熟したハイプのメカニズムだ。本稿は彼女たちの論評を基に編訳し、背景情報を補足したものである。

「驚異的な発表」が次々と

事の始まりは4月下旬だった。Anthropicは、自社モデルのClaude Mythosがソフトウェアの脆弱性発見において大多数のセキュリティ専門家を上回ると発表した。その表現は巧みだった。「特定のベンチマークで」ではなく、「大多数のセキュリティ専門家を超える」――非常に衝撃的に聞こえるが、ほぼ検証不可能な表現だ。

続いてOpenAIとHugging Faceへの不正アクセス事件が起きた。騒ぎが収まらぬうちに、AnthropicとMetaも――前者は大々的に、後者は渋々と――自社モデルに関わる類似事案を相次いで公表した。その後も、ほぼ数週間おきに新たな「マイルストーン」が見出しを飾り続けた。

これらの発表には共通点がある。いずれも当該企業自身が発表し、いずれも社内評価に基づいており、そしていずれも独立した検証がなされる前に、市場と世論における役割をすでに果たし終えている。

「人間の専門家を超える」とはどういう意味か

モデルが大多数のセキュリティ専門家より優れた脆弱性発見能力を持つと主張するには、いくつかの基本的な問いに答える必要がある。その「専門家」とは誰か?どのような条件で、どれくらいの時間をかけ、どのようなコードに対して評価されたのか?評価データセットは公開されているのか?結果はサードパーティによって再現可能なのか?

ソフトウェアセキュリティの分野では、こうした問いは特に鋭く刺さる。脆弱性の発見は制限時間付きの競技ではなく、文脈・経験・対抗的思考に高度に依存する専門的作業だ。複雑な専門的判断を一つの順位に圧縮すること自体、すでに一種の語りの操作である。企業が競技者であり審判であり同時にスポンサーでもあるとき、「リード」という言葉はすでに意味を失っている。

セキュリティインシデントの開示においても同様の問題がある。誰が先に開示するか、どの程度まで開示するか、影響範囲をどのような口調で説明するか――すべて当事者企業が自ら決定する。公衆の目に届くのは、完全な事故の事後分析ではなく、広報の手が入った声明文だ。

ハイプはバグではなく、ビジネスモデルだ

なぜこうした発表が集中して現れるのか。それは非常に具体的なビジネス目的に資するからだ――資金調達、企業評価、法人向け調達の意思決定、そして規制をめぐる言説における有利なポジションの確保である。

ここには興味深い二重構造がある。一方では、モデルの能力が驚異的で専門的な人的作業を代替できるほどだと主張し、他方では、AIが危険なほど強力であり特別なガバナンスが必要だと強調する――そしてガバナンスの最適な担い手は、よりによってそれを開発した企業自身だとされる。能力の語りは受注をもたらし、リスクの語りは参入障壁をもたらす。

同時に、メディアのサイクルは検証よりスピードを報酬とする。「AIが人間の専門家を超えた」という見出しは数時間で全世界に広まる。一方、評価手法を解体しデータの出所を追う分析記事は完成まで数週間かかり、読まれる数もはるかに少ない。これは特定の企業の問題ではなく、インセンティブ構造全体の問題だ。

次の「ブレークスルー」をどう読むか

明確にしておきたいのは、これはAIが進歩していないと言っているわけではない。モデルは確実に強くなっており、特定のタスクにおける性能は確かに印象的だ。しかし「社内ベンチマークで好成績を出す」ことと「訓練を受けた専門家を代替する」ことの間には、巨大な隔たりがある。そしてその隔たりは、通常ニュースの見出しには現れない。

GebbruとBenderの指摘は三つの問いに集約できる。誰が言っているのか?誰が金を出しているのか?誰が独立して検証できるのか?

三つの答えがそれぞれ「モデルを売る側」「投資家」「誰もいない」を指すなら、その発表に値するのは見出しではなく、より長い技術的補足資料だ。

この夏は暑いが、熱量は事実ではない。次に「AIが人間を超えた」という見出しを目にしたとき、まず一つ問うてみてほしい――なぜよりによって今、この発表が出てきたのか?

本稿はMIT Technology Reviewより編訳。