2026年2月6日を起点として、その後6ヶ月間でAIエージェントは算力消費において人間ユーザーを逆転した。
The Decoderの報道によると、OpenRouterのアナリストPeter Walkerが公開したデータによれば、2026年8月10日時点の7日間平均値で、同プラットフォームにおけるAIエージェントのトークン消費量は7.3兆に達し、2月6日の0.51兆から約14倍に増加した。同期間に人間ユーザーの消費量は約0.5兆から1.4兆へと2.8倍増加した。エージェントの総消費量は人間の5倍以上となっている。
なぜ「5倍」ではなく「14倍」なのか
エージェントの消費増加速度が絶対的な比率を上回る理由は、1回のリクエストにおける構造的な違いにある。OpenRouterプラットフォームのデータによると、典型的なエージェントタスク1回あたりのトークン消費量は、人間との対話の13〜15倍にのぼる。エージェントのワークロードにはツール定義、MCPゲートウェイ設定、スキルの前置説明、複数ターンの推論コンテキストが含まれており、1回の自律的なプログラミングや調査タスクのトークン量は、通常の問答数百回分に相当する場合がある。
推論モデルの普及がこの効果を増幅させている。OpenRouterのデータによれば、推論モデルには「過剰思考」現象が見られ、深い推論を必要としないリクエストに対しても、回答前に大量のトークンを内部的な推論に費やす傾向がある。
コスト上昇はキャッシュにより一部緩和されるが、構造的な圧力は依然として存在
エージェントが生成する7.3兆トークンのうち、約70〜85%はキャッシュヒットによるものだ。キャッシュヒットは優遇価格で課金されるため、実際のコスト増加はトークン数の数字よりも低く抑えられている。エージェントのワークフローはシステムプロンプト、ツール定義、過去のコンテキストを繰り返し利用するため、自然とキャッシュに適した構造を形成する。
割引後であっても、人間の7倍に達する消費量は、推論プロバイダーの収益構造における重要な変数となっている。エージェントタスクの複雑さが増すにつれ、キャッシュで対応できない純増の出力トークンがより速いペースでコストを積み上げていく。
エージェント市場における中国モデルのシェア変化
OpenRouterの公式ブログによると、同プラットフォームにおけるDeepSeekのトークンシェアは2026年1月の9%から6月には18%に上昇し、中国モデル全体のトークン消費量は米国モデルを超えた。DeepSeek V4が2026年4月24日にリリースされた後、5月末までに軽量版のV4-FlashがDeepSeekのエージェントトークントラフィックの70%を占めるようになった。
DeepSeek V4 Flashの価格は入力100万トークンあたり0.09ドル、出力0.18ドルであるのに対し、GPT-5.5は入力5ドル、出力30ドルと、その価格差は約55倍に達する。同期間に人間ユーザーは引き続きDeepSeek V3.2を使用している一方、エージェントトラフィックはV4-Flashへと移行しており、エージェントと人間のモデル選好が分化していることが示されている。
インフラのビジネスモデルの変容
OpenRouterの共同創業者兼COOのChris ClarkはSaaStrのインタビューで、同プラットフォームが週あたり約28兆トークンを処理する見込みであり、これは世界全体の推論量の約1%に相当し、Salesforceが同社の全事業期間を通じて処理した量を上回ると述べた。
エージェントのトラフィックは、人間によるランダムなピーク負荷とは異なり、より予測可能なバッチ負荷をもたらすため、算力のスケジューリングと価格戦略に影響を与えている。エージェントはサービス品質に対する許容誤差が低く、1回のツール呼び出しの解析エラーが自動化チェーン全体の崩壊を招く可能性がある。また、同一のオープンソースモデルが異なるプロバイダーで実際のパフォーマンスに差が生じるのは、モデルの重みではなく中間層のソフトウェアに起因している。
企業側の予算モデルはすでに時代遅れに
Blockonomiのデータによると、企業ユーザーの中で上位10%の「フロンティア型企業」は、アクティブユーザー1人あたりの出力トークン量が一般企業の8.3倍に達しており、今年1月時点ではこの差は2.6倍にすぎなかった。法律業界向けエージェントツールの週間アクティブユーザー数は今年2月以降108倍に増加しており、タスクには契約書レビュー、デューデリジェンス、法規制の比較など長いコンテキストを必要とするシナリオが含まれている。
この転換がもたらす影響
2026年2月6日のベースラインは、推論市場の中心的な買い手が人間からプログラムへと移行した転換点を示している。OpenRouterはオープンソースモデルへの偏りが顕著であり、クローズドソースAPIにおけるエージェント利用状況の公開データは存在しない。エージェント1回あたりのタスクコストが人間との対話の15倍に達し、中国モデルが55倍の価格優位性でエージェントトラフィックを占有しつつある中、AIインフラ業界の価格論理、容量計画、競争上の障壁は根本的な再計算を迫られている。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接