AI予算が立てられない。ウォールストリートジャーナルが報じたこの一言は、生成AI導入ブームの祭りが終わり、請求書の二日酔いが始まったことを意味する。推論型モデルの登場でトークン消費は不透明化し、先月の3倍の請求が飛んでくる時代。現場任せの導入は、もはや経営リスクそのものだ。

何が起きたか

ウォールストリートジャーナルの報道によれば、企業におけるAI利用料金が「予算を立てられない」ほど乱高下している。原因は明快で、ChatGPTやClaudeに代表される生成AIが採用する「トークン課金」という仕組みだ。文章の文字数、正確には処理単位であるトークンの量に応じて都度課金される。使えば使うほど請求が膨らむ、水道メーターのような料金体系である。

さらに深刻なのが推論型モデルの存在だ。ユーザーが1回質問を投げるだけで、モデルは裏側で何十回も「考える」プロセスを回す。表には見えない思考ステップがすべて課金対象となり、同一業務のはずなのに先月比3倍の請求が届く事例が続出している。CFOにとってこれは悪夢だ。原価計算が成立しないサービスを、全社員が毎日叩いているのだから。

なぜこのニュースが重要か

このニュースの本質は「AIコストが変動費化した」という一点に尽きる。これまでSaaSは月額固定という、経理が最も愛する美しい形で請求されてきた。ところが生成AIは、クラウドコンピューティングですら予測可能だった時代を終わらせ、「使用量が読めない変動費」という最悪のカテゴリに企業を叩き込んだ。

しかも推論型モデルの登場で、ユーザーは自分がいくら使っているか体感できない。質問1回あたり裏で30回思考されようが、画面には答えしか出ない。これは、タクシーに乗ったら運転手が勝手に遠回りして料金が3倍になる構造と同じだ。利用者には制御権がない。

経営リスクとして見るべきは、年次予算の信頼性が崩壊する点である。予算統制が効かない費目を全社員が自由に使える状態は、内部統制上もアウトだ。監査法人がこの問題を指摘し始めるのは時間の問題だろうと推定する。AI spendingの可視化と統制は、もはや情シスのタスクではなく、CFOアジェンダに格上げすべき案件である。

過剰評価への反論

ここで誰も言わないことを言う。この問題を「ツールの使い方」や「プラン選定」の話に矮小化している限り、何も解決しない。本質は、AIベンダー側がトークン課金という不透明な仕組みを意図的に維持していることにある。

考えてみてほしい。OpenAIもAnthropicも、ユーザー企業が月額いくら使うか事前に見積もるツールをまともに提供していない。推論型モデルの思考量を事前にキャップする機能も、極めて限定的だ。これは技術的に不可能なのではなく、収益最大化のために意図的に設計されたビジネスモデルだと見るのが自然である。

動画のナレーションでは「定額プランと従量課金の併用」「部署ごとに月額上限とアラート」「安いモデルへの振り分け」という3つの処方箋が提示された。どれも正しい。しかし現場からの「モデル選定も費用管理も社員に押し付けるのは無理」という悲鳴こそが真実だ。一般社員にgpt-4oとgpt-4o-miniの使い分け判断を求めること自体、職務設計として破綻している。

AI導入を「現場の工夫」で乗り切ろうとする企業は、3年後に数億円単位の無駄遣いと、それでも生産性が上がらなかったという二重の敗北を抱えることになると想定する。ベンダーが設計した不透明な課金構造に、個人の節約努力で立ち向かうのは無理筋だ。

経営者として次に取るべき動き

第一に、AI spending専任のオーナーをCFO配下に置くこと。情シスでもDX推進室でもない。費用統制の責任者が、全社のAI利用料を単一ダッシュボードで日次監視する体制を今月中に作れ。部署ごとの月額上限とアラートは最低限の防衛線だ。

第二に、ユースケースごとにモデルを強制割り当てするルーティング層を自社で構築すること。社員にモデル選定を委ねるのは諦めろ。要約・翻訳は廉価モデル、複雑な分析のみ推論型モデルという振り分けを、プロキシ経由で機械的に強制する。これは2026年のIT部門の必須業務だ。

第三に、ベンダーロックインを避けるため、OpenAI・Anthropic・Google・国産モデルの最低2社以上を並行採用し、価格交渉カードを握り続けること。トークン単価は今後も下がるが、下げさせるのは競争圧力をかけ続けた企業だけだ。黙って使う企業は、黙って請求される。