Googleは効率重視で調整された3つのモデル——Gemini 3.6 Flash、3.5 Flash-Lite、セキュリティ特化型のFlash Cyber——を投入する一方、3.5 Proは目立って非公開とし、Gemini 4が既に学習中であることを確認した。Ars TechnicaはProの欠如をロードマップの兆候と位置付け、VentureBeatは経済性を前面に押し出し、3.6 Flashの価格を100万トークンあたり1.50ドル/7.50ドルとし、長期的なエンジニアリングタスクにおけるエージェントコストが最大65%削減されると主張している。両者が指摘するのは同じ戦略的真実だ——最先端競争は静かにベンチマークでの優位性から推論の単位経済性へとシフトしている。
真の物語が存在するのは価格表である。Google自身の前世代モデル3.1 Flash-Lite(0.25ドル/1.50ドル)は新型の3.5 Flash-Lite(0.30ドル/2.50ドル)より依然として安価で、速度のみがプレミアムの正当化理由となっている。さらに重要なのは、中国の研究所が今や市場の底値を形成していることだ——DeepSeek v4-flashが合計0.42ドル、XiaomiのMiMo-V2.5 Flashが0.40ドル、AlibabaのQwenが2ドル。Googleは最安を目指して競争しているのではなく、大規模に稼働する企業向けエージェントが実際に動作するミッドティア層を防衛しているのだ。
グローバルテクノロジーリーダーにとってのシグナルは、エージェント型ワークロード——チャットではなく——が今や価格競争の主戦場となったことだ。単一の自律型コーディングまたはリサーチエージェントが1タスクあたり数百万トークンを消費する場合、65%のコスト削減は以前は経済的に成立しなかった自動化をプラスROIに転換する。CIOは今四半期中に社内エージェントに関する自社構築対購入の試算を再実行すべきだ。なぜならコストの下限が再び低下したからだ。
非公開とされた3.5 Proは競争上の重みを持つ。効率的なFlash層を公開しながら旗艦モデルをテスト段階に留めることは、OpenAIのGPT-5.6シリーズやAnthropicのOpus 4.8(合計30ドル)——利益と威信が集中するプレミアム推論領域——に対してGoogleがハイエンドの差別化を保護していることを示唆している。一方、Flash Cyberはセキュリティ運用に直接Geminiを組み込む試みであり、競合研究所が投資不足である防御可能な企業向け橋頭堡である。
推奨される対応:価格が月次で下落する中でロックインを回避するためモデル調達を多様化すること、コンプライアンスリスクが導入を阻む場合でも中国のオープンおよびホスト型モデルを実質的なコスト基準として扱うこと、そして単一ベンダーに標準化するのではなくタスク層ごとにモデルを切り替えられるようエージェントパイプラインを設計すること。次のサイクルで勝利する研究所は、リーダーボードで最高得点を記録する研究所ではなく、自律エージェントをあらゆる場所で実行できるほど安価にする研究所である。