DeepSeek V4.1 Flashが欧米の最先端モデルより大幅に安価だとするバイラルな言説は今週、実践的な実験と衝突した。あるコールセンターコンサルタント企業がNvidia H200を4台レンタルしてClaude Codeの背後でモデルを実行したところ、APIルートの方が自社ホスティングより安価であることが判明し、月間GPU費用がClaudeの支出を上回る一方、セキュリティ上の懸念から展開をオフラインに留めざるを得なかった。経営幹部への教訓は、DeepSeekが過大評価されているということではなく、'トークンあたりの低コスト'と'運用コストの低さ'は全く別の帳簿であるということだ。
オープンウェイトモデルの真のコストは、償却されたハードウェア、利用率、そしてセキュリティ確保と稼働維持のためのエンジニアリング労力に支配される。100%未満の稼働率のH200クラスターは、高価な遊休資本である。マネージドAPIはそのリスクをプロバイダーに移転する。これが、大きく喧伝された中国のコスト破壊が、これまでのところ、ワークロードをプライベートGPUフリートに大規模に移行させるのではなく、主にグローバルな推論価格を圧縮してきた理由だ。セキュリティの側面も重要である。このコンサルタント企業はコードをネットワークから遮断したが、これは中国発のモデルに関するデータガバナンスと来歴の懸念が、価格に関係なく依然として厳しい商業的制約であることを暗黙に認めたものだ。
注目すべき並行する動きは、DeepSeekがHuaweiのAscendチップ向けに6つのソフトウェアモジュールをオープンソース化したことで、以前のNvidiaツールを反映している。これは今日のパフォーマンスに関するものではなく、最終的に中国国内でNvidiaの支配力を緩める可能性のある'独立した制御可能な'ソフトウェアスタックの構築に関するものだ。グローバルバイヤーにとって、信頼できる第二のシリコン・プラス・ソフトウェアのエコシステムは、Ascendが生のスループットでまだ競争力がなくても、長期的な価格交渉力を再構築する。
日本の企業とSIerにとって、この実験は'安価な中国モデルを採用する'という取締役会の圧力への有用な解毒剤となる。日本企業は3つの重層的な摩擦に直面している。地域で最も保守的なデータレジデンシーとセキュリティ審査サイクル、GPUクラスターを実行・強化できるMLOpsエンジニアの慢性的な不足、そして曖昧なデータ系統を持つツールにペナルティを課す調達ガバナンスである。マネージドAPIが自社ホスティングに勝るというコンサルタントの結論は、内部エンジニアリング時間が希少で高価な典型的な日本のコスト構造にほぼ完全に合致している。
日本のSIerにとっての実践的なプレイブックは、モデル選択を二者択一として扱うのをやめ、代わりにルーティングレイヤーを販売することだ。機密性が低く大量のタスクには安価なオープンモデルを、顧客データや規制対象ワークフローに触れるものにはプレミアムマネージドAPIを使う。真のマージンは、大半の日本企業が社内で構築できないオーケストレーション、セキュリティラッピング、総所有コストモデリングにある。DeepSeekのAscendツールは、Huaweiベースのオプションが国内で調達上関連性を持つようになるずっと前に、マルチシリコンの将来のシナリオプランニングを今から始めるべきシグナルである。