AIインフラの展望は、資本がモデルのトレーニングからモデルの実行へと移行するにつれ、根本的な転換期を迎えています。テック投資会社Upper90によるAI推論スタートアップのGeneral Computeへの4億ドルの巨額融資は、ハードウェアの資金調達と展開のあり方における歴史的な節目となります。
担保の新時代:推論チップへの融資
GPU融資の初期段階を彷彿とさせる動きとして、Upper90は新しい資産クラス、すなわち「推論特化型シリコン」へと乗り出しています。CoreWeaveのような企業が先導したこれまでの融資の波は、大規模なトレーニングワークロードに使用されるNvidia GPUに焦点を当ててきましたが、今回の4億ドルの取引では、学習済みモデルの実行に特化して設計されたチップが担保として利用されます。
CEOのFinn Puklowski氏が率いるGeneral Computeは、「ネオクラウド(neocloud)」を構築しています。これは汎用コンピューティングではなく、AIワークロードに特化して設計された専門的なインフラプロバイダーです。この違いは極めて重要です。AWSやAzureのような従来のハイパースケーラーが幅広いサービスを提供する一方で、ネオクラウドは大規模言語モデル(LLM)特有のレイテンシ(遅延)とスループットの要件に最適化されています。
SambaNova SN50の技術的優位性
General Computeの戦略の中核にあるのは、Intelが支援するチップメーカーであるSambaNovaとのパートナーシップです。同社は、従来のハードウェアを大幅に上回るパフォーマンスを実現するように設計されたSambaNovaのSN50チップを導入しています。
General Computeによると、これらのチップは現在のGPUベースのクラウドと比較して、最大16倍速い推論速度を実現できます。単なる処理速度だけでなく、SN50には2つの大きな運用上の利点があります。
- 電力効率: トークンあたりの消費電力が少なく、AI導入に伴う膨大なオーバーヘッドコストを削減できます。
- 冷却の簡素化: 複雑で高価な水冷システムを必要とすることが多いハイエンドGPUとは異なり、これらのチップは、より幅広い標準的なデータセンター環境において迅速な展開を可能にします。
Nvidiaの独占を打破する
この取引は単なる資本注入にとどまりません。市場がNvidiaの支配に対する代替案を求めているという戦略的なシグナルでもあります。トークンコストや最先端モデルへのアクセス費用が開発者にとって依然としてハードルとなっている中、オープンソースモデルへの安価で効率的なアクセスへの需要が高まっています。
コーディングのベンチマークでAnthropicやOpenAIと競合するKimiのK3のように、高性能なオープンソースモデルが台頭していることは、業界のボトルネックが「いかにモデルを構築するか?」から「いかに手頃な価格で実行するか?」へと移行していることを意味します。Nvidia以外のシリコンを活用することで、General ComputeやTensorWave(AMDと提携)のような競合他社は、優れた総所有コスト(TCO)を提供できる体制を整えています。
Puklowski氏が指摘したように、この取引は、AIエコシステムにおけるNvidiaの独占的な支配を分散させるために「資本が自律的に組織化されている」ことを表しています。特化型の推論ハードウェアに賭けることで、投資家はAIブームの次のステージが、規模、効率性、そして日常的なアプリケーションにおけるAIの普及によって推進されることを認めているのです。
主なポイント
- 推論第一の融資: 4億ドルの取引は、大規模な融資の担保として、単なるトレーニング用GPUではなく、特化型の推論チップを使用する方向への転換を示しています。
- パフォーマンスの向上: General Computeは、電力効率に優れ展開が容易なSambaNovaのSN50チップを使用することで、GPUベースのクラウドを最大16倍上回る性能を目指しています。
- スタックの多様化: この動きは、オープンソースLLMの費用対効果の高いスケーリングを支えるために、Nvidia以外のシリコンに対する市場需要が高まっていることを示唆しています。
