NVIDIA CorporationDSpark reduces need for Nvidia's LPX decode rack, threatening sales of a key product.
DeepSeekがオープンソースで公開した投機的デコードモジュール「DSpark」により、NvidiaがエージェントAIワークロード向けの必須アップグレードとして販売する新型Groq 3 LPXデコードラックの売り込みが難しくなっている。MITライセンスで公開されたDSparkは、出力ごとに必要なフルデコードパスの回数を減らすことで、DeepSeek-V4-Flashでユーザーあたりの生成速度を60%から85%、V4-Proで57%から78%向上させる。KVキャッシュのメモリ要件を90%以上削減するDeepSeekのMLAアーキテクチャと組み合わせることで、これらのソフトウェア革新は、LPXが収益化を狙うデコードのボトルネックを直接的に縮小する。NvidiaのLPXラックは、256基のGroq LPUアクセラレータを中心に構築され、Vera Rubin GPUと組み合わされるが、既にRubinシステムにコミットした顧客に別途購入を決断させる必要がある。弱気の見方は、汎用のRubin GPU上でDSparkを動かすだけで、ほとんどのワークロードでLPXをオプション扱いにできるほどの推論効率が得られるというものだ。特に、AWSやCerebrasが同じ2026年のタイムラインで競合する分散型推論ソリューションを投入する中で、その傾向は強まる。
NVIDIA CorporationDSpark reduces need for Nvidia's LPX decode rack, threatening sales of a key product.
Cerebras Systems Inc. Class A Common StockCerebras launches competing disaggregated inference solutions on same timeline, benefiting from Nvidia's weakness.
Amazon.com IncAWS launches competing disaggregated inference solutions, potentially benefiting from DSpark's efficiency.
DeepSeek's open-source DSpark module boosts inference speed and reduces decode bottlenecks, strengthening its competitive position.
DSpark makes Groq's LPX decode rack less necessary, undermining demand for Groq's hardware.