NVIDIA CorporationDSpark reduces need for Nvidia's LPX decode rack, threatening sales of a key product.
โมดูลถอดรหัสแบบคาดการณ์ DSpark แบบโอเพนซอร์สของ DeepSeek กำลังทำให้ Nvidia ขายแร็คถอดรหัส Groq 3 LPX ใหม่ในฐานะการอัปเกรดที่จำเป็นสำหรับเวิร์กโหลดเอไอแบบเอเจนต์ได้ยากขึ้น DSpark ซึ่งเปิดตัวภายใต้สัญญาอนุญาต MIT เพิ่มความเร็วในการสร้างต่อผู้ใช้ขึ้น 60% ถึง 85% บน DeepSeek-V4-Flash และ 57% ถึง 78% บน V4-Pro โดยลดจำนวนรอบการถอดรหัสเต็มที่จำเป็นต่อเอาต์พุต เมื่อรวมกับสถาปัตยกรรม MLA ของ DeepSeek ซึ่งลดความต้องการหน่วยความจำแคช KV ลงกว่า 90% นวัตกรรมซอฟต์แวร์เหล่านี้ลดคอขวดด้านการถอดรหัสที่ LPX ถูกออกแบบมาเพื่อสร้างรายได้โดยตรง แร็ค LPX ของ Nvidia ซึ่งสร้างขึ้นจากตัวเร่ง Groq LPU 256 ตัวและจับคู่กับจีพียู Vera Rubin ต้องอาศัยการตัดสินใจซื้อแยกต่างหากจากลูกค้าที่ได้ลงทุนในระบบ Rubin ไปแล้ว มุมมองขาลงคือ DSpark ที่ทำงานบนจีพียู Rubin ทั่วไปเพียงอย่างเดียวอาจให้ประสิทธิภาพการอนุมานที่เพียงพอจนทำให้ LPX เป็นทางเลือกสำหรับเวิร์กโหลดส่วนใหญ่ โดยเฉพาะอย่างยิ่งเมื่อผู้ให้บริการไฮเปอร์สเกลอย่าง AWS และ Cerebras เปิดตัวโซลูชันการอนุมานแบบแยกส่วนที่แข่งขันกันในช่วงเวลาเดียวกันในปี 2026
NVIDIA CorporationDSpark reduces need for Nvidia's LPX decode rack, threatening sales of a key product.
Cerebras Systems Inc. Class A Common StockCerebras launches competing disaggregated inference solutions on same timeline, benefiting from Nvidia's weakness.
Amazon.com IncAWS launches competing disaggregated inference solutions, potentially benefiting from DSpark's efficiency.
DeepSeek's open-source DSpark module boosts inference speed and reduces decode bottlenecks, strengthening its competitive position.
DSpark makes Groq's LPX decode rack less necessary, undermining demand for Groq's hardware.