一句話總結:Supermicro 在 NVIDIA GTC 2026 大會上,率先推出了業界首批基於 NVIDIA STX 模組化參考架構的 CMX 語境記憶體儲存伺服器,旨在大幅加速 AI 推論效能,特別針對複雜的 AI 查詢與多階段代理人工作負載。
核心要點
- Supermicro 於 NVIDIA GTC 2026 大會期間,發表了業界首批 CMX 語境記憶體儲存伺服器,這項創新是基於 NVIDIA 全新 STX 模組化參考架構所打造,目標是加速 AI 的完整生命週期。
- 此 STX 架構專為應對需時甚久的 AI 查詢及多階段連鎖思維代理人工作負載而設計,這些任務需要頻繁調用與使用者查詢關聯的先前及中間 Token。
- Supermicro 董事長兼執行長梁見後(Charles Liang)表示,公司持續透過創新的機架級架構來滿足快速發展的 AI 工廠客戶需求,並強調與 NVIDIA 緊密無間的合作關係,以率先將革命性技術帶入市場。
- CMX 儲存伺服器的核心機制是儲存 Token 的鍵值(KV)快取,此快取由 NVIDIA 的推論協調層 NVIDIA Dynamo 負責管理,能有效避免在地儲存空間不足時重新運算所衍生的龐大功耗。
- 此解決方案既能加快輸出結果,又能顯著節省電力,解決了 AI 訓練與推論過程中資源消耗的痛點。
- Supermicro 將與軟體合作夥伴及包括 Micron、Samsung、Phison 等領先 SSD 供應商合作,針對特定的 STX 架構要求進行移植與驗證工作,以確保其穩定上市。
- 在 2026 年 3 月 16 日至 19 日的 NVIDIA GTC 2026 大會期間,CMX 伺服器將在 Supermicro 的 #1113 攤位及 NVIDIA 展區亮相,同時 Supermicro 也與多個儲存夥伴共同推出了 7 款 AI 資料平台解決方案。
一句話結論
Supermicro 透過率先導入 NVIDIA STX CMX 儲存伺服器,為 AI 推論工作負載帶來突破性的效能與節能優勢,再次鞏固其在 AI 基礎架構領域的領導地位,並與業界夥伴共同推動 AI 資料平台的發展。










