為了滿足人工智慧(AI)世代對基礎設施的龐大需求,NVIDIA 再出奇招!據 NVIDIA 官方部落格於 8 月 3 日發布的最新基準測試報告指出,專為 AI 原生儲存設計的 Vera 處理器(CPU),能顯著加速加密、壓縮與資料恢復等儲存關鍵原語(primitives)。測試數據顯示,Vera 在資料加密與完整性檢查方面的速度,最高可達傳統 x86 處理器的 3 倍以上,有望徹底解決代理式 AI(Agentic AI)龐大資料吞吐所面臨的 CPU 瓶頸。
(前情提要:AI 助攻量子運算!NVIDIA 開源 31B 視覺模型 Ising 1.5,全自動校準量子電腦)
(背景補充:砸 5000 億鎂!NVIDIA 攜手 OpenAI 擬建「全球最大」AI 資料中心,日本砸重金入局)
在人工智慧(AI)技術邁向「代理化」的進程中,儲存系統已不再只是單純存放資料的倉庫,而是決定 AI 代理(AI Agents)運作效率的關鍵樞紐。台北時間 8 月 3 日,NVIDIA 技術專家 Jason Hardy 與 Ronil Prasad 於官方部落格發布了一篇震撼業界的基準測試報告,詳細揭露了 NVIDIA 專為 AI 原生儲存平台設計的 Vera 處理器(CPU)在多項儲存效能上的卓越表現。
打破 CPU 瓶頸,Vera 專為高併發 AI 儲存而生
報告指出,在代理式 AI 工作負載中,AI 代理會頻繁且大量地檢索企業知識、重用鍵值(KV)快取、執行工具並生成結果。這些密集的動作會觸發龐大的儲存操作,包括資料壓縮、加密、完整性校驗與冗餘計算等。傳統上,這些運算極度依賴伺服器的 CPU,若 CPU 處理速度落後,即便搭載了最頂級的 SSD 與高速網路,也無法發揮系統的完整效能。
為解決此痛點,NVIDIA 透過其 STX AI 原生資料平台的核心元件 —— BlueField-4 STX 儲存處理器,將搭載 88 個自研 Olympus Armv9.2 核心的 Vera CPU 直接導入儲存資料路徑中。Vera 不僅支援 176 個執行緒,更配備了高達 3.4 TB/s 雙向頻寬的快取架構與高速 LPDDR5X 記憶體,專門應付 AI 儲存所需的「單執行緒高效能」與「高頻寬、高併發」雙重嚴苛要求。
基準測試亮眼:加密、壓縮、恢復全面輾壓 x86
在排除磁碟與網路等外部干擾的純記憶體運算測試中,Vera CPU 展現了壓倒性的效能優勢。與傳統的 x86 CPU 相比,Vera 在常見的 AES-128 加密上達到了 1.43 倍的加速,解密則有 1.29 倍的提升;而在資料寫入前常見的 Zstandard 與 LZ4 壓縮處理上,最高更繳出了 3.29 倍的驚人加速表現。
更關鍵的是,攸關系統穩定度與安全性的底層操作同樣獲得大幅優化。用於資料擦除編碼重建的 Reed-Solomon 恢復技術,在 Vera 上加速了高達 3.26 倍;而確保 AI 代理取得可靠上下文資訊的 CRC32C 完整性檢查,更飆升了 3.67 倍之多。即便是在模擬真實環境的「先壓縮再加密」多階段管線測試中,整體流程也達到了 3.21 倍的顯著提升。
兼顧效能與能耗,賦能下一代 AI 工廠
這些卓越的測試數據背後,代表著深遠的產業影響。NVIDIA 強調,Vera 的高效能讓儲存平台能在更低的功耗與散熱預算下,處理海量資料並支援更高密度的併發資料流。這不僅能確保 AI 工廠中的企業機密與模型資產獲得即時的加密保護,同時還能大幅縮短資料重建與回傳的時間,完美契合了先進代理式 AI 對於底層基礎設施的嚴苛需求,為全球 AI 算力軍備競賽再添一項關鍵利器。

📍相關報導📍
黃仁勳霸氣挺中國 AI!稱美國陷入 Kimi 恐慌「搞錯重點」:免費開源將引爆 NVIDIA 晶片需求
小龍蝦 OpenClaw 成立非營利基金會,OpenAI、NVIDIA、微軟、騰訊都搶著入股
戴爾聯手 NVIDIA 推「全液冷」AI 伺服器!首搭 Vera Rubin 架構,單機櫃 144 顆 GPU 算力破表
