ChatGPT日均消耗算力相當於3萬臺伺服器,引發全球AI伺服器荒。Meta為訓練Llama 3採購10萬片H100 GPU,導致交貨週期延至36周。浪潮推出「融合架構」AI伺服器NF5688G7,支援8顆H100+4顆鯤鵬CPU,大模型訓練效率提升40%。
技術演進
NVLink 4.0:GPU間頻寬達900GB/s,比PCIe 5.0快7倍
液冷GPU:H100液冷版功耗降至550W,同等算力節電30%
存算一體:三星HBM3E記憶體堆疊至12層,頻寬819GB/s
產業變局
英特爾Gaudi 3加速器以40%價效比優勢搶佔市場,谷歌TPU v5實現晶片間直連,擺脫GPU依賴。2024年AI伺服器市場規模將突破$760億。