科技

阿里巴巴Zhenwu V900明年Q1登場 216GB封裝記憶體、2032算力拚20GW

記者黃仁杰/編譯

阿里巴巴在杭州舉行的Apsara Conference公布新一波AI基礎設施布局,包括下一代Zhenwu V900 AI加速器、大規模算力部署計畫,以及Qwen 4.5、Qwen 5.0等新一代模型發展方向。

阿里巴巴在杭州舉行的Apsara Conference公布新一波AI基礎設施布局,包括下一代Zhenwu V900 AI加速器、大規模算力部署計畫。(圖/阿里巴巴提供)

其中,Zhenwu V900預計於2027年第1季正式推出,單顆晶片將配置216GB封裝內記憶體,高於輝達H200的141GB。

Zhenwu V900記憶體達216GB 效能傳為前代3倍

阿里巴巴表示,Zhenwu V900將搭載216GB封裝內記憶體,晶片間則透過自家的ICN Switch互連架構,提供約1.2TB/s的互連速度。

效能方面,V900預計可達前代Zhenwu M890的約3倍,並原生支援FP8與FP4。

按照M890約0.6 PFLOPS的FP16效能估算,V900單顆FP16峰值算力可能達約1.8 PFLOPS。

目前外界也推測,V900可能採用長鑫存儲(CXMT)的HBM3E方案,主要是雙方量產時程相近,但阿里巴巴並未正式確認相關供應關係。

最多50萬顆晶片組成單一叢集

ICN Switch可讓約1000顆Zhenwu V900協同運作,如同單一大型加速器。

阿里巴巴進一步表示,單一V900叢集最高可擴展至50萬顆晶片,若以每顆216GB記憶體計算,整體記憶體容量可達約108PB。

如此龐大的部署規模,也意味相關HBM供應能力將成為後續量產的重要觀察重點。

推出自有Rack-scale AI系統

除了單顆AI晶片,阿里巴巴也正在打造自己的機櫃級AI系統。

整套架構包含Yitian CPU、Zhenwu V900 GPU、ICN互連、Pangu NIC以及Zhenyue儲存控制器,希望從處理器、網路到儲存建立完整AI運算平台。

2032年前部署20GW算力

算力建設方面,阿里巴巴計畫到2032年部署20GW運算容量。

摩根士丹利先前估計,阿里巴巴到2026年底的算力規模約為5GW。若要達成20GW目標,未來數年平均每年需要新增約2至3GW算力。

Qwen 4.5、Qwen 5.0參數上看10兆

模型方面,阿里巴巴透露,未來的Qwen 4.5與Qwen 5.0模型規模將落在4兆至10兆參數之間。

公司同時正在研究RSI(Recursive Self-Improvement,遞迴式自我改進)方向,也就是讓AI系統參與下一代模型的開發、程式設計或訓練流程,進一步提高模型開發效率。

Qwen-Image-2.1開放權重

阿里巴巴也已釋出Qwen-Image-2.1權重,這是一款文字生成圖片與影像編輯模型。

其視覺生成架構約使用70億參數,包含32層single-stream DiT架構。

目前Arena已將Qwen-Image-2.1列為開源影像編輯模型中的領先產品之一。

從Zhenwu V900、機櫃級系統到20GW算力建設與兆級參數Qwen模型,阿里巴巴正同步擴張晶片、互連、資料中心與AI模型,希望建立更完整的自有AI運算體系。

來源:wccftech

Loading

本篇文章授權來源:科技島

Author

Write A Comment