Google今天(9日)推出首款專為人工智慧(AI)推論打造的新一代AI晶片TPU,命名為Ironwood。雲端運算服務提供2種運算配置,其中大型配置由9216顆晶片組成,運算能力為目前最大超級電腦El Capitan的24倍以上。
以雲端運算技術為主的Google Cloud Next大會9至11日在美國拉斯維加斯舉行,Google於會中發表第7代AI晶片TPU(Tensor Processing Unit,張量處理單元)Ironwood。
專為推論任務設計 能源效率與效能雙突破
Google Cloud副總裁瓦達特(Amin Vahdat)在會前記者會指出,Ironwood是Google首款專為AI推論(Inference)任務設計的TPU,也是迄今最強大且能源效率最高的TPU,引領客戶邁入推論新時代,意味著能夠以更大規模開發與部署推論式AI模型。
Google提供搭載256顆與9216顆晶片的2種配置,後者的運算能力約為全球最大超級電腦El Capitan的24倍以上,足以支援如Google最新AI模型Gemini 2.5的高效能需求。
高頻寬記憶體與綠能優化 提升AI部署效率
除了運算效能的顯著躍升,Ironwood在能源效率上也大幅提升,其每瓦效能(perf/watt)是第6代TPU Trillium的2倍,使AI任務的執行更具成本效益。此外,Ironwood提供192GB的高頻寬記憶體(HBM)容量,為Trillium的6倍,讓系統能處理更多資料,進而提升整體效能。
多元硬體選擇 減輝達依賴強化自主性
以Ironwood為核心,Google強化AI雲端基礎設施,提供更多元化的硬體選擇。除了TPU創新外,也提供輝達(NVIDIA)繪圖處理器(GPU)組合算力,是首家同時提供B200與GB200晶片的雲端服務商,未來也將支援輝達下一代AI超級晶片Vera Rubin。
Google在TPU的持續突破,將有助於其在硬體上降低對輝達的依賴,進一步提供更具競爭力的價格。研調機構Omdia估計,Google去年在TPU上的花費為60億至90億美元(約新台幣1990億元至2907億元)。
美國科技媒體The Information日前報導,Google正與聯發科攜手開發新一代TPU,預計將於明年投入生產,對此Google則未予置評。
用Podcast訂閱本節目