一個數字震驚了整個半導體業界:「35 年」。這代表著晶片設計巨擘 Arm 長期以來僅專注於提供 IP 與運算子系統的傳統。然而,在舊金山舉行的 Arm Everywhere event 活動上,Arm 卻劃時代地宣布,將首次跨足實體晶片業務,與全球科技巨頭 Meta 攜手,共同打造出劃時代的 Arm AGI CPU。這款專為新一代 AI 基礎設施量身打造的處理器,不僅宣告 Arm 商業模式的重大轉變,更預示著 AI 資料中心運算版圖即將迎來一場前所未有的變革,而 Meta、OpenAI、SAP 與 SK Telecom 等重量級企業也已確認將採用,為市場投下震撼彈。
表象:Arm 跨界實體,AI 晶片市場迎新局
當 Arm 宣布進軍實體晶片領域時,許多業界人士都感到相當意外。畢竟,長達 35 年來,Arm 始終扮演著幕後推手的角色,將其高效能、低功耗的處理器架構授權給全球晶片製造商,自身從未直接涉足終端產品。這次與 Meta 共同開發的 Arm AGI CPU,正是基於 Arm 先進的 Neoverse V3 架構,並整合了高速通道技術,旨在滿足代理式 AI 基礎設施對運算能力與效率的嚴苛要求。
據 Arm 官方表示,透過 Arm AGI CPU 的問世,他們不僅能為客戶提供從客製化晶片、整合平台方案到直接部署 Arm 設計處理器的多元選擇,更讓生態系夥伴能依據自身需求,靈活選擇最合適的解決方案。這項策略性轉變,無疑將 Arm 的服務範疇從核心 IP 延伸至更廣闊的硬體層面,直接參與到 AI 時代的運算競賽中。
真相:AGI CPU 技術深度解析與代理式 AI 願景
這款引起廣泛關注的 Arm AGI CPU,究竟有何過人之處?其實,它並非橫空出世,而是延續了 Arm 在 Neoverse 運算基礎上的深厚積累。即便這是 Arm 的首款實體晶片,卻已獲得超過 50 家橫跨超大規模雲端運算、晶片、記憶體、網路、軟體、系統設計與製造等領域的生態夥伴鼎力支持。
Arm AGI CPU 的設計核心,是為新一波 AI 革新中的「代理式 AI」工作負載所規劃的大規模機架型系統。這意味著它必須能夠並行處理數千個核心,並在持續高負載的狀態下,依然提供出色的單執行緒任務表現。具體來說,每個 Arm AGI CPU 都採用尖端的 3 奈米製程,功耗為 300W TDP,內部搭載 136 個時脈高達 3.7GHz 的 Arm Neoverse V3 核心,每個核心更配備 2MB 的 L2 快取。在資料傳輸方面,它具備 96 條 PCIe Gen 6 通道,並支援 CXL 3.0 以利記憶體擴展,同時還整合了適用於未來晶片與加速器架構的 AMBA CHI 擴展。在記憶體配置上,則擁有 6GB 的記憶體頻寬,每個晶片最高可達 6TB 容量,並支援最高 DDR5-8800 的記憶體速度,這些規格都直指 AI 資料中心對極致效能與擴展性的需求。
「Arm AGI CPU 的推出,讓我們的客戶在面對 AI 時代的挑戰時,能擁有更豐富、更具彈性的選擇。我們將持續推進產品路線,確保不同合作模式的資料中心客戶都能在平台架構與軟體相容性上攜手並進。」
— Arm 官方發言
各方角力:Meta 領軍,巨頭們的 AI 戰略佈局
有趣的是,Meta 不僅是 Arm AGI CPU 的共同合作夥伴,更是其主要客戶。這款晶片是 Arm 與 Meta 聯手開發的成果,專為新一代資料中心需求量身打造,並能與 Meta 自研的 Meta Training and Inference Accelerator (MTIA) 晶片協同作業,在大規模 AI 系統中實現更高的排程效率。這種深度合作模式,展現了科技巨頭為掌握 AI 核心技術,不惜投入資源從底層硬體共同開發的決心。
除了 Meta,包括 Cerebras、Cloudflare、F5、OpenAI、Positron、Rebellions、SAP 以及 SK Telecom 等知名企業,也已與 Arm 簽署合約,宣布將採用 Arm AGI CPU。這份星光熠熠的客戶名單,無疑是對 Arm 此次破格之舉的強力背書。此外,永擎、聯想、廣達與 Supermicro 等系統商也已開始接受搭載 Arm AGI CPU 的系統訂單,預示著這款新晶片將快速進入市場,加速其普及化。
為了加速 Arm 伺服器 CPU 的普及,Arm 也規劃了符合開放運算專案 (OCP) 與 Arm System Ready 規範的 1OU 雙節點參考設計。他們不僅會貢獻 1OU 雙節點伺服器的設計,還會提供配套韌體、系統架構規範、框架以及適用於基於 Arm 架構系統的診斷與驗證工具。這一切都指向一個明確的目標:建立一個完善且易於部署的生態系,讓 Arm 在資料中心領域的影響力能迅速擴大。
深層影響:效能翻倍、成本巨降,挑戰 x86 霸權
Arm AGI CPU 的出現,不只是技術上的突破,更可能對整個 AI 資料中心產業帶來深遠影響。根據 Arm 所展示的 10OU 雙節點設計,每個刀鋒伺服器包含兩個 Arm AGI CPU,每個晶片都有專用的記憶體與 I/O 控制,使得單一刀鋒伺服器具備 272 個核心與高達 12 條 64GB DDR5 記憶體。一個標準的 36kW 風冷機架就能裝載 30 個刀鋒伺服器,提供共 8,160 個核心的強大運算能力。而 Arm 還與 Supermicro 共同開發了更具規模的 200kW 液冷設計,可容量 336 個 Arm AGI CPU,提供高達 45,000 個 CPU 核心,展現其在超大規模部署上的野心。
「在我們的參考設計下,Arm AGI CPU 的每個機架性能對比傳統 x86 架構,可望高出至少兩倍。這不僅是效能的提升,更是資本支出的顯著減少,預計每 GW 的 AI 資料中心可減少高達 100 億美金的資本支出。」
— 產業分析師觀察
Arm 強調,相較於 x86 伺服器受限於核心互搶記憶體而影響持續效能,Arm AGI CPU 更高的記憶體頻寬有助於使每個機架執行更多有效執行緒。此外,作為基礎的 Arm Neoverse V3 架構,亦具有相對傳統 x86 更出色的單執行緒能耗效能表現。這意味著在 AI 工作負載日益增長的今天,Arm AGI CPU 有潛力在提供卓越效能的同時,大幅降低資料中心的營運成本與碳足跡,這對追求高效益與永續發展的企業來說,無疑是一大誘因。
未解之問:Arm 的新篇章能否順利改寫市場格局?
Arm AGI CPU 的橫空出世,無疑為 AI 晶片市場投下了一顆震撼彈。然而,面對根深蒂固的 x86 生態系,以及其他新興 AI 晶片供應商的激烈競爭,Arm 能否憑藉其在能耗與效能上的優勢,以及與 Meta 等巨頭的深度合作,真正改寫資料中心的市場格局?這款首款實體晶片,會是 Arm 邁向更廣闊市場的成功敲門磚,抑或是挑戰重重的開端?這些問題,或許需要時間來給出答案,但可以肯定的是,AI 運算的未來,正變得越來越精彩。