Arm AGI CPU重塑代理式AI算力格局:單機架核心突破4.5萬,解鎖資料中心效能瓶頸

近期,Arm在揭示跨足實體晶片製造後,其雲端AI事業部執行副總裁Mohamed Awad進一步公開了首款自製處理器「Arm AGI CPU」的技術細節。這款基於Arm Neoverse平台打造的量產級產品,核心目標在於解決「代理式AI」時代下,中央處理器(CPU)成為資料中心協調運算過程中的「算力瓶頸」,透過創新的機架…

近期,Arm在揭示跨足實體晶片製造後,其雲端AI事業部執行副總裁Mohamed Awad進一步公開了首款自製處理器「Arm AGI CPU」的技術細節。這款基於Arm Neoverse平台打造的量產級產品,核心目標在於解決「代理式AI」時代下,中央處理器(CPU)成為資料中心協調運算過程中的「算力瓶頸」,透過創新的機架級設計,旨在為AI基礎設施帶來革命性的效能提升。

代理式AI時代的挑戰:CPU為何成為算力瓶頸?

隨著「代理式AI」的崛起,傳統的運算模式面臨了前所未有的挑戰。Mohamed Awad解釋,過去的瓶頸在於人類輸入指令的速度,限制了系統的執行節奏;然而,在代理式AI環境中,軟體代理能夠24小時不間斷地自主協調任務,並與多個大型語言模型即時互動與決策。在這種持續且極度複雜的運作模式下,CPU的角色產生了質變,它不再僅是圖形處理器(GPU)的輔助角色,而是必須同時管理數以千計的分散式任務、調度加速器、管理記憶體與儲存,甚至處理海量AI代理之間的「扇出」(fan-out)協調任務。

面對負載呈指數級飆升的現況,傳統x86架構的CPU在持續高負載運作下,往往會出現核心爭用與效能衰退等問題,進而限制了整體資料中心的運算效率。這正是Arm決定親自投入研發,打造專為此情境優化的AGI CPU的核心原因。Arm認為,要克服現有框架的限制,必須從底層架構進行徹底的重新設計。

Mohamed Awad指出:「代理式AI對算力的需求,讓CPU從過去的幕後角色,一躍成為資料中心運算效能的關鍵樞紐。我們必須重新思考伺服器設計,才能滿足這種前所未有的複雜與高負載需求。」

Arm AGI CPU:為「機架級」運算而生

為了解決資料中心面臨的痛點,Arm AGI CPU從運作時脈、記憶體到I/O架構,皆是為了支援「高密度機架佈署」與「大規模平行運算」而量身訂做。Arm透過極致的機架密度與多執行緒效能,標榜能提供x86架構系統兩倍以上的單機架效能,宣告AI雲端基礎設施正式邁入「Arm原生」的全新發展階段。

Arm官方釋出了「AGI CPU」的硬體參考配置,展現其卓越的擴展性與彈性:

  • 1OU雙節點設計:這套標準氣冷伺服器參考架構,每個刀鋒伺服器(Blade)包含兩個節點,配置兩顆AGI CPU、專屬記憶體與I/O埠,單一刀鋒伺服器即可提供272組運算核心。
  • 氣冷36kW機架:一個標準的36kW氣冷機架系統可容納30個上述刀鋒伺服器,總計提供高達8160個CPU核心。
  • 液冷200kW巨獸:Arm更與Supermicro合作,設計支援200kW液冷的極端配置,單一機架可容納336顆Arm AGI CPU,總核心數更能突破驚人的45000個,展現其在極端環境下的強大運算潛力。

Mohamed Awad強調,Arm Neoverse V3核心具備優異的「單執行緒」效能與更高記憶體頻寬表現,確保每一個執行緒都能完成更多工作,且不會像x86架構設計在滿載時可能發生效能崩潰,這正是其能提供超越最新x86架構系統兩倍以上機架運算效能的關鍵。

不只賣晶片:Arm定義次世代伺服器標準

值得注意的是,Arm此次不僅僅是推出晶片產品,更是積極定義下一代伺服器的硬體標準。為加速生態系的採用,Arm宣布推出符合開放運算計畫(OCP)DC-MHS標準尺寸的「Arm AGI CPU 1OU雙節點參考伺服器」。Arm計畫將這套伺服器設計、支援的韌體、系統架構規格、除錯框架及診斷工具,全數貢獻給OCP開放運算社群,以推動開放標準的普及與創新。

目前,Arm AGI CPU已獲得包含Meta、OpenAI、Cerebras、Cloudflare等業界巨頭的採用承諾,而合作夥伴華擎、聯想與Supermicro也已開始接受商業系統的訂單。這顯示了業界對於Arm在AI基礎設施領域的願景與實力抱持高度期待,並且正逐步將其納入未來資料中心的規劃之中。

產業展望:Arm Neoverse引領AI基礎設施新紀元

從技術解析不難看出,Arm AGI CPU是一頭徹頭徹尾的「效能怪物」,其策略直接瞄準傳統x86架構資料中心機架的弱項。Arm並未選擇在單顆CPU的絕對算力上與x86競爭,而是巧妙地利用Arm架構的「高能效比」與「高核心密度」優勢,直接將戰場拉高到「機架級別」。當雲端服務商評估資料中心建置時,他們更看重的是在有限的功耗與空間限制下,能塞進多少總算力。在這一點上,單機櫃能提供8000組CPU核心,甚至多達4.5萬個不降頻的Arm架構CPU核心,對比受限於發熱與功耗的x86架構系統,具備顯著的競爭優勢。

更深層的意義在於,Arm正透過直接提供量產晶片與OCP開放運算硬體設計,為那些無力自行開發CPU、卻又急需高效能協調器的AI新創與雲端業者(如OpenAI、Cerebras)鋪設一條名為「Neoverse」的高速公路。這不僅標誌著Arm商業模式的重大轉型,更預示著x86陣營接下來在AI伺服器市場將面臨最嚴峻的挑戰,形塑未來AI運算基礎設施的新格局。