480GB記憶體碾壓業界!Intel Crescent Island現身,AI推論卡新王者誕生?

當Hot Chips 2026大會的聚光燈打在Intel攤位的那一刻,一個數字震驚了所有人:480GB。不是硬碟容量,不是系統記憶體,而是一張PCIe運算卡上搭載的LPDDR5X記憶體。對比前代Arc Pro B60的24GB,整整20倍的差距。

當Hot Chips 2026大會的聚光燈打在Intel攤位的那一刻,一個數字震驚了所有人:480GB。不是硬碟容量,不是系統記憶體,而是一張PCIe運算卡上搭載的LPDDR5X記憶體。對比前代Arc Pro B60的24GB,整整20倍的差距。這不是規格表上的數字遊戲,這是Intel對代理式AI(Agentic AI)時代最直接的回應——記憶體,才是決定AI推論能不能真正落地的生死門。

在資料中心裡,GPU的運算速度從來都不是瓶頸。真正的麻煩是記憶體裝不下模型,或者裝得下但前後文窗口(Context Window)一拉長,Token吞吐量就直接腰斬。這些問題,每一個做過大規模AI部署的工程師都懂。Intel這次端出的Crescent Island,就是把解決方案直接塞進一張350瓦、氣冷散熱的PCIe擴充卡裡,擺明不想讓你多花一毛錢改機櫃。

表象:一張規格碾壓眾生的推論卡

先看帳面數字。Crescent Island採用強化版Xe3P架構,以Panther Lake處理器內顯的Xe3為基底,但把矩陣運算的Systolic層數從4層拉到16層,額外支援FP4、FP8到Full Rate FP64等多種精度。8組Xe核心構成一個運算切片(Compute Slice),目前公布規格配了4組切片,總共32個Xe核心、256組矩陣引擎,配上32MB的L2快取。說白話一點:它不僅跑得快,而且什麼精度都能吃,從輕量級FP4推論到需要雙精度運算的科學計算,一張卡通包

記憶體才是真正的亮點。480GB LPDDR5X,不是焊死在板子上的GDDR6,是低功耗、高頻寬的LPDDR5X。Intel沒有公布頻寬數字,但業界普遍猜測應該落在每秒數百GB的等級。這代表什麼?代表你可以把Llama 3等級的模型完整塞進一張卡,不需要跨卡通訊,不需要頻繁搬動權重,延遲直接砍到見骨。

「代理式AI工作負載對於延遲的要求更為嚴苛,同時更大的前後文窗口也代表記憶體容量需求更大。」——Intel在Hot Chips 2026的現場簡報中如此強調。這句話背後的意思是:如果你的加速器記憶體不夠大,就別想在代理式AI這塊市場上桌。

真相:Xe3P不是小改款,是架構思維的徹底翻轉

很多人看到「Xe3P」會直覺認為這是Xe3的強化版,就像手機晶片的「Plus」版本。但仔細拆解架構圖,你會發現事情沒那麼單純。

在Xe3架構中,繪圖切片(Render Slice)裡只有4組Xe核心,但有4組光線追蹤單元。這是為遊戲而生設計。但Crescent Island的運算切片裡,Xe核心直接翻倍到8組,光線追蹤單元一組都沒留。這種取捨非常極端——Intel清楚告訴你:這不是一張能玩遊戲的卡,這是一張純粹為AI推論而生的運算怪獸。

軟體層的布局更值得玩味。Crescent Island仍基於Xe架構基礎,軟體堆疊與前代Arc Pro系列完全相容。這意味著開發者不用重新學一套工具鏈,既有程式碼「上市首日」就能無縫部署。Intel特別強調了「開箱即用(Out-of-the-Box)」的模型支援,擺明是在針對市場上某些「硬體很強但軟體難搞」的競爭對手。

「我們提供開放且可程式化的AI軟體堆疊,並支援異質運算平台,簡化部署流程並實現大規模AI部署。」Intel在會後的新聞資料中如此寫道。這句話翻譯成業界語言就是:我們不鎖生態系,你原本怎麼寫程式,現在就怎麼跑。

各方角力:PCIe型式是優雅解,還是妥協?

Crescent Island的外型選擇了最樸素的PCIe擴充卡,350瓦TDP配上氣冷散熱。這個設計決策,值得停下來好好想想。

對比NVIDIA的SXM模組或AMD的OCP加速器模組,PCIe卡在頻寬和散熱效率上都不是最極致的選擇。但它有一個無可取代的優勢:你可以直接插進現有的工作站或伺服器,不需要訂製背板,不需要更換電源供應器,甚至不需要額外拉水冷管。對於那些預算有限、機櫃空間吃緊的中型AI服務商來說,這簡直是救命稻草。

不過話說回來,PCIe的匯流排頻寬終究是共用通道。如果真的跑大規模多卡平行運算,PCIe的頻寬瓶頸可能會把480GB記憶體的優勢吃掉一部分。Intel當然也知道這件事,所以他們在簡報中特別強調了「異質運算平台」的支援能力——意思就是:你可以混搭不同類型的加速器,Crescent Island負責推論,其他卡負責訓練,分工合作。

這條路線聰明在哪?聰明在它不跟你硬拚極限效能,而是跟你拚總持有成本(TCO)和部署彈性。對資料中心營運商來說,每瓦效能、每元效能,有時候比絕對的FLOPS數字更重要。

從產業面來看,Intel這次的產品定位其實非常精準。他們沒有試圖在訓練市場跟NVIDIA正面對決,而是用「超大記憶體+PCIe相容性+氣冷散熱」三個組合拳,直接打入代理式AI推論這個高速成長的利基市場。Crescent Island不是要取代H100或B200,它是要吃掉那些「效能夠用就好,但記憶體不夠就死」的應用場景。如果你問我,這張卡真正的對手不是NVIDIA,而是AMD的Instinct MI系列和那些試圖用CPU跑推論的解決方案。代理式AI的瓶頸在記憶體容量,不在算力——這個判斷,Intel賭對了方向。

深層影響:Token-as-a-Service的硬體基石

Intel在簡報中特別點出「Token-as-a-Service」這個詞。這不是巧合。

過去兩年,AI服務商的獲利模式正在從「賣模型」轉向「賣Token產出量」。無論是API服務、訂閱制AI助理、還是企業內部的RAG系統,最終計價單位都是Token。在這種商業模式下,每瓦電力能產出多少Token,直接決定毛利率

Crescent Island支援FP4和FP8低精度推論,加上超大記憶體讓模型不需要分片載入,這兩個因素疊加起來,單位能耗的Token產出量有機會比前代產品翻好幾倍。Intel在簡報中也展示了「產出Token的電力效率」改善圖表,雖然沒有公布具體數字,但從架構設計來看,這張卡的能效比絕對是賣點之一。

更重要的是480GB記憶體開啟了新的應用可能性。代理式AI需要同時處理多個步驟的推理鏈(Chain of Thought),每個步驟都要保留前後文狀態。記憶體不夠大,就只能壓縮上下文或者頻繁換頁,結果就是延遲暴增、使用者體驗崩潰。Crescent Island把這條路直接拓寬了。

未解之問:樣品下半年才出,市場等得了嗎?

Intel預計2026年下半年向客戶提供Crescent Island樣品。這意味著大量出貨至少要等到2027年。

問題來了:到那時候,NVIDIA的Blackwell Ultra可能已經鋪貨完畢,AMD的MI400系列也應該端上桌了。Crescent Island的480GB記憶體屆時還算不算「超大容量」,恐怕要打個問號。半導體產業的殘酷就在這裡——你的規劃再漂亮,上市時間只要晚一年,優勢就可能被對手追平甚至超車。

不過換個角度想,資料中心的採購週期本來就很長。從驗證、測試、小規模部署到大規模導入,動輒一年半載。如果Intel能夠在2026下半年順利送樣,並且軟體堆疊真的做到「開箱即用」,那2027年正好趕上企業AI落地的第二波大爆發。時機,可能剛剛好。

但有一件事是確定的:Crescent Island的出現,證明了Intel在AI加速器這條路上不再是陪跑員。從Arc A系列、B系列到現在Crescent Island,每一代都在補齊短板,而這一次,他們在記憶體容量這個維度上,確實搶到了領先位置。能不能把這個領先轉化為市佔率,取決於接下來一年的樣品驗證和軟體生態的成熟速度。

AI推論市場的戰局,從來沒有像現在這麼有趣過。

如果你正在評估下一代的AI推論硬體採購,現在該做的不是等到Crescent Island上市,而是先盤點你的模型記憶體需求、前後文窗口長度、以及Token服務的延遲規格。把數字算清楚,等樣品出來的第一時間,你才知道要測什麼、怎麼比。別讓硬體規格表上的數字,騙了你的採購預算。

本文改寫整理自公開新聞來源,原始報導由T客邦發布。

常見問題 FAQ

Crescent Island的480GB記憶體對AI推論有什麼具體幫助?

直接讓大型語言模型完整載入單張加速器,無需跨卡分片,大幅降低推論延遲並支援更長的前後文窗口,對代理式AI應用特別關鍵。

Crescent Island跟NVIDIA的資料中心GPU相比,優勢在哪裡?

優勢在於PCIe擴充卡的部署彈性、氣冷散熱的低維運成本,以及對FP4到FP64多種精度的完整支援,更適合Token-as-a-Service服務商和邊緣運算場景。

Crescent Island什麼時候可以買到?

Intel預計2026年下半年向客戶提供樣品,大量出貨時間推估在2027年,實際上市時程仍取決於客戶驗證進度。

※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。