芝能智芯出品戴爾在 2025 臺北國際電腦展期間發(fā)布了全球首款搭載企業(yè)級獨(dú)立 NPU 的移動工作站——Pro Max Plus,打破了傳統(tǒng)筆記本以 GPU 為核心的 AI 運(yùn)算架構(gòu),還首次將高通 Cloud AI 100 加速卡引入移動終端,在本地大模型推理能力、功耗控制、內(nèi)存容量等多個關(guān)鍵維度上實(shí)現(xiàn)飛躍。
本地的NPU能做些什么?AI PC最終能發(fā)展成什么樣?我們一直在關(guān)注。

架構(gòu)壁壘:從 GPU 到 NPU
過去十年,移動工作站在追求 AI 性能時始終繞不開 GPU,尤其是 NVIDIA 的專業(yè)顯卡,幾乎成了 AI 開發(fā)者的“標(biāo)配”。然而,隨著大語言模型(LLM)參數(shù)量級的暴漲,傳統(tǒng) GPU 的內(nèi)存瓶頸與能效比問題日益突出。
戴爾 Pro Max Plus 的橫空出世,搭載兩顆高通 Cloud AI 100 推理加速卡,共計 32 個 AI 核心,并配備高達(dá) 64GB LPDDR4x 專用內(nèi)存,遠(yuǎn)超同級別 NVIDIA RTX PRO Blackwell 系列 GPU 所能提供的本地內(nèi)存容量(通常為 24GB)。
更關(guān)鍵的是,戴爾宣稱這套系統(tǒng)可以在完全離線的狀態(tài)下,運(yùn)行參數(shù)規(guī)模高達(dá) 1090 億的 Llama 4 Scout 模型,覆蓋了從 AI 聊天機(jī)器人、智能體 Agent,到大規(guī)模多輪對話系統(tǒng)的完整推理需求。

從硬件架構(gòu)看,Qualcomm AI 100 并非單純的神經(jīng)網(wǎng)絡(luò)處理器(NPU)延伸,它承襲了云端 AI 加速器的設(shè)計理念,將高帶寬 SRAM(288MB)與片上 AI 核心緊密集成,極大減少了推理延遲。
同時,板載 LPDDR4x 內(nèi)存帶寬高達(dá) 274GB/s,與系統(tǒng)總線協(xié)同設(shè)計,使其在高頻數(shù)據(jù)吞吐場景下依舊保持穩(wěn)定。

這套方案的意義不僅在于單機(jī)性能突破,顛覆了開發(fā)者對“GPU 必不可少”的慣性認(rèn)知。
以往,訓(xùn)練與部署模型往往是在數(shù)據(jù)中心和本地 GPU 之間反復(fù)遷移。而戴爾這次帶來的,企業(yè)級 AI 工作負(fù)載,可以被壓縮、優(yōu)化、并直接部署于筆記本上獨(dú)立運(yùn)行,從而實(shí)現(xiàn)邊緣側(cè) AI 的真正落地。
重塑開發(fā)流程:
本地大模型推理
與 AI Studio 的結(jié)合
從應(yīng)用視角來看,戴爾 Pro Max Plus 更像是一個“便攜式 AI 數(shù)據(jù)中心”,瞄準(zhǔn)了 AI 模型開發(fā)者、企業(yè)智能體工程師、游戲引擎生成算法團(tuán)隊等專業(yè)用戶。借助 Pro AI Studio,這款移動工作站承擔(dān)算力角色,更是一個完整的 AI 開發(fā)環(huán)境。
Pro AI Studio 是戴爾此次同步推出的軟件平臺,提供模型管理、推理調(diào)度、一鍵部署等功能,支持用戶快速調(diào)用包括 Llama 系列、Gemma、Phi、Claude 等主流開源和私有大模型。
在展臺現(xiàn)場,官方演示了基于該平臺的游戲世界構(gòu)建工具,只需幾句 prompt,AI 即可根據(jù)語言描述完成實(shí)時內(nèi)容生成,場景復(fù)雜度和交互邏輯明顯優(yōu)于傳統(tǒng) AIGC 工具鏈。
本地部署不再需要頻繁上傳用戶數(shù)據(jù)至云端。對于金融、醫(yī)療、政企客戶而言,這種“數(shù)據(jù)不出本地”的運(yùn)行方式,極大降低了數(shù)據(jù)泄露與監(jiān)管合規(guī)的風(fēng)險。
戴爾還指出,隨著模型量化與剪枝技術(shù)的成熟,未來即便是千億級模型,也能在更緊湊的移動設(shè)備中實(shí)現(xiàn)無縫運(yùn)行,從而拓展至更多嵌入式和邊緣場景。
當(dāng)前版本舍棄了 NVIDIA GPU 所擅長的圖形渲染與多媒體管線,例如實(shí)時光線追蹤、視頻轉(zhuǎn)碼等仍需依賴專門硬件或云端協(xié)同。
但對于專注 AI 推理和模型原型設(shè)計的用戶而言,這種取舍是合理的——他們所需要的是高吞吐、低功耗、可擴(kuò)展的本地 AI 執(zhí)行平臺,而非通用圖形處理器。
戴爾此次的設(shè)計依舊處于“原型驗(yàn)證”階段,Pro Max Plus 的大規(guī)模量產(chǎn)尚未公布確切時間。高通 AI 100 的模塊尺寸和功耗表現(xiàn)也還在優(yōu)化中。
盡管如此,這款設(shè)備所傳遞的理念已然清晰:AI 開發(fā)未來并非只能依賴數(shù)據(jù)中心,強(qiáng)大的本地 AI 引擎同樣可以嵌入進(jìn)輕薄便攜的終端中,催生“隨時可部署、隨地可推理”的智能生產(chǎn)力形態(tài)。
小結(jié)
AI 工作站開始存在介于傳統(tǒng) GPU 工作站與輕量級內(nèi)置 NPU 筆記本之間,以企業(yè)級獨(dú)立 NPU 為核心,實(shí)現(xiàn)本地大模型推理的能力,對于那些更關(guān)注推理端性能、移動性和隱私合規(guī)的企業(yè)客戶而言,Pro Max Plus 所開辟的路線,無疑提供了一個更具可控性與成本優(yōu)勢的選項。