
"在一些前沿模型突然變得不可用的時刻,我們選擇相信另一條路:前沿智能不應只屬于少數人,也不應被少數規則隨時收回。它應該開放、可用、可構建,并服務于每一位開發者。"——智譜。
今日,智譜AI正式宣布上線并全面開源其新一代旗艦大模型GLM-5.2。這款專門為長程任務打磨的模型,在全球百萬開發者參與的Code Arena前端開發盲測中,一舉拿下了全球可用模型的第一名。


而就在五天前,美國商務部突然下達禁令,要求Anthropic立即暫停向所有外國用戶開放其最頂尖的Claude Fable 5和Mythos 5模型,無論這些用戶身處美國境內還是境外。這一"一刀切"式的管制,讓全球無數開發者陷入了無頂尖模型可用的尷尬境地。
正是在這樣的背景下,智譜那句"前沿智能不應只屬于少數人,也不應被少數規則隨時收回"的宣言,顯得格外擲地有聲。
這次發布的GLM-5.2,最大的亮點莫過于它真正做到了穩定可用的1M-token上下文(行業平均值約為70萬漢字)。很多人可能不知道,行業里不少號稱支持百萬級上下文的模型,其實都是虛標,一旦用到幾百K以上,就會開始嚴重"失憶",準確率直線下降。
為了解決這個問題,智譜團隊花了整整幾個月的時間,專門擴展了1M上下文下的Coding Agent訓練環境,覆蓋了從自動化研究到性能優化、復雜調試的全鏈路工程場景。
這份投入換來了實打實的成績。在業內公認最有含金量的長程軟件工程基準Frontier SWE上,GLM-5.2只比目前最強的Claude Opus 4.8落后1個百分點,卻反超了GPT-5. 51個百分點,更是把Opus 4.7甩開了11個百分點,穩穩坐上了全球開源大模型的頭把交椅。
在實際使用中,GLM-5.2已經展現出了足以顛覆傳統開發模式的能力。它可以獨立完成從開發、聯調、測試到打包上線的全部流程,一次性交付覆蓋Web、移動端和小程序的多端應用,整個過程累計處理了88萬tokens,幾乎把1M的上下文窗口用滿。放在過去,這樣規模的工程至少需要一個小團隊協作數周才能完成。

相比上一代GLM-5.1,新版本的代碼能力有了質的飛躍。例如在Terminal-Bench 2.1(評測AI Agent完成不同類型的計算機終端任務),GLM-5.2比Opus 4.8低4%,相比GLM-5.1提升了17.5%;在MCP-Atlas(大規模工具調研評測的數據集),GLM-5.2比Opus 4.8低0.8%。智譜還為模型加入了多檔思考力度調節,讓開發者可以根據任務難度,在性能、速度和成本之間找到最合適的平衡點。
更值得一提的是,GLM-5.2的線上推理依托多個國產算力平臺,已在Day 0完成與華為昇騰、平頭哥、摩爾線程、寒武紀、昆侖芯、沐曦、海光、壁仞等國產算力平臺的推理適配,在國產芯片集群上實現高吞吐、低延遲、大并發的穩定運行。預計下半年昇騰950超節點上市后,也將成為GLM-5.2強勁的算力底座。這意味著,它從誕生之初就徹底擺脫了對海外芯片的依賴,真正實現了技術自主可控。
按照MIT協議,GLM-5.2的全部權重已經同步上線Hugging Face和Model Scope,任何人都可以自由下載、部署甚至商用。
智譜表示,這只是他們邁向AGI道路上的一步,下一個目標,是打造能夠7×24小時自主協同工作的智能體系統,讓AI從今天的智能助手,真正進化為未來的數字員工。

