這兩天的大模型圈,簡直是神仙打架。
xAI 發佈 Grok 4.6,智能指數直接追平 GPT-5.6 Sol,價格還一分沒漲;DeepSeek-V4-Pro 正式版上線,在 Terminal Bench 得分 87.9,比 Claude Fable 5 僅低 0.1 分。
昨天,智譜 GLM-5.3 壓軸登場了,先看測評數據,9 個權威榜單 GLM-5.3 的表現都很亮眼,編程體驗較 GLM-5.2 提升了 50%,複雜軟件工程、長程任務和 Agent 能力進一步提升,直接殺進了由 Fable 5 和 GPT-5.6 Sol 統治的第一梯隊。
那個熟悉的開源一哥、國模一哥,重回巔峯了。

重點是,GLM-5.3 基座還是那台 743B 的 GLM-5.2,沒改架構、沒重新預訓練,全部提升全靠後訓練硬堆出來的。
性能更強、消耗卻更低了
Z.ai Code Bench 測評顯示,Max 滿血檔的 GLM-5.3 拿到 34.5%,平均只燒了約 75K 輸出 Token;GLM-5.2 要燒 96K 纔拿 23.4%,Claude Opus 4.8 燒 120K 拿 29.5%。

不過跑分歸跑分,實際體驗如何,咱們還是得自己上手感受一下。
01. GLM-5.3 實測
目前,GLM-5.3 已上線智譜官方編程工具 ZCode、效率工具 AutoClaw,上線 GLM Coding Plan 全量用戶及開放訂閱。
API 很快也會上線,完整模型權重將在兩週內開源,
我們打開 ZCode,模型選擇 GLM-5.3,模式切換爲完全訪問。

一句話捏出一架大疆 Mavic 3 Pro
我們輸入一句簡單的提示詞感受一下:
使用 Three.js 創建大疆 Mavic 3 Pro 無人機的 3D 模型。
不到 2 分鐘,GLM-5.3 就輸出了結果,效率相當高:
細節把控也不錯,GLM-5.3 用 LatheGeometry 車出流線型機身,連雲台減震板、前置避障攝像頭都清晰可見,連哈蘇鏡頭標誌性的金圈都做出來了。
我們可以手動調節螺旋槳轉速,調節畫面大小、旋轉視角,功能全面且流暢,這個完成度沒話說。
復刻綠金迪手錶
我上傳了一張勞力士綠金迪的參考圖,讓 GLM-5.3 進行 3D 還原。

我們輸入提示詞之後,GLM-5.3 只用了十幾分鍾就做出來了。

我們一起看看生成的效果:
功能邏輯沒啥問題,但是手錶的屏幕有點出戲,像懸浮在空中的隱形眼鏡。錶帶銜接也有點小問題。
我們讓 ZCode 繼續優化一下,ZCode 很快就定位並修復了問題。

打開頁面,錶針指向和我係統時間一致,可以手動調整指針,還支持變換視角、拆解視圖。
3D 微縮城市天氣
我嘗試讓 GLM-5.3 生成上海的微縮城市天氣系統:
天氣渲染效果非常準確,閃電、陽光、能見度隨天氣實時切換。
而且真的可以查詢每小時的天氣情況:
不過城市建模方面,還沒有上海的標誌特色,我們上傳一張上海的實拍圖優化時,GLM-5.3 能迅速在原有建模中精準補全地標建築。

02. 網絡安全能力
如果說編程是 GLM-5.3 的基本功,那網絡安全能力就是 GLM-5.3 捅破天花板的獨門祕籍。
智譜這次把海量的漏洞發現數據喂進了模型,結果產生了驚人的能力湧現:
- CyberGym 評分 84.5,登頂開源 SOTA;
- ExploitBench 54.4,比前代翻了一倍多。
在實戰中,GLM-5.3 配合國內安全團隊掃描真實代碼庫,累計挖出了 2436 個漏洞,橫跨 269 個開源項目。
最玄幻的是,其中一個高危漏洞寫於 1981 年,藏了 45 年沒人發現,被 AI 給揪出來了。
這意味着,GLM-5.3 已經具備了超越普通安全專家、進行深層代碼審計的神覺。
03. 一些分享
GLM 就像一個帶着成熟方案進場、甚至能反向審計安全漏洞的全棧合夥人。
從靈感到成品的過程,正在被快速縮減,生產力門檻被抹平。
有想法的個人創作者,一個人就能擁有團隊的開發效率。
大模型的戰場已經從卷參數轉向了卷交付。智譜通過極致的後訓練證明,即使不堆架構、不改基座,靠工程化對齊也能實現智能的暴力拉昇。
GLM-5.3 把做產品的起跑線,直接劃在了工業級的水準之上。
閉源模型雖然在高牆內保持着先發優勢,但以 GLM 爲代表的開源勢力正在以更快的節奏填平代差,讓最前沿的技術從少數巨頭的私人圍城,變成了全行業共享的生產力基座。
國產開源模型能夠正面硬剛硅谷頂流,讓每一個人都能站在巨人的肩膀上,去定義屬於自己的產品起跑線。
原文鏈接:開源世界第一的 GLM 又回來了,一出手就翻出了 45 年前的 Bug!