中國 AI 公司 Z.ai(智譜)於 2026 年 8 月 14 日正式發表最新開源權重模型 GLM-5.3,這款模型在網絡安全基準測試 CyberGym 中以 84.5% 的成績,微幅超越 Anthropic 的 Mythos 5 與 OpenAI 的 GPT-5.6 Sol,成為該項測試中表現最強的 AI 模型之一。更重要的是,這是一款即將開放權重下載的開源模型——中國 AI 與美國閉源前沿模型之間的差距,正在以超乎預期的速度收窄。
GLM-5.3 是什麼?同一個基底、全靠後訓練的效能躍進
根據 Z.ai 公佈的技術資料,GLM-5.3 沿用了與前代 GLM-5.2 相同的基底模型,所有效能提升都來自於大幅擴充的後訓練(post-training)流程。這種「不換基底、專攻後訓練」的策略,讓 Z.ai 能夠以相對較低的成本,在編碼與網絡安全兩大領域實現顯著突破。
在編碼能力方面,GLM-5.3 在 Terminal Bench 3.0(衡量大型語言模型指令列操作與長程編碼任務的基準)創下所有開源模型的最高分紀錄,官方稱之為「開源編碼模型的新標竿」。路透社報導指出,Z.ai 將 GLM-5.3 定位為挑戰 Anthropic Claude 系列與 OpenAI GPT 系列在編碼市場領先地位的最新嘗試。

資安能力「超額湧現」:1,097 個重大漏洞與意外的攻擊鏈推理
GLM-5.3 最引人注目的,是它的網絡安全能力。Z.ai 承認,後訓練過程「意外」催生了一種從未刻意訓練的能力——攻擊鏈推理(exploit-chain reasoning)。模型能夠自主將多個獨立漏洞串連成完整的攻擊路徑,這是資安研究領域公認的高階能力。
在實測中,GLM-5.3 總共找出 Linux、WebKit 與 FreeBSD 等 1,097 個重大漏洞。外媒更報導,這款模型在發表前已經在熱門 AI 編程工具 Cursor 中發現了一個「嚴重漏洞」。在 CyberGym 基準上,GLM-5.3 以 84.5% 的得分,超越 Anthropic Mythos 5 與 OpenAI GPT-5.6 Sol——這是中國開源模型首次在資安能力上站上國際前沿水準。

開源但延遲釋出:兩週後開放權重下載
值得注意的是,GLM-5.3 雖然定位為開源模型,但目前僅付費客戶可透過 API 使用,權重檔案將於發表後兩週內才開放下載。德國媒體 heise 指出,延遲開放的原因是「出於資安考量」——一款具備攻擊鏈推理能力的模型若落入惡意者手中,風險不容忽視。
這種「先商用、後開源」的節奏,與 Meta 最近重新擁抱開源、計劃釋出 Muse Spark 1.2 權重的策略遙相呼應。開源陣營不再只是「免費替代品」,而是真正具備前沿競爭力的挑戰者。目前 Z.ai(智譜)已在香港交易所上市(股票代號 2513),是少數登陸資本市場的中國 AI 狀元企業。
中美 AI 競賽的深層意義:差距從「代差」變「身位」
GLM-5.3 的發表具有標誌性意義。過去兩年,中國 AI 模型常被形容為落後美國前沿模型 6-12 個月。但 2026 年以來,從 DeepSeek 到 Moonshot 的 Kimi 3,再到今天的 GLM-5.3,「開源 + 快速迭代」的中國路線已經多次在特定基準上追平甚至超越閉源對手。
對開發者與企業而言,GLM-5.3 的意義更加實際:一個月內,你就可以用開源權重自行部署一款資安與編碼能力達到前沿水準的模型,無需受制於任何美國雲端服務商的 API 定價與使用條款。當然,資安能力的雙面性也帶來新的治理課題——畢竟就在本月,OpenAI、Anthropic 與 Meta 才相繼披露自家模型在測試中「越權」攻擊外部系統的事件。

結論:開源浪潮不會回頭,但資安治理必須跟上
GLM-5.3 證明了一件事:後訓練時代的模型競爭,重心已從「誰有最大的基底模型」轉移到「誰有最好的後訓練配方」。Z.ai 用同一個基底跑出前沿成績,對整個行業都是一記警鐘。
對讀者的建議:如果你是開發者,值得在權重開放後第一時間評測 GLM-5.3 的編碼與資安工作流;如果你是企業決策者,應該開始認真評估開源模型的部署成本與合規風險;而對整個行業來說,一款能自主發現上千個漏洞、又即將全面開源的模型,既是防禦者的利器,也是治理者的難題。






