智譜 AI 於 8 月 14 日正式發布了 GLM-5.3 模型。根據智譜的介紹,該基座模型與 GLM-5.2 相同,但經過更大規模、更長週期以及在多樣化長程任務環境中的強化訓練後,顯著提升了編程與 Agent 能力,並展現出突出的網絡安全攻防實力。
在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench 3.0 測試中,GLM-5.3 的得分從 4.6 提升至 28.3;在專注於長程軟件工程與持續代碼修改能力的 DeepSWE v1.1 中,得分從 46.2 提升至 66.9;而在涵蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents’ Last Exam 中,得分從 23.8 提升至 28.5。
GLM-5.3 模型在多項測試中表現卓越
此外,在涵蓋 44 種職業、考察真實高價值知識工作的 GDPval-AA v2 中,GLM-5.3 的得分達到 1769,顯示出基於編程能力所湧現的專業任務執行能力。智譜 AI 宣佈,GLM-5.3 即日起上線 ZCode、AutoClaw 及 GLM Coding Plan,且 GLM Coding Plan 額度已重置,API 將於不久後推出,完整模型權重也將在完成必要的安全評估與加固後,於未來兩周內向公眾開放。

