智譜 AI 發佈 GLM-5.3 模型 顯著提升編程與 Agent 能力

智譜 AI 於 8 月 14 日正式發布了 GLM-5.3 模型。根據智譜的介紹,該基座模型與 GLM-5.2 相同,但經過更大規模、更長週期以及在多樣化長程任務環境中的強化訓練後,顯著提升了編程與 Agent 能力,並展現出突出的網絡安全攻防實力。

在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench 3.0 測試中,GLM-5.3 的得分從 4.6 提升至 28.3;在專注於長程軟件工程與持續代碼修改能力的 DeepSWE v1.1 中,得分從 46.2 提升至 66.9;而在涵蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents’ Last Exam 中,得分從 23.8 提升至 28.5。

GLM-5.3 模型在多項測試中表現卓越

此外,在涵蓋 44 種職業、考察真實高價值知識工作的 GDPval-AA v2 中,GLM-5.3 的得分達到 1769,顯示出基於編程能力所湧現的專業任務執行能力。智譜 AI 宣佈,GLM-5.3 即日起上線 ZCode、AutoClaw 及 GLM Coding Plan,且 GLM Coding Plan 額度已重置,API 將於不久後推出,完整模型權重也將在完成必要的安全評估與加固後,於未來兩周內向公眾開放。

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版