智譜 AI 發佈 GLM-5.3 模型 顯著提升編程與 Agent 能力

·作者 Henderson
智譜 AI 發佈 GLM-5.3 模型 顯著提升編程與 Agent 能力
重點
  • 智譜 AI 發布 GLM-5.3 模型,提升編程與 Agent 能力。
  • GLM-5.3 在 Terminal-Bench 3.0 測試中得分顯著上升。
  • 模型在多種專業場景中展現出強大的任務執行能力。
  • GLM-5.3 將上線多個平台,API 也將推出。

智譜 AI 於 8 月 14 日正式發布了 GLM-5.3 模型。根據智譜的介紹,該基座模型與 GLM-5.2 相同,但經過更大規模、更長週期以及在多樣化長程任務環境中的強化訓練後,顯著提升了編程與 Agent 能力,並展現出突出的網絡安全攻防實力。

GLM-5.3 模型性能提升

在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench 3.0 測試中,GLM-5.3 的得分從 4.6 提升至 28.3;在專注於長程軟件工程與持續代碼修改能力的 DeepSWE v1.1 中,得分從 46.2 提升至 66.9;而在涵蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents’ Last Exam 中,得分從 23.8 提升至 28.5。

多樣化應用場景與上線計劃

此外,在涵蓋 44 種職業、考察真實高價值知識工作的 GDPval-AA v2 中,GLM-5.3 的得分達到 1769,顯示出基於編程能力所湧現的專業任務執行能力。智譜 AI 宣佈,GLM-5.3 即日起上線 ZCode、AutoClaw 及 GLM Coding Plan,且 GLM Coding Plan 額度已重置,API 將於不久後推出,完整模型權重也將在完成必要的安全評估與加固後,於未來兩周內向公眾開放。

GLM-5.3 對編程能力的影響

智譜 AI 的 GLM-5.3 模型在編程與任務執行能力上有顯著提升,這不僅反映了其在技術上的進步,也顯示出對於專業領域的適應性。隨著模型的上線,開發者將能夠利用這些新功能來提升工作效率,特別是在長程任務和跨工具協作方面。這樣的進步可能會促進更多企業採用智能化解決方案,進一步推動行業的數字化轉型。

H
關於作者
Henderson