智譜 AI 發佈 GLM-5.3 模型 顯著提升編程與 Agent 能力

智譜 AI 於 8 月 14 日正式發布了 GLM-5.3 模型。根據智譜的介紹,該基座模型與 GLM-5.2 相同,但經過更大規模、更長週期以及在多樣化長程任務環境中的強化訓練後,顯著提升了編程與 Agent 能力,並展現出突出的網絡安全攻防實力。

在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench 3.0 測試中,GLM-5.3 的得分從 4.6 提升至 28.3;在專注於長程軟件工程與持續代碼修改能力的 DeepSWE v1.1 中,得分從 46.2 提升至 66.9;而在涵蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents’ Last Exam 中,得分從 23.8 提升至 28.5。

GLM-5.3 模型在多項測試中表現卓越

此外,在涵蓋 44 種職業、考察真實高價值知識工作的 GDPval-AA v2 中,GLM-5.3 的得分達到 1769,顯示出基於編程能力所湧現的專業任務執行能力。智譜 AI 宣佈,GLM-5.3 即日起上線 ZCode、AutoClaw 及 GLM Coding Plan,且 GLM Coding Plan 額度已重置,API 將於不久後推出,完整模型權重也將在完成必要的安全評估與加固後,於未來兩周內向公眾開放。

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
Henderson
Henderson

Henderson 是 TechRitual Hong Kong 科技編輯,專注報導智能手機、消費電子產品、SIM 卡及流動通訊市場。自加入 TechRitual 以來,累計撰寫數千篇科技報導及產品評測,內容同步發佈至 SINA 及 Yahoo Tech 等主要平台。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)