打開 App

udn
  • 淺色
  • 登入/註冊
bell icon

智譜新旗艦模型 程式設計變強

AI示意圖。路透
AI示意圖。路透

本文共590字

經濟日報 記者林宸誼/綜合報導

大陸AI企業智譜昨(14)日發表新一代旗艦模型GLM-5.3,稱透過擴大後訓練規模實現程式設計能力躍升50%,在多項基準測試中取得開源模型第一,程式設計與智能體(Agent)能力接近 Claude Fable 5。

澎湃新聞報導,智譜也表示,相比前代,GLM-5.3的新能力包括:更強的程式設計能力、網路安全能力、後訓練Scaling及開源。

中美進入大模型上新週期,DeepSeek V4 Pro在13日淩晨正式推出,並已更新至API,模型版本為DeepSeek-V4-Pro-0813,新版本增強了Agent能力。

根據DeepSeek給出的模式測試對比成績,與此前V4-Pro-Preview版本相比,V4-Pro-0813已經全面提升,例如在AI程式設計智能體(Agent)基準測試DeepSWE中,得分從Preview的7.3,大幅提升至62.7,甚至超越了Claude Opus 4.8。

在AI安全智慧體基準測試Cybergym、智能體(Agent)基準測試AutomationBench中甚至超越目前公認最強大的Claude Fable 5。

隨後,DeepSeek首款智能體(Agent)也開放測試,13日晚間,DeepSeek宣布,DeepSeek Harness的開發者預覽版(v0.1 版本)面向全球 Harness開發者開放測試,並同步以MIT協議開放原始程式碼。

※ 歡迎用「轉貼」或「分享」的方式轉傳文章連結;未經授權,請勿複製轉貼文章內容

猜你喜歡

上一篇
寒武紀進擊 招聘軟體人才 打造 AI 晶片護城河
下一篇
APEC領導人峰會11/17至18日深圳舉行

相關

熱門

看更多

看更多

留言

前往頁面