跳到正文
AI寒武纪 · 微信公众号·· 2026-06-22AI 评分53

DeepSWE新编程基准GLM-5.2通过率44%,问鼎开源第一,大幅领先Opus-4.6max

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

DeepSWE 编程基准更新到 v1.1,共 113 个任务,来自 91 个活跃开源仓库,GLM-5.2 位列开源第一,kimi-2.7-code 开源第二,两者均高于 Opus-4.6 max。

来源:AI寒武纪 · 微信公众号 · mp.weixin.qq.com