跳到正文
AI科技评论 · 微信公众号·· 2026-07-10AI 评分61

豆包 2.1 Pro 实测:Agent 自主性极强,代码规矩、干净、可运行

豆包2.1Pro实测:Agent 自主性极强,代码「规矩、干净、可运行」

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

AI科技评论把豆包 2.1 Pro 放进三个真实工程任务实测,它在零人工干预下完成完整交付,三项加权总分为 4、4.55 和 4.1,综合得分 84.4。测试由 Claude Opus 4.7/4.8 担任裁判,从可运行性、正确性、可读性、可维护性和 Agent 自主性五个维度打分,任务 C 完成 91 轮长程执行、41 次工具调用。

来源:AI科技评论 · 微信公众号 · mp.weixin.qq.com