Claude Opus 5会计测试超越人类CPA
先了解这件事
2026年10月2日,Rohan Paul在X平台引用研究称,Claude Opus 5在会计基准测试中全面胜过持证会计师。研究显示,前沿模型在中长度、定义清晰的会计任务上速度快于且准确率高于初级会计师:Claude Opus 5在任务上20/20全对,数分钟完成;而12名持证CPA得分在0%到约90%之间,多人未能在3小时内完成。成本方面,每达成一条评分标准,Claude成本为$0.21,而无AI会计师为$10.35。Paul评论称规则型工作不再是职业而是一条提示词,人类在规则型职业中成了慢、贵、易错的一方。同日稍晚,The Decoder报道Mercor研究细节:12名平均5年半经验的持证CPA完成简化的APEX Accounting Benchmark任务,AI模型几乎无错完成,而18个月前最佳模型还低于会计师约37%的平均水平。目前该事件仅停留在社交媒体引用研究阶段,尚无官方或第三方独立验证。
AI 根据报道生成 · 41 分钟前更新
报道时间线
沿着报道,了解事件的不同侧面。
- The DecoderMercor 研究:AI 在结构化会计任务上速度与准确率超过持证会计师,但仍无法独立结账
Mercor 研究让 12 名平均 5 年半经验的持证 CPA 完成简化的 APEX Accounting Benchmark 任务,发现当今 AI 模型几乎无错完成,而 18 个月前最佳模型还低于会计师约 37% 的平均水平。
- X:Rohan PaulRohan Paul 引用研究称规则型工作正变成一条提示词,Claude Opus 5 会计任务全面胜过 CPA
Rohan Paul 评论称规则型工作不再是职业而是一条提示词,人类在规则型职业中成了慢、贵、易错的一方。其引用的研究显示前沿模型在中长度、定义清晰的会计任务上已快于且更准于初级会计师,Claude Opus 5 在任务上 20/20 全对且数分钟完成,而 12 名持证 CPA 得分在 0% 到约 90% 之间,多人未能在 3 小时内完成;图中还显示每达成一条评分标准 Claude 成本 $0.21,无 AI 会计师为 $10.35。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。