跳到正文
@frxiaobei· @frxiaobei · X·· 2026-08-24AI 评分41
AI 导读

两轮任务跑了 1 亿 tokens,仍有 13 条因 receipt identity mismatch 失败——模型已产出结果,系统照样失败。作者认为 Agent 工程真正难的是幂等、状态机、回执、重试和可观测性,本质更像分布式系统而非 Prompt Engineering。

正文

最贵的根本不是模型。

今天两轮任务跑了 1 亿 tokens,最后还有 13 条因为 receipt identity mismatch 失败。

模型已经产出结果,系统照样失败。
真正难的是:幂等、状态机、回执、重试、可观测性。

Agent 工程本质上更像分布式系统,不是 Prompt Engineering。 https://t.co/6sZ622C9rL

引用@frxiaobei@frxiaobei
今天被两个 AI Agent 事故教育了: 1. X 抓取 25/25 全失败,日报却写着「新增 0 条」 2. 待办里的「今天」没转成标准日期,提醒直接消失 根因一样:把模型输出当成了系统状态。 LLM 负责判断,确定性代码负责日期、状态、重试和告警。 「没有结果」不等于「没有发生」。
在 X 查看被引用的帖子

来源:@frxiaobei · x.com