跳到正文
@AYi_AInotes· @AYi_AInotes · X·· 19 天前AI 评分31
AI 导读

一套百路并发对抗测试方案用 TypeSafe 的 Jev 决策模型替代生成模型,三层链路为状态捕获、单选决策裁判、闭环执行与熔断。Playwright 实时提取 DOM 简化树生成紧凑状态快照;Jev 不生成文本,仅接收快照与预设破坏性问题列表,约 100 毫秒内并行输出概率分布与选择项,输入每百万 Token 仅 0.042 美元且输出不计费。

正文

估计很多做工程的朋友这套百路并发对抗测试的具体逻辑, 替大家把核心的三层链路拆清楚了:
第一层是状态捕获。Playwright 挂载到浏览器, 实时提取 DOM 简化树与交互元素, 去除无用样式与冗余节点, 提炼为紧凑的状态快照。
第二层是单选决策裁判。调用的并不是聊天大模型, 而是 TypeSafe 的 Jev。

这一层的核心在于它完全不生成文本, 只接收状态快照与预设的破坏性问题列表, 在约 100 毫秒内并行输出概率分布与选择项。由于输入每百万 Token 仅 0.042 美元且输出不计费, 并发拉满也没有账单压力。
第三层是闭环执行与熔断。无头浏览器根据单选结果触发极端点击、畸形输入或反常跳转, 一旦触发控制台未捕获异常或接口 500 报错, 自动抓取失败现场并保存快照生成复现报告。
用决策模型替代生成模型做测试, 是今年最值得关注的架构微调方向。

来源:@AYi_AInotes · x.com