跳到正文
@karminski3· @karminski3 · X·· 24 天前AI 评分35
AI 导读

作者推荐三篇论文,分别讨论为何把推理强度设为 max 测 SWE 会出现倒挂、设为 max 是否真的更好,以及如何让模型在思考时正确停下来。其核心观点是:SOTA 模型永远是完美的信息压缩器,用最少 token 解决最难问题,思考一大堆得出"42"不算 SOTA,E = mc² 才是。

正文

来, 走出民科, 咱们阅读论文.
为什么max测SWE会倒挂:https://t.co/9cV5oLJLLH
设置为max真的就对吗:https://t.co/7QgZzJws0W
到底怎样才能让模型思考的时候正确的停下来: https://t.co/m1M1t03vJi
我重申我的观点, SOTA的模型永远是完美的信息压缩器. 用最少的token解决最难的问题. 思考一大堆得出宇宙的最终解是42不是SOTA. E = mc² 才是.

来源:@karminski3 · x.com