跳到正文
@karminski3· @karminski3 · X·· 24 天前AI 评分37
AI 导读

有开发者吐槽模型厂商拿max档位刷分,却反过来称max不适合普适场景,还让用户改用high档。作者自测也发现high比max强,此前测小模型量化版时甚至有的medium表现更好,认为这是后训练不足却被包装成最佳实践。

正文

不是, 😭 说的不是 high 比 max 强这个事情, 我自己测也是 high 比 max 强. 而且我上一期给大家测小模型量化版甚至有的 medium 表现更好.

但模型厂商本身拿max刷分然后又反手说max并不适合普适场景, 然后D小将逢人就教育说要开high. 要用linux bash, 要打补丁, 要看到思维链出现xxx才能用. 这种明明是后训练拉了却要包装成最佳实践让人无语.

思考强度高性能就好是模型厂商自己宣传的, 然后max表现不利就跟大家说降一档用也是模型厂商宣传的. 合着怎么都优势在我.

我寻思星巴克也不敢中杯比大杯咖啡多250ml吧? 那罗老师就不是打自己嘴巴子那么简单了.....

来源:@karminski3 · x.com