跳到正文
热点事件持续更新

webAI开源3.6B小模型TwIL-LM3-Pro引关注

3 篇报道2 个报道来源6 小时前更新

先了解这件事

AI 综述

2026年10月2日,webAI开源小模型TwIL-LM3-Pro。早先报道(Elvis Saravia)称其参数为3.6B,BIG-Bench Hard得分95.4,远超Qwen3-8B的63.7,训练配方为形式逻辑微调后合并权重,再用程序化验证器做强化学习。后续报道(Kim)称参数为3.66B,在形式逻辑综合基准上与Qwen3-8B大致持平,参数量不到后者一半,并在六项形式任务上领先VibeThinker-3B检查点;模型基于IBM Granite 4.2后训练,Q4 GGUF权重仅2.09 GiB,可通过llama.cpp本地推理。两篇报道在参数数值(3.6B vs 3.66B)及对比基准(BIG-Bench Hard vs 形式逻辑综合基准)上存在差异,目前尚无其他独立来源验证。

AI 根据报道生成 · 5 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. X:Kim
    webAI 发布 3.66B 本地逻辑推理模型 TwIL-LM3-Pro

    webAI 发布 3.66B 参数形式逻辑模型 TwIL-LM3-Pro,可在笔记本本地运行。其综合逻辑评测与 Qwen3-8B 持平,参数量不足后者一半,并在全部六项形式逻辑任务上领先 VibeThinker-3B。该模型基于 IBM Granite 4.2 后训练,Q4 GGUF 权重仅 2.09 GiB,可通过 llama.cpp 本地推理。

  2. X:Kim
    webAI 发布 3.66B 形式逻辑模型 TwIL-LM3-Pro

    webAI 发布 3.66B 参数形式逻辑模型 TwIL-LM3-Pro,可在笔记本本地运行。其测试中,该模型在形式逻辑综合基准上与 Qwen3-8B 大致持平,参数量不到后者一半,并在全部六项形式任务上领先公开的 VibeThinker-3B 检查点。模型基于 IBM Granite 4.2 后训练,Q4 GGUF 权重仅 2.09 GiB,可通过 llama.cpp 本地推理。

  3. X:Elvis Saravia
    webAI 开源 3.6B 小模型 TwIL-LM3-Pro

    webAI 开源 3.6B 参数模型 TwIL-LM3-Pro,可在普通电脑本地运行,BIG-Bench Hard 得分 95.4,远超 Qwen3-8B 的 63.7。其训练配方为:形式逻辑微调后将权重合并回基座模型,再用程序化验证器做 RL,逻辑分数提升且通用推理保持稳定。

本事件热度走势

当前热度 15·可比范围峰值 17(10月2日 15:00)·近 24 小时可比范围变化 –

0510152010月2日12:0010月2日15:0010月2日17:0010月2日20:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。