Claude Code v2.1.156 发布
Claude Code v2.1.156 修复了使用 Opus 4.8 时 thinking blocks 被修改导致 API 报错的问题。该版本为 Claude Code GitHub Releases 上的小版本更新。
项目更新、模型与开源社区动态
Claude Code v2.1.156 修复了使用 Opus 4.8 时 thinking blocks 被修改导致 API 报错的问题。该版本为 Claude Code GitHub Releases 上的小版本更新。
Claude Code 发布 v2.1.154,引入 Opus 4.8 作为默认模型并默认高推理强度,可用 /effort xhigh 处理最难任务。新增动态 workflow,可协调数十到数百个后台 Agent,用 /workflows 查看;Opus 4.8 的 fast mode 降价为标准费率 2 倍换 2.5 倍速度;另有多项修复,包括阻止 rm -rf $HOME、改进数据外泄检测等。
推荐理由:发布说明列出 Opus 4.8 默认高推理、动态 workflow 编排多 Agent 与 fast mode 降价等变化,读者可据此评估升级对现有工作流的影响。
Claude Code 发布 v2.1.153,为 github/git 插件市场源新增 skipLfs 选项,可在克隆和更新时跳过 Git LFS 下载。该版本还修复了自定义 API 网关可能收到用户 Anthropic OAuth 凭证而非网关自身 token 的回归问题,并解决了按 transcript 文件路径恢复会话时内存占用高达数 GB 的问题。
inclusionAI 发布 LLaDA2.0-Uni 的 FP8 量化版本 LLaDA2.0-Uni-FP8,对 MoE 路由专家权重(gate_proj、up_proj、down_proj)做 128×128 块级 FP8(float8_e4m3fn)量化,模型加载显存从 62.9 GB 降至 32.5 GB,减少约 48%,输出质量保持不变。
inclusionAI 发布基于 MoE 的扩散大语言模型 LLaDA2.0-Uni,在单一模型中统一多模态理解与生成,支持文生图、图像理解、图像编辑以及交错生成与推理。
推荐理由:模型把多模态理解与生成统一进扩散 LLM 框架,并公开 8 步解码与加速方案,读者可据此判断部署门槛。
Claude Code v2.1.152 发布,`/code-review --fix` 现在会在审查后把复用、简化和效率建议直接应用到工作区,`/simplify` 也改为调用该命令。
inclusionAI 发布 SingGuard 多模态安全护栏模型家族,提供 Sing-Guard-2b、4b、8b 三个生成式护栏模型及 SingGuard-Bench 基准(部分资源即将发布)。
Claude Code 发布 v2.1.150,本次更新仅包含内部基础设施改进,没有面向用户的功能变化。
Claude Code v2.1.149 发布,`/usage` 现可按 skills、subagents、plugins 和单个 MCP server 成本分类展示用量明细。
Claude Code v2.1.148 修复了部分用户 Bash 工具对每条命令都返回退出码 127 的问题,该问题为 2.1.147 引入的回归。
Claude Code v2.1.147 将 /simplify 更名为 /code-review,可按指定 effort 级别报告正确性 bug,并支持通过 --comment 把发现以行内评论形式发布到 GitHub PR,旧的清理修复行为已移除。
Claude Code v2.1.146 将 `/simplify` 重命名为 `/code-review`,并支持可选 effort level(如 `/code-review high`)。
Claude Code v2.1.145 新增 `claude agents --json`,可将活跃 Claude 会话以 JSON 列出,便于脚本、状态栏和会话选择器调用。
Claude Code v2.1.144 为后台会话新增 /resume 支持,通过 claude --bg 或 agent view 启动的会话会与交互式会话一同显示并标记为 bg。
FireRedTeam 开源了入选 CVPR 2026 的多模态检索方法 ReMatch,通过在训练中加入 chat 式生成匹配目标,让多模态大模型同时从原始输入和投影嵌入判断查询-文档相关性。该方法引入多个可学习表示 token 并融合为单向量嵌入,已发布基于 Qwen2.5-VL-3B 的 ReMatch-3B checkpoint 及评测脚本。
Claude Code v2.1.143 发布,`claude plugin disable` 现在会在其他已启用插件依赖目标插件时拒绝执行,并给出可复制的禁用链提示。
蚂蚁集团提出 ARGenSeg,一种基于自回归图像生成的分割范式,让 MLLM 输出视觉 token 并经通用 VQ-VAE 解码为掩码,实现多模态理解与像素级感知的统一。
Claude Code v2.1.142 发布,fast mode 默认模型从 Opus 4.6 升级为 Opus 4.7,可通过 CLAUDE_CODE_OPUS_4_6_FAST_MODE_OVERRIDE=1 固定回 Opus 4.6。
蚂蚁集团 inclusionAI 开源 ARGenSeg,提出基于自回归图像生成的图像分割范式,让 MLLM 直接输出视觉 token 并经通用 VQ-VAE 解码为掩码,无需专用分割头。
Claude Code v2.1.141 发布,hook JSON 输出新增 `terminalSequence` 字段,使钩子无需控制终端即可发出桌面通知、窗口标题和响铃。
Claude Code v2.1.140 发布,Agent 工具的 subagent_type 匹配现在对大小写和分隔符不敏感,如 "Code Reviewer" 可解析为 code-reviewer。
Claude Code 发布 v2.1.139,新增 Research Preview 的 agent view(运行 `claude agents` 查看所有会话状态)和 `/goal` 命令,可设完成条件让 Claude 跨轮次持续工作。
Claude Code 发布 v2.1.138,本次更新仅包含内部修复,未公布具体功能变更或性能数据。
Claude Code 发布 v2.1.137,修复了 VSCode 扩展在 Windows 上无法激活的问题。
Claude Code v2.1.136 发布,新增 `CLAUDE_CODE_ENABLE_FEEDBACK_SURVEY_FOR_OTEL` 环境变量,供企业通过 OpenTelemetry 重新启用会话质量调查;同时新增 `settings.autoMode.hard_deny` 自动模式分类规则,可无条件拦截操作。
Claude Code v2.1.133 新增 worktree.baseRef 设置(fresh | head),用于选择 --worktree、EnterWorktree 和 agent-isolation worktree 从 origin/ 还是本地 HEAD 分支,默认 fresh 将 EnterWorktree 的基准改回 origin/。
Claude Code v2.1.132 新增 CLAUDE_CODE_SESSION_ID 环境变量,并支持用 CLAUDE_CODE_DISABLE_ALTERNATE_SCREEN=1 退出全屏渲染、保留终端原生滚动。该版本修复了外部 SIGINT 无法优雅关闭、--resume 遇 emoji 截断报错、stdio MCP 服务器写入非协议数据导致内存涨至 10GB+ 等多项问题。
Claude Code v2.1.131 修复了 VS Code 扩展在 Windows 上因打包 SDK 中硬编码构建路径(createRequire polyfill bug)而无法激活的问题,同时修复了 Mantle 端点认证因缺少 x-api-key 头而失败的问题。
Claude Code 发布 v2.1.129,新增 `--plugin-url` 参数可从 URL 拉取插件 `.zip` 包供当前会话使用,并加入 `CLAUDE_CODE_PACKAGE_MANAGER_AUTO_UPDATE` 环境变量,在 Homebrew 或 WinGet 安装下后台执行升级并提示重启。
Claude Code 发布 v2.1.128,`/color` 无参数时随机选择会话颜色,`/mcp` 显示已连接服务器的工具数量并标记零工具服务器,`--plugin-dir` 开始支持 `.zip` 插件包。
inclusionAI 开源发布 Ling-2.6-flash,这是一个总参数 104B、激活参数 7.4B 的指令模型,面向高频智能体场景优化推理效率与 token 效率。
推荐理由:官方给出 104B 总参数与 7.4B 激活参数的具体配置和评测数据,可用于评估高频智能体场景下的推理成本与部署取舍。
inclusionAI 在 Hugging Face 开源 Ling-2.6-flash 指令模型,总参数 104B、激活参数 7.4B,主打推理效率与 token 效率。
推荐理由:模型以 7.4B 激活参数和混合线性架构给出推理吞吐与 token 效率数据,可供评估高并发 agent 场景的部署成本。
inclusionAI 在 Hugging Face 发布 DR-Venus-4B-SFT-GGUF,这是由 Qwen/Qwen3-4B-Thinking-2507 微调而来的 4B 深度研究智能体,也是 DR-Venus 的监督初始化检查点。
推荐理由:用约 1 万条开放轨迹训练出 4B 深度研究智能体,并在多个基准上超过此前同规模开源模型。
inclusionAI 在 Hugging Face 发布 DR-Venus-4B-RL-GGUF,这是基于 DR-Venus-4B-SFT 用 IGPO 式信息增益奖励做智能体强化学习得到的 4B 深度研究智能体,基座为 Qwen3-4B-Thinking-2507,最大 rollout 上下文 256K、单次最多 200 步交互。
inclusionAI 发布 4B 深度研究智能体 DR-Venus-4B-SFT,基于 Qwen3-4B-Thinking-2507 在清洗后的开源 REDSearcher 轨迹上做智能体监督微调,最大训练长度 200K,使用 search 与 visit 工具。
推荐理由:给出 9B 以下开源深研究智能体的基准对比,读者可据此判断 4B 模型的深研究能力位置。
inclusionAI 发布 DR-Venus,一个基于 Qwen3-4B-Thinking-2507、完全用开源数据训练的 4B 深度研究智能体。
inclusionAI 发布 LLaDA2.0-Uni,一个基于扩散大语言模型的统一 MoE 模型,将多模态理解与生成整合进 Mask Token Prediction 范式,模型权重和推理代码已在 HuggingFace 开源。
Inclusion AI(蚂蚁集团)联合 HKUST、ZJU 等发布 TC-AE,一个基于 Vision Transformer 的 tokenizer,通过优化 token 空间解决高压缩比下的表征坍缩问题。
inclusionAI 开源 cuLA,用 CuTe DSL 和 CUTLASS C++ 为 GLA、KDA、GDN、Lightning Attention 等线性注意力变体提供手调 CUDA 内核,支持 NVIDIA Blackwell(SM10X)与 Hopper(SM90)GPU。
FireRedTeam 将 FireRedVAD 作为独立仓库开源,并放出模型权重与推理代码。该方案支持非流式/流式 VAD 与非流式 AED,可检测 100+ 语言的语音、歌声和音乐,非流式 VAD 在覆盖 102 种语言的 FLEURS-VAD-102 上取得 97.57% F1,超过 Silero-VAD、TEN-VAD、FunASR-VAD 和 WebRTC-VAD。