inclusionAI 发布 Ling-3.0-tiny,7.9B 参数 MoE 模型面向端侧部署
inclusionAI 发布 Ling-3.0-tiny,这是一个总参数 7.9B、每 token 仅激活 1.3B 的轻量混合推理 MoE 模型,提供 BF16、FP8 和 INT4 三种权重。
项目更新、模型与开源社区动态
inclusionAI 发布 Ling-3.0-tiny,这是一个总参数 7.9B、每 token 仅激活 1.3B 的轻量混合推理 MoE 模型,提供 BF16、FP8 和 INT4 三种权重。
Claude Code v2.1.227 修复了会话以过期登录 token 启动时功能开关未按用户订阅层级评估的问题,该问题曾导致 Max 套餐用户被错误提示为 Fable 启用 usage credits。
Claude Code 发布 v2.1.226 版本,本次更新以修复 bug 和提升可靠性为主,未引入新功能。
Claude Code v2.1.225 为用量警告加入网关支出限额支持,达到上限时会显示限额、重置时间与运营方留言(需网关同为 2.1.225)。`claude agents` 新增工作区信任提示,用于不受信任目录,行为与 `claude` 一致。
Claude Code v2.1.224 新增 `claude self-hosted-runner` 自托管环境,可将自有机器或容器作为 web、移动端和桌面端会话的运行位置,面向 Team 和 Enterprise 套餐。
Claude Code v2.1.223 修复了 Bash 权限绕过漏洞——构造命令可向权限检查隐藏自身,同时修补了 workflow 脚本通过动态 import() 逃逸沙箱、以及 agent 定义中 bypassPermissions 忽略组织禁用策略的权限缺口。
Claude Code 发布 v2.1.222,修复 worktree 隔离会话及其子智能体可对主检出执行破坏性 git 命令的问题,隔离现已覆盖所有会话类型的文件编辑与 Bash。
Claude Code v2.1.221 为 VSCode 新增 Focus view,可用 Ctrl+Alt+F 将工具活动折叠为每轮摘要并显示运行中工具指示。
Claude Code v2.1.219 新增 Claude Opus 5(claude-opus-5)并设为默认 Opus 模型,支持 1M 上下文,fast mode 定价为 $10/$50 per Mtok。
inclusionAI 在 Hugging Face 发布面向智能体的 MoE 扩散语言模型 LLaDA2.2-flash,非嵌入总参数量 100B,上下文窗口扩展至 128K。
推荐理由:模型卡列出与 Ling-2.6-flash 的智能体基准和吞吐对比,可据此比较扩散架构在工具调用场景的表现。
Claude Code v2.1.218 将 /code-review 改为后台子智能体运行,审查不再占用对话上下文,并保留堆叠的斜杠命令作为审查目标。该版本还修复了 Windows 路径中 \u 前缀段被错误转成 CJK 字符、左箭头键无撤销地丢弃对话,以及 /ultrareview 在非交互会话中静默执行本地审查等问题。
Claude Code 发布 v2.1.217,新增提示词输入框 emoji 短代码自动补全,输入 `:heart:` 即可插入 ❤️,并可通过 `emojiCompletionEnabled` 设置关闭。
Claude Code v2.1.216 修复了长会话中消息归一化开销随轮次平方增长导致的多秒卡顿与恢复缓慢问题,并新增 `sandbox.filesystem.disabled` 设置,可在保留网络出口管控的同时跳过文件系统隔离。
Claude Code v2.1.215 中,Claude 不再自行运行 `/verify` 和 `/code-review` 技能,需用户主动输入 `/verify` 或 `/code-review` 才会调用。
Claude Code v2.1.214 修复了单段 `dir/**` 允许规则会误批任意层级嵌套目录写入的权限绕过问题,并修复 Windows PowerShell 5.1 会话中的权限检查绕过。超过 10,000 字符的 Bash 命令现在一律提示确认,不再自动执行。新增 EndConversation 工具,允许 Claude 终止存在滥用或越狱尝试的会话。
Claude Code v2.1.212 将 /fork 改为把当前对话复制到新的后台会话(在 claude agents 中独立成行),原先启动的会话内子智能体改为 /subtask。新增 WebSearch 调用与子智能体派生两项会话级上限(默认均为 200,可用环境变量调整),MCP 工具调用超过 2 分钟自动转入后台。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏模型,基于 Qwen3.5 微调,提供 0.8B、2B、4B、9B 四个尺寸,采用 Apache 2.0 许可。
蚂蚁集团 AI 安全实验室的 SingGuard Team 在 Hugging Face 发布 SingGuard-NSFA,这是面向智能体 AI 的双模式护栏框架,用于拦截提示词注入、敏感信息窃取、恶意代码请求、危险工具滥用和资源耗尽等风险,并开源 0.8B、2B、4B、9B 四个基于 Qwen3.5 的尺寸及 Apache 2.0 许可。
蚂蚁集团 SingGuard 团队在 Hugging Face 发布 SingGuard-NSFA 系列智能体护栏模型,本次为基于 Qwen3.5 的 4B GGUF 版本,采用生成式推理与实时分类双模式。
推荐理由:模型卡给出双模式护栏的部署方式与四档参数规模,读者可据此判断智能体实时安全拦截的落地条件。
inclusionAI 发布 SingGuard-NSFA 智能体安全护栏模型,覆盖 0.8B、2B、4B、9B 四个尺寸,基于 Qwen3.5 微调并采用 Apache 2.0 许可。
推荐理由:模型卡列出四个尺寸的 F1 表现与约 50 ms 实时检测延迟,读者可据此比较它在智能体安全拦截上的部署取舍。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏,开源 0.8B、2B、4B、9B 四个规模,均基于 Qwen3.5 微调,采用 Apache 2.0 许可。
蚂蚁集团 inclusionAI 发布 SingGuard-NSFA 系列智能体安全护栏模型,提供 0.8B、2B、4B、9B 四个尺寸,基于 Qwen3.5 微调并以 Apache 2.0 许可开源。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏,提供 0.8B、2B、4B、9B 四个基于 Qwen3.5 微调的尺寸,采用 Apache 2.0 许可。
inclusionAI 发布 SingGuard-NSFA 智能体护栏模型,包含 0.8B、2B、4B、9B 四种规模,基于 Qwen3.5 微调并以 Apache 2.0 开源。
Claude Code v2.1.211 新增 `--forward-subagent-text` 标志和 `CLAUDE_CODE_FORWARD_SUBAGENT_TEXT` 环境变量,可将子智能体的文本与思考内容纳入 stream-json 输出。该版本还修复了权限预览未中和双向覆盖、零宽及形近引号字符的问题,并解决了并行会话唤醒后同时登出、插件 MCP 服务器空闲后不重连等缺陷。
Claude Code v2.1.210 发布,为折叠的工具摘要行加入实时耗时计数器,并新增对 Write(path)、NotebookEdit(path)、Glob(path) 权限规则的启动警告,提示改用 Edit(path) 或 Read(path)。
Claude Code 发布 v2.1.209,修复了 `claude agents` 后台会话中 /model 等对话框被阻塞的问题,该改动回退了此前一个范围过宽的防护逻辑。
Claude Code 发布 v2.1.208,新增屏幕阅读器模式,可通过 `claude --ax-screen-reader` 或设置 `axScreenReader` 开启纯文本渲染。
Claude Code v2.1.207 发布,Auto mode 在 Bedrock、Vertex AI 和 Foundry 上无需 `CLAUDE_CODE_ENABLE_AUTO_MODE` 即可使用,可通过设置中的 `disableAutoMode` 关闭。
Claude Code 发布 v2.1.206,为 `/cd` 增加目录路径建议,并新增 `/doctor` 检查以精简 `CLAUDE.md` 中可由代码库推导的内容。
Claude Code 发布 v2.1.205,新增自动模式规则阻止篡改会话记录文件,并改进自动模式在无法从上下文解析变量时执行 `rm -rf` 前先询问。自动更新二进制下载改为流式写入磁盘,更新器峰值内存降低约 400 MB;`/doctor` 升级为可诊断并修复问题的完整设置检查,`/checkup` 为其别名。
Claude Code v2.1.204 修复了 headless 会话中 SessionStart hook 期间 hook 事件无法流式传输的问题,该问题可能导致远程 worker 在 hook 执行中途被空闲回收。
Claude Code v2.1.203 发布,新增登录即将过期警告和手动权限模式的灰色 ⏸ 标识,并将会话的额外工作目录加入 MCP roots/list。
Claude Code v2.1.202 在 `/config` 中新增"Dynamic workflow size"设置,可控制动态工作流生成的 agent 数量(小/中/大),该设置为建议性指引而非强制上限。
Claude Code v2.1.201 发布,Claude Sonnet 5 会话不再使用对话中途的 system role 来传递 harness 提醒。该改动调整了会话中系统提示的注入方式。
Claude Code v2.1.200 将 AskUserQuestion 对话框改为默认不再自动继续,需通过 /config 选择启用空闲超时,并把 CLI、VS Code 和 JetBrains 的默认权限模式改为 Manual。该版本还修复了启动崩溃、后台会话休眠后静默中断、后台智能体因残留 daemon.lock 无法重启等问题,并改进了屏幕阅读器输出与安装脚本的内存不足提示。
Claude Code v2.1.199 发布,堆叠式 slash-skill 调用(如 `/skill-a /skill-b do XYZ`)现在会加载最多 5 个前置技能,而非仅第一个。该版本修复了 SSL 证书错误、流式响应在部分输出后被丢弃、子智能体被限流或服务器错误静默失败等问题,并让订阅用户的 429 限流错误自动退避重试。
Claude Code 发布 v2.1.198,子智能体默认在后台运行并在完成后发出通知,Claude in Chrome 转为正式可用。该版本新增 /dataviz 技能,用于图表与仪表盘设计指导,并提供可运行的配色验证器。后台智能体在 worktree 中完成代码工作后可自动提交、推送并创建草稿 PR,网关新增 Claude Platform on AWS 作为上游提供方。
Claude Code v2.1.197 引入 Claude Sonnet 5 并设为默认模型,提供原生 1M-token 上下文窗口。8 月 31 日前提供 $2/$10 每百万 token 的促销价,需更新到该版本才能使用。
推荐理由:原文给出了 Claude Code 默认模型切换到 Claude Sonnet 5 的关键细节和限时定价,读者可据此评估是否升级版本。
inclusionAI 在 Hugging Face 发布 4B 深度研究智能体 DR-Venus-4B-RL,在 DR-Venus-4B-SFT 基础上用 IGPO 式信息增益奖励和格式感知的轮级监督做长程智能体强化学习。