inclusionAI 发布 vllm-ling-v3 仓库
inclusionAI 在 GitHub 上线 vllm-ling-v3 新仓库,基于 vLLM 做 LLM 推理与服务。vLLM 由 UC Berkeley Sky Computing Lab 发起,支持 200+ Hugging Face 模型架构,采用 PagedAttention、连续批处理与 FP8/INT4 等量化,并提供 OpenAI 兼容 API。
项目更新、模型与开源社区动态
inclusionAI 在 GitHub 上线 vllm-ling-v3 新仓库,基于 vLLM 做 LLM 推理与服务。vLLM 由 UC Berkeley Sky Computing Lab 发起,支持 200+ Hugging Face 模型架构,采用 PagedAttention、连续批处理与 FP8/INT4 等量化,并提供 OpenAI 兼容 API。
inclusionAI 在 GitHub 开源 AKernel(Apache License 2.0),一个将整个数据中心变为 AI Agent 可编程扩展的分布式内核。
inclusionAI 在 GitHub 开源 sandboxd,这是 AKernel 使用的 Linux 沙箱生命周期服务,通过 gRPC API 管理沙箱的启动、等待、检查、度量与删除。
Claude Code v2.1.207 发布,Auto mode 在 Bedrock、Vertex AI 和 Foundry 上无需 `CLAUDE_CODE_ENABLE_AUTO_MODE` 即可使用,可通过设置中的 `disableAutoMode` 关闭。
蚂蚁集团 AI Security Lab 的 SingGuard 团队发布 SingGuard-NSFA 护栏框架,针对 Agent 的提示词注入、敏感信息窃取、恶意代码、工具滥用等运行时威胁,开源 0.8B/2B/4B/9B 四个模型及基准。
Claude Code 发布 v2.1.206,为 `/cd` 增加目录路径建议,并新增 `/doctor` 检查以精简 `CLAUDE.md` 中可由代码库推导的内容。
Claude Code 发布 v2.1.205,新增自动模式规则阻止篡改会话记录文件,并改进自动模式在无法从上下文解析变量时执行 `rm -rf` 前先询问。自动更新二进制下载改为流式写入磁盘,更新器峰值内存降低约 400 MB;`/doctor` 升级为可诊断并修复问题的完整设置检查,`/checkup` 为其别名。
Claude Code v2.1.204 修复了 headless 会话中 SessionStart hook 期间 hook 事件无法流式传输的问题,该问题可能导致远程 worker 在 hook 执行中途被空闲回收。
Claude Code v2.1.203 发布,新增登录即将过期警告和手动权限模式的灰色 ⏸ 标识,并将会话的额外工作目录加入 MCP roots/list。
Claude Code v2.1.202 在 `/config` 中新增"Dynamic workflow size"设置,可控制动态工作流生成的 agent 数量(小/中/大),该设置为建议性指引而非强制上限。
支付宝推出 Alipay-PIBench,一个评估 AI 编程智能体在真实支付集成任务上表现的仓库级基准,包含 9 个产品项目和 18 个任务实例,覆盖基础支付完成与高级风险感知支付加固两类场景。
inclusionAI 在 GitHub 开源 Avernet,一个用于构建和运营持久、协同多智能体系统的开源基础设施层,采用 Apache License 2.0。
Claude Code v2.1.201 发布,Claude Sonnet 5 会话不再使用对话中途的 system role 来传递 harness 提醒。该改动调整了会话中系统提示的注入方式。
Claude Code v2.1.200 将 AskUserQuestion 对话框改为默认不再自动继续,需通过 /config 选择启用空闲超时,并把 CLI、VS Code 和 JetBrains 的默认权限模式改为 Manual。该版本还修复了启动崩溃、后台会话休眠后静默中断、后台智能体因残留 daemon.lock 无法重启等问题,并改进了屏幕阅读器输出与安装脚本的内存不足提示。
Claude Code v2.1.199 发布,堆叠式 slash-skill 调用(如 `/skill-a /skill-b do XYZ`)现在会加载最多 5 个前置技能,而非仅第一个。该版本修复了 SSL 证书错误、流式响应在部分输出后被丢弃、子智能体被限流或服务器错误静默失败等问题,并让订阅用户的 429 限流错误自动退避重试。
Claude Code 发布 v2.1.198,子智能体默认在后台运行并在完成后发出通知,Claude in Chrome 转为正式可用。该版本新增 /dataviz 技能,用于图表与仪表盘设计指导,并提供可运行的配色验证器。后台智能体在 worktree 中完成代码工作后可自动提交、推送并创建草稿 PR,网关新增 Claude Platform on AWS 作为上游提供方。
蚂蚁集团与斯坦福联合开源 Universal Manipulation Exoskeleton(UME),一套在真机遥操作中提供实时力矩触觉反馈的上肢外骨骼系统,并提供将人类遥操作数据迁移为自主机器人策略的框架。
Claude Code v2.1.197 引入 Claude Sonnet 5 并设为默认模型,提供原生 1M-token 上下文窗口。8 月 31 日前提供 $2/$10 每百万 token 的促销价,需更新到该版本才能使用。
推荐理由:原文给出了 Claude Code 默认模型切换到 Claude Sonnet 5 的关键细节和限时定价,读者可据此评估是否升级版本。
inclusionAI 在 Hugging Face 发布 4B 深度研究智能体 DR-Venus-4B-RL,在 DR-Venus-4B-SFT 基础上用 IGPO 式信息增益奖励和格式感知的轮级监督做长程智能体强化学习。
Claude Code v2.1.196 新增组织默认模型支持,管理员可在组织控制台设置,未自选时 `/model` 中显示为 "Org default" 或 "Role default"。
Claude Code v2.1.195 新增 CLAUDE_CODE_DISABLE_MOUSE_CLICKS 环境变量,可在全屏模式下禁用鼠标点击、拖拽和悬停,同时保留滚轮滚动。该版本修复了 hook matcher 对含连字符标识符的子串误匹配问题,改为精确匹配,并修复了 macOS 语音听写长时间会话静音、中日泰等无空格语言自动提交失效等多项问题。
inclusionAI 发布 SingGuard 多模态安全护栏模型,把安全策略作为运行时输入,无需重训即可按自定义规则审核文本、图像和图文内容。模型覆盖多语言、query 侧与 response 侧场景,输出 safe 或 unsafe 总体判断并在 <answer> 标签给出命中的风险类别。
Claude Code v2.1.193 新增 `autoMode.classifyAllShell` 设置,可将全部 Bash/PowerShell 命令交由 auto-mode 分类器处理,而非仅限任意代码执行模式。
Claude Code v2.1.191 新增 `/rewind`,可恢复到执行 `/clear` 之前的对话。该版本通过将文本更新合并至 100ms,把流式响应期间的 CPU 占用降低约 37%,并减少长会话中终端输出缓存带来的内存增长。同时修复了后台 agent 停止后被复活、hooks 逗号分隔匹配器不触发等问题,MCP 服务器能力发现与 OAuth 请求现可对瞬时网络错误重试。
inclusionAI 发布多模态安全护栏模型 SingGuard-0.8b,把生效的安全策略作为运行时输入而非固定训练分类,部署团队无需重训即可按默认类别或自定义自然语言规则评估内容。模型覆盖文本、图像、图文、多语言以及查询侧与响应侧的安全评估,在六类基准上取得领先的平均表现,并支持 fast 与 fast-slow 两种推理模式和 Transformers、vLLM 推理。
Claude Code v2.1.187 新增 `sandbox.credentials` 设置,阻止沙箱命令读取凭证文件和密钥环境变量,并在模型选择器中加入组织级模型限制,选中受限模型时提示"restricted by your organization's settings"。
inclusionAI 发布 SingGuard 多模态安全护栏模型家族,支持文本、图像、图文及多语言、query 侧与 response 侧的安全评估。模型把生效的安全策略作为运行时输入而非固定训练分类,部署方无需重训即可按默认类别或自定义自然语言规则判定内容,并以 safe/unsafe 加匹配风险类别的 <answer> 标签输出结果。
推荐理由:原文给出策略作为运行时输入的设计与多模态、多语言覆盖范围,读者可据此判断免重训适配审核规则的可行性。
inclusionAI 发布 SingGuard 多模态安全护栏模型,把生效的安全策略作为运行时输入,无需重新训练即可按默认类别或自定义自然语言规则评估内容。
inclusionAI 发布 SingGuard-2b-GGUF,一款策略自适应多模态 LLM 护栏模型,将安全策略作为运行时输入而非固定训练分类,无需重训即可按默认类别或自定义自然语言规则评估内容。该模型覆盖文本、图像、图文、多语言、查询侧与响应侧六类安全场景,在六大基准类别上取得 SOTA 平均表现,并支持 Transformers 与 vLLM 原生推理。
inclusionAI 开源 SingGuard-8b 多模态安全护栏模型,将安全策略作为运行时输入而非固定训练分类,无需重训即可按自定义自然语言规则评估内容。该模型覆盖文本、图像、图文、多语言及查询侧与响应侧场景,在六大基准类别上取得 SOTA 平均表现,并支持 Transformers 与 vLLM 原生推理。
inclusionAI 发布 SingGuard 多模态护栏模型家族,将安全策略作为运行时输入而非固定训练分类,无需重训即可按自定义自然语言规则评估内容。该模型覆盖文本、图像、图文、多语言及查询侧与响应侧场景,在六大基准类别上取得 SOTA 平均表现,并支持 fast-slow 动态推理与 Transformers、vLLM 原生推理。
inclusionAI 发布策略自适应多模态护栏模型 SingGuard-2b,将安全策略作为运行时输入而非固定训练分类,无需重训即可按默认类别或自定义自然语言规则评估内容。该模型覆盖文本、图像、图文、多语言及查询侧与响应侧场景,在六大基准类别上取得 SOTA 平均表现,并支持 fast-slow 动态推理与 Transformers、vLLM 原生推理。
Claude Code v2.1.186 新增 `claude mcp login` 和 `claude mcp logout` 命令,可在 CLI 中直接认证 MCP 服务器,无需打开交互式 `/mcp` 菜单,并支持 `--no-browser` 以通过 SSH 完成认证。
inclusionAI 开源 Ling-2.6-flash-base 基础检查点,这是 Ling-2.6-flash 背后的基座模型,采用 Lightning Attention 与 MLA 按 7:1 混合的线性注意力架构,总参数约 104B、激活约 7.4B,训练 token 约 9.6T,上下文从 4K 分阶段扩展至 256K。
inclusionAI 发布 Ling-2.6-1T-base,一个总参数约 1T、激活约 63B 的细粒度 MoE 基座模型,由 Ling-2.0-1T-base 通过混合线性注意力改造而来,并作为 Ling-2.6 与 Ring-2.6 的共同基座。
推荐理由:模型卡给出了从 Ling-2.0 改造的迁移流程与长上下文训练安排,读者可据此评估万亿级 MoE 基座的微调与部署成本。
Claude Code v2.1.185 调整了流式卡顿提示:文案由"No response from API · Retrying in …"改为"Waiting for API response · will retry in …",触发阈值也从静默 10s 延长至 20s。
Claude Code v2.1.183 强化自动模式安全,未明确要求丢弃本地工作时会拦截 `git reset --hard`、`git checkout -- .`。
Claude Code v2.1.181 新增 `/config key=value` 语法,可在交互模式、`-p` 和 Remote Control 中直接设置任意配置项,并加入 `sandbox.allowAppleEvents` 选项允许沙箱命令在 macOS 发送 Apple Events。
inclusionAI 在 GitHub 上线 ASystem 仓库,目前包含 assets、docs、tests 等目录及 index.html、CNAME 等文件,仓库 Star 数为 1、Fork 数为 0。
Claude Code 发布 v2.1.179,修复了流式连接中断时部分响应丢失的问题,现在会保留已生成内容而非直接报错,加载动画也不再卡在"running tool"。该版本还修复了 WSL2 下鼠标滚轮滚动、沙箱 denyRead/allowRead 通配符导致 Bash 工具描述过大、欢迎页多个推广横幅堆叠等问题,并提升了远程会话的插件加载性能。