能否防御 AI 生成的真实危机事件视频攻击?RA-Bench 系统评测检测器、生成器与社交传播
论文提出 RA-Bench 基准,用于检测 AI 生成的真实危机事件视频,包含 17,886 条视频,其中 1,830 条真实视频锚点覆盖 10 类社会风险,16,056 条生成片段来自 4 个开源和 5 个闭源生成器。
项目更新、模型与开源社区动态
论文提出 RA-Bench 基准,用于检测 AI 生成的真实危机事件视频,包含 17,886 条视频,其中 1,830 条真实视频锚点覆盖 10 类社会风险,16,056 条生成片段来自 4 个开源和 5 个闭源生成器。
inclusionAI 开源 SingProbe,一个基于冻结基座模型(如 Ling-3.0-flash)多层隐状态的轻量 token 级探针训练框架,基座模型 requires_grad=False 仅做前向推理,由 token-probe 补丁版 SGLang 实时导出各层隐状态,仅训练探针模型,每 token 输出 10 维 logits。
inclusionAI 发布新一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数 5.1B,在关键基准上追平或超过上一代 1T 级旗舰 Ring-2.6-1T。
推荐理由:模型卡给出混合线性注意力架构与多精度量化对比,读者可据此评估长上下文智能体任务的部署成本。
Claude Code v2.1.233 为 `--worktree` 标志和 `claude agents` 视图新增 GitLab merge request URL 支持,MR 显示为 `!
Claude Code v2.1.232 将 subagent forking 设为默认开启,`subagent_type: "fork"` 的子智能体可继承完整对话与 prompt cache,交互式会话中的非 teammate 智能体默认后台运行。
FireRedTeam 发布 FireRedTTS3 的 PyTorch 代码与模型,基于语义增强连续语音表示,统一语音生成与编辑,含 Base 和 Instruct 两个变体,采用 Apache-2.0 许可。
推荐理由:仓库给出完整评测数字和安装使用入口,读者可以据此评估它在多语言克隆和语音编辑上的实际表现。
Claude Code v2.1.231 修复了 MCP OAuth 登录时因重定向 URI 不匹配而失败的问题,该问题影响使用预注册 OAuth 客户端的服务器(如 Slack)。
inclusionAI 发布 Ling-3.0-flash 原生混合线性推理模型,总参数 124B、激活 5.1B,官方称其关键基准上追平或超过前代 1T 级旗舰 Ring-2.6-1T。
推荐理由:官方给出 124B 总参数、5.1B 激活的架构与量化评测数据,可供判断长上下文推理的部署成本。
inclusionAI 发布原生混合推理模型 Ling-3.0-flash,总参数 124B、每 token 激活 5.1B,约为前代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%。
推荐理由:模型卡给出混合线性注意力架构与 5.1B 激活参数占比,并附 SGLang、vLLM 部署命令,便于对照前代旗舰评估效率取舍。
inclusionAI 在 GitHub 发布 ling-cookbook 仓库,为 Ling 系列模型提供本地部署配方和工程示例,标注为进行中的项目。
Claude Code 发布 v2.1.229,新增插件市场 `command` 源支持,本地命令输出的插件目录每会话重新解析、无需重启即可生效。
Claude Code v2.1.228 修复了交互会话在罕见内部布局错误后停止重绘、Windows 上从 git 安装父目录启动时找不到 git / Git Bash、`/tui` 回退到旧模型等问题。新版本还加固了从 claude.ai 同步的 skills,使其不再遮蔽本地命令或 MCP prompts,并改进跨会话消息显示与 Vertex AI 凭证处理。
inclusionAI 发布 Ling-3.0-tiny,一个轻量混合推理 MoE 模型,总参数 7.9B、每 token 仅激活 1.3B,提供 BF16、FP8 和 INT4 权重。
inclusionAI 发布 Ling-3.0-tiny,这是一个总参数 7.9B、每 token 仅激活 1.3B 的轻量混合推理 MoE 模型,提供 BF16、FP8 和 INT4 三种权重。
Claude Code v2.1.227 修复了会话以过期登录 token 启动时功能开关未按用户订阅层级评估的问题,该问题曾导致 Max 套餐用户被错误提示为 Fable 启用 usage credits。
Claude Code 发布 v2.1.226 版本,本次更新以修复 bug 和提升可靠性为主,未引入新功能。
Claude Code v2.1.225 为用量警告加入网关支出限额支持,达到上限时会显示限额、重置时间与运营方留言(需网关同为 2.1.225)。`claude agents` 新增工作区信任提示,用于不受信任目录,行为与 `claude` 一致。
Claude Code v2.1.224 新增 `claude self-hosted-runner` 自托管环境,可将自有机器或容器作为 web、移动端和桌面端会话的运行位置,面向 Team 和 Enterprise 套餐。
Claude Code v2.1.223 修复了 Bash 权限绕过漏洞——构造命令可向权限检查隐藏自身,同时修补了 workflow 脚本通过动态 import() 逃逸沙箱、以及 agent 定义中 bypassPermissions 忽略组织禁用策略的权限缺口。
Claude Code 发布 v2.1.222,修复 worktree 隔离会话及其子智能体可对主检出执行破坏性 git 命令的问题,隔离现已覆盖所有会话类型的文件编辑与 Bash。
Claude Code v2.1.221 为 VSCode 新增 Focus view,可用 Ctrl+Alt+F 将工具活动折叠为每轮摘要并显示运行中工具指示。
Claude Code v2.1.219 新增 Claude Opus 5(claude-opus-5)并设为默认 Opus 模型,支持 1M 上下文,fast mode 定价为 $10/$50 per Mtok。
inclusionAI 在 Hugging Face 发布面向智能体的 MoE 扩散语言模型 LLaDA2.2-flash,非嵌入总参数量 100B,上下文窗口扩展至 128K。
推荐理由:模型卡列出与 Ling-2.6-flash 的智能体基准和吞吐对比,可据此比较扩散架构在工具调用场景的表现。
inclusionAI 在 GitHub 发布开源项目 PanelWise,一个可嵌入的 Python 多模型聚合引擎,将同一任务发给可配置模型面板,支持 --eval 与 --no-eval 两种执行拓扑,面板成员、协调者和评估者均可在 YAML 配置。
inclusionAI 在 GitHub 开源 buildkit-service,用于智能体基础设施的分布式镜像构建与包镜像服务,可将 Dockerfile 批量构建为 OCI / Nydus 镜像并推送到任意 OCI registry。
Claude Code v2.1.218 将 /code-review 改为后台子智能体运行,审查不再占用对话上下文,并保留堆叠的斜杠命令作为审查目标。该版本还修复了 Windows 路径中 \u 前缀段被错误转成 CJK 字符、左箭头键无撤销地丢弃对话,以及 /ultrareview 在非交互会话中静默执行本地审查等问题。
Claude Code 发布 v2.1.217,新增提示词输入框 emoji 短代码自动补全,输入 `:heart:` 即可插入 ❤️,并可通过 `emojiCompletionEnabled` 设置关闭。
Claude Code v2.1.216 修复了长会话中消息归一化开销随轮次平方增长导致的多秒卡顿与恢复缓慢问题,并新增 `sandbox.filesystem.disabled` 设置,可在保留网络出口管控的同时跳过文件系统隔离。
Claude Code v2.1.215 中,Claude 不再自行运行 `/verify` 和 `/code-review` 技能,需用户主动输入 `/verify` 或 `/code-review` 才会调用。
Claude Code v2.1.214 修复了单段 `dir/**` 允许规则会误批任意层级嵌套目录写入的权限绕过问题,并修复 Windows PowerShell 5.1 会话中的权限检查绕过。超过 10,000 字符的 Bash 命令现在一律提示确认,不再自动执行。新增 EndConversation 工具,允许 Claude 终止存在滥用或越狱尝试的会话。
Claude Code v2.1.212 将 /fork 改为把当前对话复制到新的后台会话(在 claude agents 中独立成行),原先启动的会话内子智能体改为 /subtask。新增 WebSearch 调用与子智能体派生两项会话级上限(默认均为 200,可用环境变量调整),MCP 工具调用超过 2 分钟自动转入后台。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏模型,基于 Qwen3.5 微调,提供 0.8B、2B、4B、9B 四个尺寸,采用 Apache 2.0 许可。
蚂蚁集团 AI 安全实验室的 SingGuard Team 在 Hugging Face 发布 SingGuard-NSFA,这是面向智能体 AI 的双模式护栏框架,用于拦截提示词注入、敏感信息窃取、恶意代码请求、危险工具滥用和资源耗尽等风险,并开源 0.8B、2B、4B、9B 四个基于 Qwen3.5 的尺寸及 Apache 2.0 许可。
蚂蚁集团 SingGuard 团队在 Hugging Face 发布 SingGuard-NSFA 系列智能体护栏模型,本次为基于 Qwen3.5 的 4B GGUF 版本,采用生成式推理与实时分类双模式。
推荐理由:模型卡给出双模式护栏的部署方式与四档参数规模,读者可据此判断智能体实时安全拦截的落地条件。
inclusionAI 发布 SingGuard-NSFA 智能体安全护栏模型,覆盖 0.8B、2B、4B、9B 四个尺寸,基于 Qwen3.5 微调并采用 Apache 2.0 许可。
推荐理由:模型卡列出四个尺寸的 F1 表现与约 50 ms 实时检测延迟,读者可据此比较它在智能体安全拦截上的部署取舍。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏,开源 0.8B、2B、4B、9B 四个规模,均基于 Qwen3.5 微调,采用 Apache 2.0 许可。
蚂蚁集团 inclusionAI 发布 SingGuard-NSFA 系列智能体安全护栏模型,提供 0.8B、2B、4B、9B 四个尺寸,基于 Qwen3.5 微调并以 Apache 2.0 许可开源。
蚂蚁集团 SingGuard 团队发布 SingGuard-NSFA 智能体安全护栏,提供 0.8B、2B、4B、9B 四个基于 Qwen3.5 微调的尺寸,采用 Apache 2.0 许可。
inclusionAI 发布 SingGuard-NSFA 智能体护栏模型,包含 0.8B、2B、4B、9B 四种规模,基于 Qwen3.5 微调并以 Apache 2.0 开源。
Claude Code v2.1.211 新增 `--forward-subagent-text` 标志和 `CLAUDE_CODE_FORWARD_SUBAGENT_TEXT` 环境变量,可将子智能体的文本与思考内容纳入 stream-json 输出。该版本还修复了权限预览未中和双向覆盖、零宽及形近引号字符的问题,并解决了并行会话唤醒后同时登出、插件 MCP 服务器空闲后不重连等缺陷。