一文看懂 DeepSeek Harness
DeepSeek 释出自家 Coding Agent 产品 DeepSeek Harness,以「一切皆插件」为内核原则,当前为 developer preview 版本 0.1.0-rc.5、MIT 许可。
推荐理由:文章拆解了 DeepSeek Harness 的 Cordis 插件内核与四种运行模式,便于对照 Claude Code、Codex 理解其设计取舍。
开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。
当前仅显示精选新闻DeepSeek 释出自家 Coding Agent 产品 DeepSeek Harness,以「一切皆插件」为内核原则,当前为 developer preview 版本 0.1.0-rc.5、MIT 许可。
推荐理由:文章拆解了 DeepSeek Harness 的 Cordis 插件内核与四种运行模式,便于对照 Claude Code、Codex 理解其设计取舍。
DeepSeek Harness 已发布,底层框架 Cordis 只管插件加载和依赖,模型、工具、策略、存储、上下文、UI 都以插件形态存在,以 MIT 协议开源并已获 10K+ star。
推荐理由:原文列出 Harness 的插件化架构与 PTC 工具调用模式,可据此判断它对 Agent 工作流的影响。
FireRedTeam 发布 FireRedTTS3 的 PyTorch 代码与模型,基于语义增强连续语音表示,统一语音生成与编辑,含 Base 和 Instruct 两个变体,采用 Apache-2.0 许可。
推荐理由:仓库给出完整评测数字和安装使用入口,读者可以据此评估它在多语言克隆和语音编辑上的实际表现。
DeepSeek 发布 DeepSeek Harness v0.1 开发者预览,面向全球构建 agent harness 的开发者开放,代码库以 MIT 许可证开源。
推荐理由:官方开放了开发者预览并说明一切皆插件的架构设计,开发者可以据此评估是否用它搭建智能体。
DeepSeek Harness 开发者预览版上线并开源,定位为类似 Claude Code 的 Agent 框架。它采用插件式架构,模型、工具、技能、会话、沙箱、循环、UI 等能力均由可替换的插件组合,基于具备时空可组合性的 Cordis 插件系统构建。
推荐理由:全文拆解了 DeepSeek Harness 的插件化架构与模式设计,读者可据此判断这类 Agent 框架的定制边界与取舍。
DeepSeek 正式开源 DeepSeek-V4-Pro-0813,同时推出基于 Cordis 的开源代码智能体框架 Harness v0.1 开发者预览版,并同步开放配套插件生态。
推荐理由:原文列出 Harness 的插件式架构与四种默认模式,可用于比较它与 Codex、Claude Cowork 的工具组织方式。
inclusionAI 发布 Ling-3.0-flash 原生混合线性推理模型,总参数 124B、激活 5.1B,官方称其关键基准上追平或超过前代 1T 级旗舰 Ring-2.6-1T。
推荐理由:官方给出 124B 总参数、5.1B 激活的架构与量化评测数据,可供判断长上下文推理的部署成本。
inclusionAI 发布原生混合推理模型 Ling-3.0-flash,总参数 124B、每 token 激活 5.1B,约为前代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%。
推荐理由:模型卡给出混合线性注意力架构与 5.1B 激活参数占比,并附 SGLang、vLLM 部署命令,便于对照前代旗舰评估效率取舍。
安全公司 CloudSEK 与 Hudson Rock 披露,今年 3 月爆发的 LiteLLM 供应链投毒事件在约 40 分钟攻击窗口内波及全球超 2,500 个组织,约 195TB 密码凭据被外传。
推荐理由:披露的泄露数据类型与受影响机构清单,便于读者核对自身 AI 网关上游依赖的风险敞口。
MiniMax 发布开放权重音乐生成模型 Music 3.0,可基于创意描述和可选歌词一次性完成最长五分钟完整歌曲的作曲、编曲与制作。
推荐理由:原文给出架构细节和三方面能力升级,读者可以了解其开放权重音乐模型的技术路径。
安全公司 CloudSEK 和 Hudson Rock 披露,开源 AI 开发工具 LiteLLM 遭供应链攻击,TB 级凭证泄露,可能让攻击者访问超过 2500 家组织。
推荐理由:材料披露 LiteLLM 遭供应链攻击导致云密钥等凭证泄露,可了解此次受波及组织范围与凭证类型。
AutoGPT 创始 AI 工程师 Nicholas Tindle 分享应对 AI 智能体提交 pull request 的做法:把 AGENTS.md 和技能文件放到代码旁边,用 pull request 模板和覆盖率门槛当硬闸门,并让 CLA 签名充当人类识别器。
推荐理由:AutoGPT 把 AGENTS.md、技能和 CI 门槛放到代码旁的做法,可以迁移到其他开源项目的维护流程里。
SGLang 与 Miles 宣布 Day-0 支持 Qwen3.8-2.4T-A95B,这是千问最大的开源模型,总参数 2.4T、每 token 激活 95B,采用 69 层 GDN 线性注意力与 23 层 GQA 全注意力 3:1 交错的混合架构,MoE 含 512 专家 top-10 路由。
推荐理由:SGLang 团队详解 Qwen3.8 混合注意力架构的推理支持方案,给出内核优化、并行布局与实测吞吐数字,可作部署参考。
Meta 发布从 Muse 蒸馏而来的 30B 多模态模型 Muse Glimmer,采用 Apache 2.0 许可,面向本地隐私场景的智能体用途。模型由 2B ViT 视觉编码器和 28B 文本解码器组成,支持图像、视频、多模态工具调用和目标检测,并附带基于 DFlash 的可选投机解码。
推荐理由:原文给出架构组成、基准对比和各推理框架的 day-0 用法,读者可以据此评估本地部署的可行路径。
Stanford 研究人员用 Evo 2 生成 DNA 序列合成了近 300 个噬菌体,实验室测试从中筛出 16 个对大肠杆菌杀伤力较强的噬菌体。Evo 2 由 Brian Hie 打造,此次一次性生成完整的 ΦX174 基因组,部分候选噬菌体在实验中适应性高于天然 ΦX174。研究还开发了计算框架以减少送交合成的候选基因组数量,Hie 已将 Evo 2 以开源软件形式发布。
推荐理由:研究展示生成式模型从零设计完整噬菌体基因组并经实验室筛选验证,同时点出合成与验证环节的硬约束。
NVIDIA 发布 Cosmos 3 开放世界物理 AI 基础模型系列,基于 mixture-of-transformers 架构,融合视觉推理、世界生成与动作预测能力。
推荐理由:原文列出 Cosmos 3 三个尺寸的定位与多项基准排名,读者可据此判断开放世界模型在物理 AI 中的分工。
阿里巴巴 8 月 3 日正式发布新一代基座大模型 Qwen3.8,旗舰版 Qwen3.8-Max 总参数量 2.4T、激活 95B,支持视觉理解与 1M Tokens 上下文。
推荐理由:原文列出 2.4T 总参数、激活 95B 与 API 定价,读者可据此比较旗舰模型的规模与成本取舍。
Mistral AI 发布开源多模态安全分类器 Shieldstral,权重 3B,采用 Apache 2.0 协议。模型将内容审核改写为推理时的问答任务,用户用自然语言给出政策,无需重训即可适配文本、图像和 prompt–response 对的审核。
推荐理由:原文解释了用问答式策略接口替代固定分类体系的设计思路,并给出训练数据构建方法,读者可以借鉴其小模型超越大模型的数据策略。
Microsoft Research 发布开源智能体框架 Orchard,核心是可复用的 Kubernetes 环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 内直接训练智能体。
推荐理由:原文给出框架设计、训练配方和多项基准数字,读者可以据此评估开放环境层对降低 Agent 研究成本的作用。
阿里巴巴正式发布新一代基座大模型 Qwen3.8,旗舰版 Qwen3.8-Max 总参数量 2.4 万亿、激活 95B,采用稀疏 MoE 架构与混合注意力机制,支持视觉理解,上下文长度达 1M Tokens。
推荐理由:原文给出 2.4T MoE 旗舰模型的参数规模、编程能力表现和 API 定价,便于比较其性价比定位。