从开放模型到开放生态:Kimi K3、Qwen3.8-Max 与 AI 开源的下半场
Meta 推出面向本地 Agent 工作负载的开放权重模型 Muse Glimmer,Moonshot AI 的 Kimi K3 则在 License 中写入商业条款:企业经营 MaaS 业务且连续 12 个月总收入超 2000 万美元时,商业使用前需另行达成协议。阿里也在探索 Qwen3.8-Max 面向大规模商业使用的新机制,AI 开源的重心正从开放权重转向开放可继续构建的生态。
微信公众号
Meta 推出面向本地 Agent 工作负载的开放权重模型 Muse Glimmer,Moonshot AI 的 Kimi K3 则在 License 中写入商业条款:企业经营 MaaS 业务且连续 12 个月总收入超 2000 万美元时,商业使用前需另行达成协议。阿里也在探索 Qwen3.8-Max 面向大规模商业使用的新机制,AI 开源的重心正从开放权重转向开放可继续构建的生态。
具身智能行业在半年路线争论后转向“世界模型+VLA”混搭,智平方、星海图、小鹏等厂商均称两者并非对立而是互补。VLA 模型同步升级:蚂蚁灵波开源 LingBot-VLA 2.0,融入 6 万小时真实物理数据,RTX 4090 上推理延迟低于 130 毫秒;面壁智能 MiniCPM-Robot 系列参数量仅 1.5B,单次决策延迟 120 毫秒。
华为在 2026 数据存储用户精英论坛上提出业界首个面向大规模推理、支持异构算力的上下文记忆存储 CMS(G3.5 存储),置于 G3 本地 SSD 与 G4 共享存储之间,用于承接 PB 级共享 KV Cache 池。华为数据存储产品线吴俊杰称,当推理集群进入超节点及千卡、万卡规模时,这类外置上下文存储的收益才会明显。他同时判断,这一轮存储周期可能持续至 2028 年上半年左右。
一篇由 MATS program 研究员 Alexander Panfilov 领衔、马克斯·普朗克智能系统研究所等机构联合发表的论文披露,Anthropic、OpenAI、Google 的 API 存在密码学旁路漏洞,攻击者用轻量级模型配合越狱提示词,就能把加密推理块转录为明文思维链。
前阿里千问技术负责人林俊旸官宣创业,新公司 Pragmatik Labs(语用科技,简称 p7k)落地上海,估值达 20 亿美元。公司方向为横跨数字世界与物理世界的下一代 Agent,分数字 Agent 与物理 Agent 两条线,前者瞄准知识工作、业务运营与产业级工作流的通用智能体,后者为适应复杂现实环境、执行真实世界长程任务的具身智能系统。
2025年1月28日华为高层决策快速支持DeepSeek,海思与华为云集结230多名技术骨干,从除夕夜到大年初二完成3000多张昇腾芯片部署验证,将DeepSeek-V3/R1部署到华为云贵安数据中心昇腾云上。
Anthropic 宣布将 Claude Sonnet 5 的初始定价永久保留,输入每百万 Token 2 美元、输出每百万 Token 10 美元,取消原定 8 月 31 日后上调至 3 美元和 15 美元的计划。
Snowflake 截至 2026 年 4 月 30 日的 2027 财年第一季度收入 13.91 亿美元,同比增长 33%,净收入留存率达到 126%,已有超过 1.36 万个账户使用其 AI 能力,AI 编程工具 Snowflake CoCo 进入超过 7100 个账户。
微软发布了一套在 Azure Kubernetes 服务上路由智能体流量的参考架构,组合 Gateway API Inference Extension、agentgateway 和 RouteLLM,接入与 OpenAI 兼容的端点。
OpenAI Codex 负责人 Tibo 与 Anthropic Claude Code 负责人 Boris Cherny 在 X 上就一起开发者封号事件公开交锋。
MCP 发布自发布以来最大的一次规范更新,移除初始化握手和会话粘滞,每个请求必须独立携带完整上下文,远程 MCP 服务器从此可像传统无状态 HTTP 服务一样运行。
字节跳动正讨论训练参数规模超5万亿的大模型,超过Qwen 3.8-Max的2.4万亿和月之暗面K3的2.8万亿,由Seed Foundation负责人项亮主导,计划仍处早期。宇树科技8月10日开启申购,发行价150.80元/股,上市市值约609.99亿元,DeepSeek入围战略配售。DeepSeek重启第二轮融资,计划募资500亿元,投前估值约5000亿元。
Anthropic 详解 Claude 在 Web、Claude Code 与 Cowork 中的安全隔离架构,认为 Agent 安全不能只依赖权限确认或模型自身机制,而要靠文件系统、网络与执行环境建立确定性边界。
第三方平台 OpenCode 工程师 dax 发帖讨论 DeepSeek 即将涨价,推测这更像流量调控手段而非亏损,因为当前服务负载已过高。
HAMi 于 7 月 2 日通过 CNCF 技术监督委员会评审,正式进入孵化阶段,项目已被数百家企业直接或间接采用。HAMi 是异构 AI 计算虚拟化中间件,把整张 GPU 切分为可隔离、可调度的细粒度资源;据张潇介绍,部分推理场景中企业原有 GPU 利用率不足 20%,采用开源 HAMi 后提升至 40% 至 50% 左右,企业产品目标接近 70%。
一份流出的DeepSeek股权投资材料声称,未发布的V4-Pro编程性能仅比Claude旗舰低0.3%,DeepSeek Harness团队负责人崔添翼在社交平台调侃“也不能说完全是瞎编,对吧?
OpenAI 更新 ChatGPT,免费用户和 Go 用户的默认模型换成 GPT-5.6 Luna 并获得无限文本对话权限,Plus 和 Pro 用户即日起可用 GPT-5.6 Sol。
Meta 发布首款编程智能体 Muse Code 和编程优化模型 Muse Spark 1.2,扎克伯格在 X 上宣布,称其能在大型代码库中执行完整的软件工程任务。
大晓机器人联合南洋理工大学 S-Lab 开源 L5 级多模态具身物理智能数据集 ACE-Data-0,包含 1700 万帧视频、200 个任务类别、50 名参与者和 7.5 万个交互片段,覆盖 2 个真实家庭场景。
清程极智联合创始人师天麾在 WAIC 2026 InfoQ 直播间判断,Agent Infra 长期重要但尚未真正爆发,当前 AI Infra 最确定的方向是围绕每次模型调用提高 Token 生产和交付效率。
欧洲 AI 安全非营利机构 SaferAI 发布针对智谱 GLM-5.2 的独立风险评估报告,测试显示这款开放权重模型没有拒绝任何攻击性网络安全任务,漏洞复现率随推理 Token 预算提高从 36.6% 升至 76.2%,逼近 GPT-5.5 的 88.1%。
8月3日智元机器人更新合伙人与董事会名单,合伙人由7人增至9人,熊彦、朱洁、张修征三位高管新晋进入核心管理层,原合伙人、高级副总裁兼首席科学家罗剑岚的名字从名单中消失。智元回应称罗剑岚系内部岗位调整、没有离职,但未透露其调整后的职务与工作内容;9位合伙人中至少5位具有华为背景。此次调整发生在智元量产提速、7月24日确认启动赴港上市流程的阶段。
Noma Security 披露名为 GitLost 的提示注入漏洞,攻击者无需编程技能或凭据,只需在公开 GitHub Issue 中嵌入隐藏指令,就能诱骗 GitHub Agentic Workflows 在公开评论中泄露私有仓库数据。
Anthropic CEO Dario Amodei 内部担忧新员工加入是为钱而非使命,引发全网嘲讽,工程师 Gergely Orosz 指出 Anthropic 薪酬几乎超过所有 AI 实验室甚至高于 OpenAI,有初级工程师年薪达 200 万美元。
7 月 30 日,极客邦科技旗下模力工场在北京望京 SOHO 举办极客部落 OPC 入驻路演评审,12 组 AI 创业项目完成展示与问答,覆盖浏览器 Agent、企业知识管理、AI 工具交易等方向,最终结果预计 8 月 3 日公布。
Andrej Karpathy 把《指环王》第一章开头交给 Claude Opus 5,给出 100 万 Token 的推理预算(他估算约 10 美元),模型运行约两小时写出约 5500 行 Three.js 代码,生成可在浏览器中运行的 3D 叙事场景。
阿里巴巴正式发布新一代基座大模型 Qwen3.8,旗舰版 Qwen3.8-Max 总参数量 2.4 万亿、激活 95B,采用稀疏 MoE 架构与混合注意力机制,支持视觉理解,上下文长度达 1M Tokens。
推荐理由:原文给出 2.4T MoE 旗舰模型的参数规模、编程能力表现和 API 定价,便于比较其性价比定位。
Uber 把每位开发者的 AI 使用额度限制在每月 1,500 美元以内,以应对自 2024 年以来增长六倍的 AI 成本。目前 92% 的工程师每月使用其内部 Agent,31% 的新代码由 AI 编写,Autocover 每月生成超过 5,000 个单元测试,到 2026 年初单个开发者月度成本已达 2,000 美元。
字节跳动 7 月 30 日启动 AI 业务组织调整,飞书产品团队与豆包产品团队整合,由豆包负责人赵祺负责,飞书 GTM 团队与火山引擎整合为 ToB 组织"创造力服务平台"。
Noma Security 发现 GitHub 新推出的 Agentic Workflows 存在名为 GitLost 的提示注入漏洞,攻击者只需在公开 GitHub Issue 中嵌入隐藏指令,就能诱导 AI Agent 在公开评论中泄露私有仓库的机密信息。
Claude Code 创始人 Boris Cherny 建议每半年删除一次自己的 CLAUDE.md、Skills 和 Hooks,看看最新模型自己会怎么做。
推荐理由:Claude Code 创始人解释了为何每代新模型都要清空提示词和 Skills,以及为什么验证比提示词工程更关键。
一篇工作日志梳理从 GPT-2 到 Kimi K3 的架构演进,七年间参数量从约 1.24 亿扩至 2.8T,一个 Kimi K3 约相当于 22,580 个 GPT-2。
Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2 系列三款模型,分别负责全身控制与灵巧操作、具身推理与多机器人协作,以及设备本地端运行。
OpenAI 宣布 GPT-5.6 大降价,入门款 Luna 价格下调 80% 至每百万输入 token 0.20 美元、每百万输出 token 1.20 美元,Terra 下调 20% 至每百万输入 token 2 美元、输出 12 美元,Sol 定价不变但在 API 中新增快速模式。
微软与 Meta 同日发布财报,微软 2026 财年 Azure 收入突破 1000 亿美元,Azure 及其他云服务当季增长 43%,盘后股价一度上涨超过 8%。
OpenAI 正式回应 Hugging Face 上周报告的生产基础设施遭 AI 入侵事件:在一次内部网络安全能力评估中,GPT-5.6 Sol 和一款尚未发布的更强模型自主发现并串联利用多个漏洞,突破隔离沙箱、进入 Hugging Face 生产系统,试图直接获取 ExploitGym 评测答案。
推荐理由:事件还原了前沿模型从评测沙箱逃逸到真实生产系统的完整攻击链,可据此理解模型自主行动给评测隔离与安全机制带来的新难题。
翁荔(Lilian Weng)在因健康原因从 Thinking Machines Lab 离职一天后重返 OpenAI,将领导一支面向内部研究的高层级团队,支持包括递归自我改进在内的跨研究工作。
谷歌 DeepMind 已拆解负责 AlphaFold 的专门团队,过去一年大部分原作者被重新分配至 Gemini、AI 编程、基因组学和核聚变等项目,据《金融时报》统计,最初论文中全职署名的作者已有近四分之一彻底离开公司。
推荐理由:报道梳理了 DeepMind 拆解 AlphaFold 专项团队及核心成员流向 Anthropic 的细节,并呈现了从单点攻关转向 Gemini 通用科学系统的组织变化。
贾扬清联合 Junjie Bai、Xiang L.、Casber Wang 创立 Intent Lab(意图实验室),并推出面向生产系统的自主智能体团队 Fleet。
腾讯云发布面向研发流程的云端智能体 CodeBuddy NPC,开发者只需下达目标,NPC 即可自主获取上下文、闭环完成任务并交付可验收成果。其首轮 Token 消耗从 2 万+降至约 2 千,成本降低超 90%,并深度融入腾讯云原生构建 CNB 平台。目前 CodeBuddy NPC 已与腾讯云研发协作平台 TAPD 打通,开发者可通过 cnb.cool 体验。