马斯克悄悄改了战场:Grok Build 0.2.60 剑指 Agent Runtime
Grok Build 于 2026 年 6 月 21 日发布 0.2.60 版本,未推出新模型能力或刷新 Benchmark,而是聚焦会话恢复、上下文压缩、MCP 工具输出等 Runtime 细节。
按公众号阅读文章与观点
Grok Build 于 2026 年 6 月 21 日发布 0.2.60 版本,未推出新模型能力或刷新 Benchmark,而是聚焦会话恢复、上下文压缩、MCP 工具输出等 Runtime 细节。
MoffettNathanson 高级分析师 Michael Morton 在与 Ben Thompson 的对谈中称,从 AI 平台流向品牌官网的流量增速是传统电商平台的 4 到 8 倍,AI 目前更像升级版 Google Search,而非新的交易平台。
远景科技集团在 Viva Tech 上宣布 "Mission Gobi(戈壁使命)" 计划(业内称 GobiX),将利用戈壁风光资源发电,到 2030 年在全球戈壁荒漠地区建成 5GW 规模的绿色 AI 算力中心。
ICRA 2026 期间,速腾聚创、帕西尼感知、光轮智能、智元机器人、天机智能、非夕科技六家中国企业登台,分享感知、操作、数据、仿真与基础模型进展。智元机器人发布 5B 参数开源预训练具身世界模型 τ0-WM,预训练数据 27000 小时,其中真机遥操作数据 17800 小时;其「部署即训练」范式在 16 台双臂移动机器人长程任务测试中将策略准确率从 60%-70% 提升至 95%。
中国人民大学高瓴人工智能学院与微软研究院提出 Arbor,一个面向自主科研的框架与开源工具包,通过 Hypothesis-Tree Refinement 把多轮实验组织为持续演化的研究状态,并登上 Hugging Face Daily Paper 日榜第一。
豆包专业版结束全免费,新增三档订阅:标准版68元/月、加强版200元/月、高级版500元/月,学生价38元/月,付费版接入豆包2.1系列大模型。量子位付费实测其办公任务模式可在授权后操作本地电脑发小红书、生成应用、做PPT并调用Skills,但标准版做一版应用就烧完5小时额度。作者判断免费版够日常使用,想体验Agent能力可从68元标准版起步,500元高级版更适合高频办公的重度用户。
6月22日智谱港股盘中涨超42%,股价新高2980港元,总市值突破1万亿港元,而同一周上市的MiniMax股价已从3月高点1330港元跌至616.5港元,已然腰斩。文章认为估值锚已从讲故事溢价转向硬实力定价,智谱借GLM-5.2技术卡位、B端安全刚需和MaaS业务增长形成不可替代性,MiniMax则缺少这一锚点。7月两家公司将迎来首批解禁,MiniMax解禁后流通盘将暴增近10倍。
AI正深度冲击律师业,不复杂的民事案件越来越多人用AI查法条、写诉讼状,2025年初DeepSeek等应用普及后,独立律师小韩对简单纠纷直接建议客户用AI自己搞定。全国律师人数从2016年32.8万增至2025年83万,而2021至2022年诉讼增量仅1.6%,法学专业截至2025年已连续5年上榜本科就业红牌专业。中国法律行业生成式AI个人使用率已达96%,DeepSeek以约80%占比成首选。
北京大学、清华大学、星尘智能等机构联合提出 StableVLA,用轻量级 IB-Adapter 替换 VLA-Adapter 的 MLP projector,在视觉特征进入策略模型前筛选信息,无需额外扰动数据即可提升鲁棒性。
Momenta冲刺港股IPO,将自身定位为物理AI基座模型构建者,其R7世界模型已量产并首发搭载于上汽大众ID. ERA 9X。招股书显示2023年至2025年营收从7.43亿元增至24.13亿元,许可收入从0.23亿元增至9.68亿元。据CIC灼识咨询数据,2025年3月至2026年2月中国第三方城市NOA供应商市场中,搭载Momenta系统的量产车销量市占率达65%。
深圳制造的灵晟超级计算机登顶全球超算 TOP500 榜单,打破西方近十年垄断,时隔九年中国超算重回榜首。灵晟采用全自研纯 CPU 架构,未使用一块 GPU,是全球首台纯 CPU 架构突破 2EFlops 的超算系统。其核心处理器为自研 LX2 芯片,内嵌 AI 矩阵加速单元,集成国产 HBM,并同步拿下 HPCG 榜单第一。
推荐理由:灵晟以无 GPU 的纯 CPU 架构登顶 TOP500,为 E 级算力不依赖 GPU 的路线提供了一份实例。
Founder Park 启动 2026 中国 AGI 创新影响力机构 TOP 30(MVP 30)征集,面向以中国企业为主的 AI 初创公司与上市公司产品,覆盖基础设施层、模型层、应用层。申报截止 7 月 3 日,评审至 7 月 24 日,结果将于 8 月 3 日至 4 日在 AGI Playground 2026 大会现场及线上公众号公布。
Netflix 高级工程师 Tejas Chopra 开发的开源工具 Headroom 可在智能体指令送入大模型前压缩词元,据其估计其中高达 90% 属于冗余。
Claude 上线“群聊 Agent”功能,支持多智能体在群聊中协作交互。Karpathy 盛赞其为交互新范式,但也有观点担忧它成为打工人的“数字监工”。
Aether AI 完成 2000 万美元种子轮融资,由经纬创投领投,英诺基金、SWC Global、九合创投参投,走因果世界模型路线,区别于视频生成、3D 生成和 JEPA。其因果世界模型在机器人操作任务上相比传统世界模型实现 25%-50% 成功率提升和 5 到 10 倍样本效率提升,约 80% 数据来自模拟、第一视角和公开视频。
香港大学 MaRS Lab 张富团队研发的 FAST-LIVO2 获 IEEE TRO 傅京孙纪念最佳论文奖,为该奖史上第二次颁给中国科研团队。论文由郑纯然一作、张富通讯,提出激光-视觉-惯性融合的直接法里程计与建图系统,适配弱纹理、光照剧变场景。项目开源后 GitHub 累计约 4.2k Star。
上海人工智能实验室、上海交通大学、香港中文大学团队提出TRM(Thinking Reward Model),用ME² principle和DAG-based pairwise evaluation给大模型推理过程打分,把"想得好"变成可训练的奖励信号。
6月23日,豆包专业版随火山引擎FORCE大会上线,基于豆包2.1系列大模型,下分标准68元、加强200元、高级500元三档连续包月套餐,年付最高5088元,免费版继续保留。
香港城市大学、腾讯等机构研究者提出离线强化学习新方法 ROMI,通过鲁棒价值感知的模型学习与隐式可微自适应加权双层优化,解决 RAMBO 保守性难控、模型梯度更新易致梯度爆炸的问题。在 D4RL 与 NeoRL 基准上,ROMI 总得分 953.5,较 RAMBO 提升 18.6%,并在多数任务上达到或超越 SOTA。该论文已被 ICLR 2026 接收。
小米 MiMo 团队 6 月 11 日开源终端编程 Agent MiMo Code,AI科技评论 在源码中发现 checkpoint-writer 共享父 Agent 的 KV cache、Dream/Distill 自进化与四层记忆等工程创新。
InfoQ 访谈 PingCAP 联合创始人黄东旭、徐昊、滕昱等人,讨论 AI 写代码与重写软件的边界。黄东旭的 db9 项目三个月产出超 100 万行 Rust 代码,0 行由人类手写或 review,峰值一天消耗约 10 亿 token,上线后服务超 10000 个数据库实例。多位受访者认为 AI 已能写任何东西,但技术选型、架构拆分和方向判断仍需资深工程师掌舵。
极客时间企业版一场直播中,快手王东旭、造物者咨询袁野、极客邦赵钰莹、前蚂蚁金服右军四位嘉宾围绕 AI 组织转型给出判断。王东旭提出"AI 洗牌洗掉的是协调税",袁野强调"个人提效不等于组织提效",赵钰莹首次解读覆盖 2660 份样本的《2026 中国智能体工程化人才与组织发展报告》,右军则指出个人效率飙升反而导致组织进度滞后。
蚂蚁集团容器调度团队负责人吴伟提出,把训练与推理两个资源池打通做训推一体池化调度,让任务在波峰波谷间流动,以提升 GPU 利用率。他指出提升利用率存在硬件和业务 SLO 两层天花板,软件优化接近硬件极限后仍需靠扩容,而国产卡的主要差距不在单卡算力,而在 CUDA 全链路生态。
作者拿到微信小微的内测资格,实测该 Agent 打通通讯录、朋友圈、微信支付和小程序的调用,但几乎每一步操作都要求用户确认,批量发消息、定时发消息均不支持。小微基座为微信自研 WeLM,偶尔借助 DeepSeek 回复,作者推测服务端用的是 WeLM-V4-80B 这一 80B 激活 3B 的 MoE 型号,并提到还有激活 22B 的 WeLM-V3-258B。
火山引擎在 6 月 23 日 Force 大会上发布豆包大模型 2.1 Pro、Seedance 2.0 4K 等 5 款新模型。Seedance 2.5 将于 7 月初上线,支持 30 秒单段原生视频直出和最多 50 个全模态素材联合生成。
推荐理由:文章给出豆包 2.1 Pro 与 Seedance 系列的发布细节,可看到一个云厂商把强模型当作云入口的整体打法。
德国慕尼黑法院裁定谷歌必须删除涉事AI摘要并禁止继续传播错误信息,谷歌表示将上诉。文章提到谷歌AI摘要月活已超过25亿,而SparkToro称2026年前四个月美国谷歌搜索中68.01%未产生点击,Penske Media、Chegg等已就AI摘要抢走网页流量起诉谷歌。
微信 AI 助手小微开启灰度测试,作者试用一天后给出 15 条体验与思考。小微把语音设为默认输入与输出方式,入口分布在聊天、公众号文章和视频号中,还能在群聊和单聊里生成回复话术。作者称小微主模型为微信自研 WeLM,部分回答调用 DeepSeek,并可用自然语言生成小工具,但生成的小工具目前无法消耗 token 调用 AI 能力。
Hermes 上线 /learn 模式,可向它输入 GitHub 仓库、PDF、API 文档、配置文件等资料,由其自行学习、提炼并封装成合适的 Skill。在 hermes agent 终端输入 hermes update 即可完成升级。
Anthropic 发布新产品 Claude Tag,让 Claude 以团队成员身份加入 Slack,用户 @ 它一个任务后由它自行拆解步骤、逐步执行并在线程里回复结果。
零一万物CEO李开复在虎嗅独家对话中表示,公司已放弃基座模型路线,转向面向企业一号位的AI转型业务,2025年订单规模约5亿元、2026年合约统计已达15亿元。他称零一万物对标的不是OpenAI而是Palantir,并以主权AI切入哈萨克斯坦等海外市场,一号位工程成单率约10%到15%。公司正筹备新一轮融资,并为2027年IPO做准备。
微信正小范围内测原生AI助手“小微”,主界面左上角出现绿色机器人图标,顶部标注“测试版”,被记者称为微信史上最大更新。火山引擎在FORCE原动力大会公布豆包视频生成模型Seedance 2.5,支持单段原生30秒视频直出、可导入50个全模态参考素材,预计7月初正式上线。DeepSeek Harness团队负责人崔添翼回应招聘海报争议,称“没有不招外国人的规定”。
Anthropic 发布企业协作工具 Claude Tag,定位为 Claude Code 的一次进化,可嵌入 Slack 频道让整个团队共享同一个 Claude。
Seed-2.1-Pro 在 DracoBench 上得分 94 分,排在 GLM-5.2、KIMI-K2.7-Code、KIMI K2.6 和 GLM-5.1 之后。
中美双方都相信时间站在自己这一边:美国认为自身在科技研发上具有结构性优势,但需战略收缩以应对过度扩张,2026年上半年伊朗局势与台湾地区军售让步印证了这一趋势。中国则认为西方民主正被民粹侵蚀、东升西落不可逆,DeepSeek与GLM5.2等进展表明技术封锁未奏效。
波波夫在文章中引用Cloudflare联合创始人马修·普林斯的数据称,AI Agent发出的HTML页面HTTP请求占比已达57.5%,人类浏览请求降至42.5%,机器人流量首次超越人类。
OPPO 高级算法工程师刘鹏已确认出席 AICon 上海"Agent 系统架构与工程化实践"专题,分享《从唤醒到陪伴:多模态 Agent 如何重构手机交互范式》。
New Relic 首席技术战略官 Nic Benders 认为,以 dashboard 和 alert 为核心的可观测性已走到尽头,行业正从 instrumentation、data platform 进入 intelligence 时代。
亚马逊云科技中国峰会上提出三层 Agent 治理逻辑:先用 Amazon Quick 统一构建入口实现"企业看得见",再通过 AgentCore 的行为可追溯、Policy 硬拦截和身份识别做到"流程看得清",最后用 Kiro、Release Management、Amazon Continuum 和 Amazon Transform 为关键 Agent 提供可靠性保障。
HashiCorp 发布 Terraform MCP Server,让 AI 助手能够直接对接 Terraform 基础设施。该服务基于 Model Context Protocol,使 Claude、GPT 等 AI 工具可查询和管理 Terraform 资源与状态。
小鹏汽车基于亚马逊云科技 Kiro、Amazon Bedrock 和 Amazon EKS 搭建内部 AI 编程与 Agentic 工作平台"灵犀",实现 AI 代码覆盖率超 70%、700 多个 Skills、14 万多个工作流,SRE 缺陷自动修复从两天压缩到 10 分钟。