谷歌DeepMind发布Gemini Robotics 2系列,实现机器人全身控制
谷歌DeepMind发布Gemini Robotics 2系列三款机器人模型,其中Gemini Robotics 2是负责全身移动与多指灵巧操作的VLA模型,Gemini Robotics ER 2作为高级大脑负责理解指令、拆解多步骤任务并跟踪进度,Gemini Robotics On-Device 2则可在机器人本地运行。
微信公众号
谷歌DeepMind发布Gemini Robotics 2系列三款机器人模型,其中Gemini Robotics 2是负责全身移动与多指灵巧操作的VLA模型,Gemini Robotics ER 2作为高级大脑负责理解指令、拆解多步骤任务并跟踪进度,Gemini Robotics On-Device 2则可在机器人本地运行。
OpenAI 下调 GPT-5.6 系列 API 价格,入门款 Luna 最高降价 80%,每百万 Token 输入价格从 1 美元降到 0.2 美元、输出从 6 美元降到 1.2 美元。
推荐理由:降价最狠的 Luna 定位在高频 Agent 任务,读者可据此判断智能体长期运行的成本门槛变化。
微软 FY2026 Q4 营收 900 亿美元、净利润 358 亿美元,同比分别增长 18% 和 31%。财报显示对 Anthropic 的投资本季带来 32 亿美元收益、每股增益 0.33 美元;对 OpenAI 的投资因资本重组使账面起伏,本季贡献 4.8 亿美元净收益、全年约 50 亿美元。
在 YC 7月28日发布的访谈中,Claude Code 负责人 Boris Cherny 建议每六个月删掉 Claude.md、skills 和 hooks,把系统提示词全删掉再一行行加回,以消融实验的方式验证每一行的作用。
无问芯穹首次公布跨集群异构推理架构PDD,将传统PD分离解构为Prefill-RelayDecode-MainDecode三级结构,用中继实例掩盖以太网下KV Cache传输延迟。
被 ECCV 2026 录用的 SemVID 提出一种 training-free token 剪枝框架,通过显式保留 Object、Motion、Context 三类语义角色 token 来维持支撑视频时序定位(VTG)的证据链。
OpenAI 在 GPT-5.6 技术报告中披露,GPT-5.6 已被投入真实生产环境,用于分析线上流量、调整请求路由、通过 Codex 改写生产环境中的 Triton 和 Gluon Kernel、为推测解码设计 draft model 方案并自动运行数百次实验,使端到端服务成本降低 20%,Token 生成效率提升 15% 以上。
Google DeepMind 已不再将 AlphaFold 作为独立团队,原成员被分流到 Gemini、AI 编程、基因组、蛋白质与酶设计、核聚变等项目,部分人加入 Isomorphic Labs 或离开。
UIUC DREAM Lab与亚马逊的研究提出SECFID基准,发现提示词注入防御中安全性与忠实度无法兼得。团队在48种模型与防御配置上评测,强防御可达99%安全率,代价是丢掉近30%数据;SECFID将模型反应区分为执行、作为数据处理和忽略三种行为。
高通委托IDC发布《从AI设备到个人AI》白皮书,提出以智能体为核心载体、以用户为中心运行的"个人AI"范式,并给出端边云分布式计算解法。白皮书显示,今年上半年全球智能手机出货量同比下滑13.9%,但AI手机占比已达66.4%。高通以个人知识图谱、传感器中枢及CPU/NPU/GPU协同方案对应个性化服务、全时感知等五大特征。
量子位报道,Matt Shumer 的 Opus 5 游戏提示词「挑战循环」在 X 上走红,做法是主 Agent 拆解任务、子 Agent 分头制作,再由评委 Agent 与真实 3A 游戏盲测并排对比,画面不达标就返工重做。
vivo 蓝图实验室提出全自动摄影图像增强框架 SmartPhotoCrafter,用户只需输入一张照片、无需任何修图指令,模型即可自主分析图像质量并推理优化策略。
深信服公布其 AI 安全智能体 Sangfor AI 在 CyberGym 评测中的成绩:基于国产大模型 GLM-5.2 的固定配置,在涵盖 ARVO 与 OSS-Fuzz 的 1507 项漏洞挑战任务中完成 1301 项,整体成功率 86.3%,位列全球前四、国内参评团队第一。
World Labs 发布机器人策略训练与评估引擎 R2S2R,打通了从仿真训练到真实运行的闭环。该引擎由 Real-to-Sim 和 Sim-to-Real 两部分组成,可把真实机器人、传感器、物体和交互过程重建为可交互虚拟世界,再在其中规模化训练与评估策略并部署回真机。
萝卜快跑获香港运输署批准,7月27日起在机场岛开展车内无安全员的全无人测试,成为右舵左行交通体系中首个获批全无人测试的Robotaxi企业。它随后宣布携手Uber和Lyft旗下Freenow在伦敦启动公开道路测试,首期落地布伦特行政区,预计2027年起面向市民提供无人驾驶出行服务。Waymo也已在伦敦启动有专业人员随车的测试,两者首次在同一海外城市、同一套右舵规则下竞争。
词元无限(Tokens Infinity AI)成立一年内连续完成三轮融资、总额数亿元,最新一轮由临芯投资领投、华控基金继续加码。
openJiuwen 社区联合华为终端平板与PC产品线等团队发布 JiuwenSwarm 蜂群智能体的鸿蒙PC版本,称其为首个面向鸿蒙PC的开源AI统一工作台。
Google、哥本哈根大学、牛津大学等机构提出 VGGRPO(Visual Geometry GRPO,收录于 ECCV 2026),在隐空间用 4D 几何奖励对视频扩散模型做后训练,无需修改架构或反复 VAE 解码。
贾扬清离开英伟达后再创业,成立 Intent Lab,推出定位为把意图转化为生产级软件的自主智能体系统 Fleet,首批公布三项成果。其中 GPU 推理引擎由一句话意图生成,在 TensorRT-LLM 上完成内核、运行时、通信和投机解码四类优化,在两台 Grace Blackwell 节点上把输出速度从 102 tokens/s 提升到 647 tokens/s。
近十家 AI 公司、超过 1100 名员工联名发表公开信《Pacing the Frontier》,请求美国推动国际合作、配套技术工具与治理规则,在风险临近时主动放缓自动化 AI 的研发进度。
研究团队提出面向复杂多参考图像生成的动态优化框架 DyRef,该工作被 ECCV 2026 接收并选为 Oral 报告。团队同时构建 OmniRef-Bench,包含395个专家标注样本,覆盖主体、背景、风格、光照、姿势5类参考类型,每个样本含2到7张参考图。
腾讯生命科学实验室与中南大学联合研究的 UniPert–G2CP 虚拟细胞算法登上《Cell》主刊,该算法从基因扰动信息出发预测化合物在特定细胞背景下的表型响应。研究将基因扰动剂与化合物扰动剂纳入同一语义空间,并以4994个基因、7860个化合物和5个癌症细胞系等公开数据建模。团队计划将其作为核心能力集成到即将发布的AI生命科学Agent平台,以Skill形式服务实验科学家。
微软CEO纳德拉在CNN《Fareed Zakaria GPS》节目中警告,企业若把数据、记忆和AI使用记录的控制权交给单一AI供应商,会因难以迁移而在对方涨价、停服或能力掉队时失去自主。
火山引擎把豆包 APP 的搜索能力单独拆出,面向企业和开发者开放,支持通过 API、MCP、Skill 接入更多模型和 Agent,每月赠送 500 次免费搜索额度,并支持按量后付费和订阅月卡。
蚂蚁 inclusionAI 团队开源千亿参数 MoE 扩散语言模型 LLaDA2.2,原生支持 128K 上下文,并称其为全球首个大规模 Agentic 扩散模型。
英伟达与 Ilya Sutskever 创立的 SSI(Safe Superintelligence Inc.)宣布结为长期战略合作,英伟达将授予下一代 Vera Rubin 平台的使用权,预计未来一年内把 SSI 的算力规模提升 10 倍。
智在无界(BeingBeyond)发布 Being-H0.8,称其为首个基于人类视频数据的隐式触觉世界动作模型,把触觉放入预测—执行—反馈链路,先预判接触再依触觉反馈调整动作。
斯坦福经济政策研究所发布政策简报指出,暂无足够证据表明AI正在造成大规模失业,受AI影响最高与最低职业的失业率分别上升0.77和0.85个百分点。但2026年初美国应届毕业生失业率达到5.6%,比三年前上升1.6个百分点,在软件开发、客户服务等AI高暴露职业中,年轻员工就业人数明显下降而资深员工基本稳定。
Thinking Machines 联合创始人翁荔宣布,明天是她在该公司的最后一天,理由是工作强度太大、身体撑不住。此时距公司首个开源模型 Inkling 发布刚过去12天,她加入公司约20个月。她表示仍然喜欢读论文追前沿,但想去一个更可预期的地方、做边界更清楚的角色,不再担任联合创始人;Mira Murati 和现任 CTO Soumith Chintala 等人在 X 上留言送别。
月之暗面开源 Kimi K3 的模型权重和技术报告,2.8 万亿参数 MoE,具备原生视觉理解能力,支持 100 万 token 上下文窗口。
推荐理由:权重、技术报告与训练 Infra 一并公开,呈现 2.8 万亿参数 MoE 从架构到线上服务的工程链路。
陶哲轩在ICM大会演讲《Mathematics in the age of AI》中提出,数学正从「证明稀缺」进入「证明过剩」时代,并把AI带来的冲击拆成生成、验证、表述、发表、正典化五段流水线,认为每一环都会出现「证明消化不良」。
有人拿 FrontierCode 编程基准把 Opus 5 的推理档位从低到高扫了一遍,发现性能天花板不是拉满的顶配档位,medium 才是顶峰。档位越高只代表推理预算越大,信息提取、分类这类边界清晰的简单任务上 low 和 high 输出质量几乎无差别,代码场景拉高强度后模型还会擅自重构无关函数、调整导入、重命名变量。
Anthropic 宣布为 Opus 5、Fable 5 等模型删掉超过 80% 的系统提示词,网友陈成(@chenchengpro)实测却发现 Opus 5 真正收到的系统提示词比 Opus 4.8 增加约 72%。
黄仁勋发起的开源倡议公开信签署方已从首批约25家扩大到70多家,OpenAI 也加入其中,Anthropic 成为主要未签署方。Anthropic 技术人员 Julian Schrittwieser 在 X 上反讽回应,提议英伟达也应开源 CUDA 和 GPU driver,吴恩达则为黄仁勋辩护称每个人都有权不公开自己的代码。
香港科技大学(广州)、南洋理工大学、阿里巴巴集团和其域创新科技联合发布《3D Gaussian Splatting Rasterization: A Survey》,以可微光栅化器为核心重新梳理 3DGS 技术版图,并在 Mip-NeRF 360、Tanks&Temples、Deep Blending 的 11 个场景上统一评估 27 种代表性方法。
中国科学院计算技术研究所"知境"团队发布社会心智大模型技术体系,含评测基准 SoMBench、训练方法 Zing 与部署架构 Actio。Zing-27B 在 5 项国际社会心智评测上综合均值 79.80,超过 GPT-5.5 的 78.44;Zing-32B 综合均值 76.32,略超 DeepSeek-V4-Pro 的 75.90。
飞书深诺于7月23日将出海营销 AI 产品 Marvy 升级至 2.0,把市场洞察、媒体策略、智能创意、智能投放和数据分析五大 Agent 放进同一套 AgentOS,由 Supervisor Agent 拆解任务并交叉验证。官方数据显示,某消费电子品牌尼日利亚项目中整体优化效率提升74%、人工耗时减少89%,创意预测准确率最高达95%以上。飞书深诺还计划推出更轻量的 Marvy Lite。
中国信通院与腾讯在 2026 世界人工智能大会共赢金砖论坛上发布 AI 航海家+,首批 22 位智能体专家覆盖巴西、阿联酋、埃及、新加坡、印度尼西亚、马来西亚、泰国七个国家,服务战略顾问、市场营销、财税金融、法务合规等环节。该产品基于信通院国别专业语料与腾讯 WorkBuddy 多智能体平台,已在 WorkBuddy 国内版和国际版(workbuddy.ai)同步上线。
据彭博报道,DeepSeek已口头通知部分潜在投资方,原本预计未来几天签署的第二轮融资投资协议暂不签署。该轮计划至少募资100亿元,投前估值不低于4800亿元,约合710亿美元,较首轮约500亿美元估值上涨约四成。融资并未正式终止,未来仍可能重启,知情人士称此次暂停部分与融资接洽中出现的信任问题有关,DeepSeek仍在为扩充算力等业务扩张寻求资金。
李飞飞、Trevor Darrell、Jitendra Malik 等人参与的 T-Rex 论文提出面向灵巧手的触觉架构,在 12 项真实世界灵巧操作任务上平均成功率达 65%,比最强纯视觉基线的 35% 高 30 个百分点。