OpenAI Jalapeño 跑分公布,推理芯片三条路线开始分化
OpenAI 公布自研推理芯片 Jalapeño 的首批跑分,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值吞吐位置每瓦完成的 AI 工作提高约 1.5~1.9 倍,端到端延迟降低约 1.7~3.6 倍;芯片额定功耗为 700W,这批负载中的持续功耗没有超过 550W。
微信公众号
OpenAI 公布自研推理芯片 Jalapeño 的首批跑分,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值吞吐位置每瓦完成的 AI 工作提高约 1.5~1.9 倍,端到端延迟降低约 1.7~3.6 倍;芯片额定功耗为 700W,这批负载中的持续功耗没有超过 550W。
AI科技评论复盘上周Anthropic与Moderna先后公布的两项AI制药进展,追问AI制药的估值锚点应该设在哪里。
云蝶科技在 WRC 世界机器人大会发布系统级具身大脑 RoboForge 与任务型本体 WING,其团队两篇论文 POLIA 与 Strat-Reasoner 同期发表于 ICML 2026。
AIVA总裁李博在2026世界机器人大会火山引擎具身智能论坛上提出,物理AI的竞争关键不在模型与硬件,而在能否与人建立真实信任,AI汽车比人形机器人更具落地优势。AIVA以“AI定义汽车,先有AI再有车”为理念,与火山引擎从产品定义阶段协同打造AI原生车型,其HMI团队用ArkClaw生成视频Demo、研发团队用Trae重构测试链路。首款车型AIVA ME7将于2026年年内亮相。
乐聚机器人推出面向工业场景的垂域具身智能模型 KUAVO VLA,以通用 VLA 基础模型为起点,用 600+ 小时 KUAVO 同构型真机数据进行中训练,沉淀本体适配、基础操作与 100 个工业共性能力。在 25 项任务评测中,该模型整体任务成功率 48.27%、过程分 74.51%,两项均列第一,较基模 Lingbot-VLA 2.0 分别提升 32% 和 32.45%,部分场景提效约一倍。
华为诺亚方舟实验室发布论文提出 RoboHarness 系统,将 VLA、WAM、RL 策略、TAMP 等独立控制系统封装为可被统一调度的 agentic skills,由 Coding Agent 负责高层决策,不重训底层策略。
第四届 GLOW 2026 于 2026 年 8 月在德国不来梅作为 IJCAI-ECAI 2026 专题 Workshop 举行,由北京航空航天大学、中关村实验室、香港中文大学等机构学者组织。会议围绕未标注数据学习、大模型极低比特量化、跨领域任务执行、大模型评测与 Agentic RL 等方向,讨论有限资源条件下人工智能如何跨越训练环境边界。
IJCAI 2026 收录的 AC²-VLA 提出用动作上下文而非视觉复杂度来调度 VLA 模型的计算,通过认知缓存复用、视觉 token 剪枝和层跳过三个机制统一由 router 调度。
聆动通用在科大讯飞孵化下推出工业具身机器人 LDB01,联合讯飞研究院打造统一多模态具身大模型 iFLYTEK-Embodied-Omni,并已拿到国内首张工业级具身机器人 CR 认证和欧盟 CE-MD 认证。其 LDB 在物流分拣场景正逼近 80-90% 工人人效,平均无故障工作时长不低于 7000 小时,2026 年预计交付约 200 台。
8 月 23 日,奥特曼在 David Senra 的播客中谈到 OpenAI 内部资源取舍,称 Sora 本身是好产品但太吃 compute,同期 Codex 优先级更高,算力和团队投入开始向 Codex 倾斜。
原力灵机通用具身基础模型 DM0.5 在 RoboDojo 评测榜以 24.90 综合得分、19.34% 平均成功率双项第一,模型权重与训练框架全面开源。该榜仿真头部模型平均成功率仅 8.80%、人类专家为 76.03%,而 DM0.5 在 Memory 维度拿到 47.44% 成功率,约为第二名 12.11% 的四倍。
IJCAI-ECAI 2026 闭幕数据显示,中国投稿量突破 4000 篇、占大会总投稿量 60% 以上,注册 669 人排第一,但论文接收率约 13.3%,低于大会平均水平。本届 40% 投稿为 primary paper,较往年的 25% 明显上升,PPI 政策对多投作者从第二篇起每篇收 100 美元。大会宣布 IJCAI 2027 将于 8 月 7 日至 13 日在日本京都举行。
自变量机器人在 WRC 2026 展出 QUANXTA Zero 系列无本体数采方案,包含 G0、G1、E0 三款产品,数据入库有效率超 85%,实测最高采集速度达每小时近百次,效率为传统遥控方式的 2 倍多。该方案从模型训练需求反向定义硬件,配合 DMuon 优化器与 X-Tokenizer,可将简单任务的数据成本整体降低约 60%,并把采集到真机部署的全流程从 6 个月缩短到 3 天。
斯坦福大学助理教授吴佳俊在 IJCAI ECAI 2026 发表「计算机与思想奖」获奖演讲《Building Visual and Physical Intelligence Through Code》,提出把几何、材质、物理规律等经典符号 AI 先验定义为「物理代码」,与基础模型结合。
在 WRC 2026 的圆桌论坛上,王田苗向众擎机器人赵同阳、加速进化程昊、智身科技刘宇龙、优必选焦继超和京东徐磊连提三问,聚焦具身智能万台交付的卡点、通用智能的可靠性以及软硬是否解耦。
WRC 灵巧手展区呈现三个变化:20 个左右自由度的高自由度灵巧手增多,直驱、绳驱、混合驱动三条路线成形;触觉从可选配置变为常规能力,压阻式、电容式、视触觉、霍尔-磁传感四类方案并存。真正走量落地的仍是 6 自由度五指灵巧手,其次是三指灵巧手,中科硅纪今年目标 3 万台年产能中 6 自由度产品预计占七八成。
北京雁栖湖应用数学研究院(BIMSA)副教授王雅晴在 IJCAI 2026 早期职业焦点环节提出「数据高效智能体学习」(DEAL)框架,从经验增强、架构设计与高效学习范式三个方向应对智能体的「数据沙漏」瓶颈。
8 月 22 日,第二届世界人形机器人运动会在北京国家速滑馆开幕,银河通用的人形机器人完成全自主网球对打,与网球名将郑洁对阵,掌握发球、正手、反手、底线调动与网前截击,摔倒后可自行站起继续比赛。
WRC 2026 上,维他动力、宇泛智能、智身科技、云深处等六家四足机器人公司集中展示从表演到作业的落地进展。维他动力推出双足人形 Vbot ATOM,身高 160 cm、31 个自由度,计划 2026 年年底交付;宇泛智能灵猫 Cyvet 实现背越式跳高 1 米、立定跳远近 2 米,量产下线在即。
在 WRC2026“类脑智算”圆桌上,慕尼黑工业大学教授 Alois Knoll 与辉羲智能徐宁仪、沐曦李兆石、英飞凌刘伟、黑芝麻智能杨宇欣等嘉宾判断,神经形态计算不会整体替代现有 AI 体系,而是先从传感器感知、预处理和 System 0/System 1 低层控制等事件稀疏、功耗敏感环节切入。
WRC 2026 上具身数据采集设备明显增多,上游传感器厂商、模型公司、数据公司、灵巧手公司和互联网大厂五类玩家集体入场,数采从本体公司的配套环节变成独立展区。
智谱 GLM 5.3 与 GLM 5.2 在同一题目下从零开发基于 OpenStreetMap 数据的北京国贸至望京 3D 驾驶游戏,两者均端到端完成并支持断网运行,GLM 5.3 用时 50 分 47 秒,快于 GLM 5.2 的 66 分 1 秒。
北京智源人工智能研究院等机构在 IJCAI 2026 发表综述《Towards Automated Kernel Generation in the Era of LLMs》,系统梳理大模型自动生成 CUDA、Triton、ROCm、AscendC 等后端核算子的技术版图。
IJCAI-ECAI 2026 颁出四项论文奖:1990 年的非单调推理论文获 AIJ 经典论文奖,2021 年的 Logic Tensor Networks 获 AIJ 杰出论文奖,2002 年的 SMOTE 获首届 JAIR 时间检验论文奖,2021 年关于二元分类器解释计算复杂性的论文获首届 IJCAI-JAIR 最佳论文奖。
蚂蚁灵波在2026年WRC展示搭载全栈大脑2.0的机器人在上海国大药房门店承担夜班药品分拣,并计划今年采集百万小时数据。其7月发布的LingBot-VLA 2.0等六款具身开源模型预训练数据达6万小时,已适配17个机器人品牌、20种构型。首席科学家沈宇军称具身数据需做到百万小时起步,才可能迎来具身智能的ChatGPT时刻。
WRC 2026 上,具身智能厂商的展示重心从本体 demo 转向大脑能否稳定干活、能否算过账。原力灵机用 DM0.5 泛化模型实现约 2 秒/件的包裹分拣,自变量以 WALL-B 大模型展示翻面分拣,星动纪元则靠全栈自研与广东邮政等落地场景建壁垒。优必选 Walker S2 支持 3 分钟自主换电,银河通用发布推理延迟 0.39 毫秒的 AstraBrain-WBC 0.5 通用小脑模型。
Anthropic 将 Claude Code 原定 8 月 19 日结束的 +50% 周额度加成延长到了 8 月 31 日,文章借此讨论 Agent 长任务的 token 消耗结构。
星动纪元创始人陈建宇在 WRC 2026 提出,世界模型可能成为下一代具身智能核心范式,而非 VLA 的增强模块。他将具身大模型迭代归纳为语言模型加机器人控制、VLA、世界模型三个范式,并称团队 2024 年发表全球首个融合视频预测与动作预测的世界动作模型,比英伟达类似方案早约一年。其全直驱灵巧手每秒可点击 10 次鼠标,负载达 24 千克。
星海图联合创始人高继扬在 WRC 2026 提出,具身智能商业模式将走向以「物理世界 Token」销售为主体,整机毛利率从当前 40%-60% 降至方案订阅阶段约 20%,最终可能沦为负毛利载体。
亚利桑那州立大学助理教授魏华在 IJCAI 2026 演讲中提出,基础模型智能体的可靠性问题本质上是强化学习中的「仿真到现实」差距,跨语言场景即对应观察差距。其团队将机器人领域的域随机化技术引入大模型智能体,经提示词、动作与奖励空间扰动后,3B 参数模型在跨语言任务上表现击败 32B 模型。他还强调不确定性量化与人类在环,让机器知道何时该向人类求助。
纽约大学阿布扎比分校与阿布扎比克利夫兰诊所团队在 ACL 2026 Findings 发布首个多语言医疗错误检测、定位与纠正评测基准 MedErrBench,覆盖英语、中文、阿拉伯语和十类医疗错误。
在2026世界机器人大会上,宇树科技创始人王兴兴提出具身智能大爆发的量化临界点,即机器人能在80%左右陌生场景中通过语音指令完成80%左右的任务。他还介绍正在预研的物理AI机器人自进化路径,用前沿大模型串联论文检索、代码生成、仿真训练、真机测试与评价反馈形成闭环。演讲中他展示了语音驱动的AI动作生成、会议室整理等演示,并提到最新一代轮足复合四足机器人Unitree As2-W。
无界动力自研具身通用大脑 MWA™ 在斯坦福等发起的 RoboCasa GR1 TableTop 榜单上霸榜全球第一,该大脑采用"隐空间世界模型+强化学习"双轮驱动,而非主流 VLA 直连路线。
鹿明机器人推出 NexCore 平台,将模型封装为机器人技能,打通数据采集、治理、训练、技能生成、评测到部署的完整闭环。该平台支持本地部署并兼容非鹿明生态机器人,让工厂自行开发专属技能。鹿明与三菱电机从 PLC 质检起步,逐步拓展至推料箱、打螺丝、搬运等任务,后者由客户转为投资人。
李飞飞押注的空间智能被视为世界模型主流路线之一,其核心是把 AI 从识别二维画面推进到生成可进入、可操作、可持续编辑的三维世界,World Labs 将其功能拆为 Renderer、Simulator 与 Planner。
IJCAI-ECAI 2026 研究卓越奖授予英国拉夫堡大学校长 Nick Jennings,其获奖演讲《智能体AI的过去、现在与未来》指出,当下热议的智能体AI并非新概念,而是积累数十年的研究路线。他引用 2026 年 Gartner CIO 调查称,仅 17% 组织已部署 AI 智能体,但超 60% 预计未来几年内部署,并强调现实系统本质上是多智能体系统,社会交互长期被低估。
阿里于 8 月 14 日开源 Qwen3.8-27B,该模型随后成为 Hugging Face 上排名第一的热门模型,4bit 量化后约 17.1GB,一张 24GB 显存的 RTX 4090 或 3090 即可装下。
Cursor 开始向全部付费计划逐步开放 Origin early beta,把 repository、PR、checks、review、merge 和 Automations 放进同一套体系,定位是面向 agent scale 的代码托管。
第 35 届 IJCAI-ECAI 2026 在德国不莱梅开幕,斯坦福助理教授吴佳俊获「计算机与思想奖」,表彰其在计算机视觉、生成式 AI 和机器人技术领域的奠基性贡献。大会今年新设的 JAIR 时间检验奖首届颁给 SMOTE 论文,该工作以特征空间插值生成少数类样本,成为处理数据不平衡的基础方法。本届共接收论文 858 篇,主赛道接收 713 篇(有效评审投稿 5233 篇)。
中山大学团队提出 SpatialSV,通过从 MLLM 中间隐藏层提取特征并预测深度图、射线图和点云图,将 2D 视觉特征提升为显式 3D 几何表达,训练后卸载全部 3D 预测头,推理零额外延迟。在 Qwen2.5-VL-3B 上仅保留 50% 文本标注时,加入自动生成的 3D 几何监督后空间问答准确率从 47.2% 回升至 53.9%,接近全量标注的 55.3%。