视觉失效之后,触觉如何补上具身智能的「最后一厘米」?| GAIR Live 032
GAIR Live 032 圆桌邀请模量科技高立波、超维传感李炎辉、千觉机器人赵浩南,讨论具身智能从视觉主导转向视触融合。赵浩南称没有触觉的灵巧手只是"高级夹具",视觉在最后一厘米存在遮挡、状态感知缺失和高频反馈迟滞三大局限。高立波透露模量科技已实现每平方厘米近 400 个集成单元,正向 1000 个单元冲刺。
按公众号阅读文章与观点
GAIR Live 032 圆桌邀请模量科技高立波、超维传感李炎辉、千觉机器人赵浩南,讨论具身智能从视觉主导转向视触融合。赵浩南称没有触觉的灵巧手只是"高级夹具",视觉在最后一厘米存在遮挡、状态感知缺失和高频反馈迟滞三大局限。高立波透露模量科技已实现每平方厘米近 400 个集成单元,正向 1000 个单元冲刺。
南洋理工大学李搏扬团队用数学分析找出 MTS(Meta-learning for Training-data Selection)失效的两大根源:选择网络梯度信噪比(GSNR)比主网络低约一个数量级,且输入特征不足以判断数据质量。
沐曦在WAIC展台中央留出位置给龙蜥、vLLM、PyTorch基金会、SGLang等十个开源社区,并首次亮相曦景S600超节点(单机柜64张GPU、可扩展至万卡集群)和曦索X300系列科学智能GPU。其自研全栈计算软件MXMACA已开源53个软件仓库,占软件栈15%到20%,并成为首家与vLLM官方签署合作协议的中国芯片企业。
7月16日晚,安徽开润股份发布投资进展公告,其全资子公司宁波浦润出资4000万元认购的砺思星灵基金,将29亿元实缴资金全部间接投向DeepSeek,获得0.8265%股权,按此计算DeepSeek估值约3508.8亿元。
推荐理由:通过上市公司公告可推算DeepSeek估值约3509亿元,并呈现同一轮融资两个估值口径的差异。
《人工智能拟人化互动服务管理暂行办法》落地后,优必选仿生机器人在官网、产品页均查不到未成年人模式、历史交互数据删除和退出路径说明,京东客服确认"无"未成年人模式。新规要求拟人化 AI 服务落实未成年人保护、数据权益与退出机制,企业若未公开披露相关治理信息,即便内部已实现也构成合规漏洞。
台积电2026年第二季度净利润同比增长77%、毛利率67.7%,并将2026年全年资本开支指引从520至560亿美元上调到600至640亿美元,但其美股股价下跌2.32%。存储板块同步下跌,SK海力士跌13.69%、美光跌5.65%、闪迪跌12.63%。文中认为资本开支作为AI投资估值锚开始松动,下一个锚点将转向盈利兑现速度能否匹配资本开支。
AI 字幕与 ChatGPT 等大模型普及后,翻译行业订单缩减、单价下滑,95% 的普通笔译工作 AI 都能完成,口译订单减少至少 20%。笔译高端订单从每千字 350 至 500 元降至大部分客户仅接受 150 至 200 元,新人因无项目经验陷入"无经验-不选用-简历空白"的闭环。从业者转向医疗翻译、药企合规等专业赛道,或仅接高单价订单维持收入。
阿里巴巴达摩院提出并开源数字遥操作方案 RynnWorld-Teleop,用生成式世界模型替代真实机器人完成视觉演示,同时自动输出关节级动作标签。
普渡机器人在WAIC首次亮相类人形机器人PUDU D7,并披露自研具身智能大模型PuduFM与具身智能操作系统PuduAgent,共同支撑其「一脑多形」战略。PuduFM由PIM、VLA和World Model三个组件构成,借助「虚实双闭环」机制,仅需50条专家示范数据即可完成新任务适配。目前普渡机器人已在全球85个国家和地区部署超13万台机器人,覆盖16个行业。
蚂蚁灵波过去一周连续发布并开源 LingBot 全栈 2.0 六款基础模型,压轴推出业界首个具身原生世界动作模型 LingBot-VA 2.0。7月19日 17:30-20:00,蚂蚁灵波联合量子位在上海世博天地 AOKKA Coffee 举办 LingBot 2.0 发布后主创团队首次公开亮相的 WAIC After Party。
逛完WAIC 2026后,国产AI芯片的真正对手被指向CUDA而非英伟达GPU。以清微智能为样本,其可重构架构将有效晶体管利用率从不足40%提升至70%以上,4K超节点用Mesh网络组织4096颗芯片,互联成本较国外同类方案降低约90%。RAISA软件栈已支持近千个主流算子、完成超200个大模型适配,部署及在建算力规模超5000 PFLOPS。
支付宝以 AHA(Agent Hub Access)把自家服务能力开放给终端智能体,OPPO 小布与阶跃 STEPX 已通过端侧互联调起支付宝阿宝办事。该方案不做云端 A2A 互联,而是让同一台手机上两个 App 的智能体直接进程通信,身份、资金、责任问题各留在原地,支付与授权仍由用户本人确认。
面壁智能联合东北大学-面壁智能数据智能联合实验室、清华大学 THUNLP 实验室、OpenBMB 与 AI9Stars 开源数字员工全流程构建与管理平台 StaffDeck。
中数睿智在WAIC期间发布"AI for Reasoning"因果智能体系及《因果世界模型技术体系蓝皮书》,该体系已在35家以上大型央国企投产,累计安全运行超15000小时,覆盖800余个核心业务场景。实测显示,其在油气钻井井控场景可将溢流、气侵等危险工况预警窗口提前约15至20分钟,复杂工况根因定位准确率约94%,并过滤40%以上无效误报。
阶跃星辰与千里科技在WAIC 2026联合发布汽车超级智能体,搭载阶跃最新Agentic模型Step 3.7 Flash,总参数196B、推理激活仅11B,400TPS响应,编程能力达Claude Opus 4.6的97%,任务成本仅为其九分之一。该端侧模型可在车机本地运行,弱网环境下仍实时在线。千里科技智驾系统已覆盖50多万辆车,辅助驾驶激活率达92%。
上海交通大学牛力实验室提出 ICRDrag,一个基于 DiT 架构的上下文区域拖拽模型,用成对掩码实现高精度图像局部编辑,论文入选 ECCV 2026。该模型支持最多 5 对源/目标区域协同与锚点锁定,并基于百万级视频数据集 OpenVid 构建了 28.7 万组配对样本的 PRD 数据集及 1000 组样本的 PRDBench 评测基准。
国民健康“十五五”规划提出控制三级医院规模,严禁公立医院超规划建设和违规举债建设,超大特大城市中心城区、省会城市核心区新增床位也被严格限制。2025年全国医院3.8万个,比上年减少近1000家,减少的几乎都是民营医院,民营医院从2.7万家降至2.6万家。资产负债率高于80%、床位使用率低于75%且平均住院日高于9天的公立医院,原则上不再新增床位。
小鹏 MONA L03 在慕尼黑完成全球上市,起售价 12.38 万元人民币,未来计划进入全球 65 个国家和地区销售。Ultra SE 版采用双图灵 AI 芯片,整车算力达 1500TOPS,Max 版搭载单颗图灵 AI 芯片、算力 750TOPS,而特斯拉 Model Y 为 720TOPS。
昆仑万维官宣天工AI业务ARR突破8亿美元,其中约7亿来自短剧C端充值,2025年年报披露时ARR约4亿美元,半年近乎翻倍。公司2024年、2025年连续亏损,2026年Q1再亏8.87亿元,旧估值锚失效后市场开始尝试用P/ARR为其AI业务定价。
文章提出,AI正以"永不撒手的帮助"取代成长所需的适度挫折,让人在表现更好的同时逐渐丧失独立判断。作者引用哈佛商学院与波士顿咨询对758名顾问的实验:使用GPT-4者多完成12.2%子任务、速度快约四分之一、质量提高约三成;并借2024年《科学进展》293篇微型故事实验指出,使用AI的作品彼此更相似,形成"高概率走廊"。
AI科技评论以开源框架 OpenHands 为执行环境、经 OpenRouter 接入 Hy3、GLM-5.2、DeepSeek-V4-Pro 三个裸模型,跑同一组三道题并由 Claude Opus 4.8 盲评。
OpenAI Codex 负责人 Tibo 在 X 上发起活动,用户发推文谈喜欢 GPT-5.6 Sol 或从 Claude 换到 Codex,审核通过即获 100 美元积分,限前 1 万人。活动条款写明提交即永久授权 OpenAI 在付费广告中使用推文和 X 账号名。文章还提到 Codex 周活跃用户从今年 1 月不到 100 万涨到活动后的 900 万。
2024 图灵奖得主理查德·萨顿在 2026 世界人工智能大会主论坛演讲中指出,当前大模型仅靠拟合人类历史数据进行模式识别,算力规模并不等于原生智能,且因缺乏目标与奖励信号而无法校验信息真伪。他认为静态标注数据时代已达极限,AI 正迈入智能体从第一视角经验中自主学习的“经验时代”,这才是通往 AGI 的必由之路。
21 岁的戴灏庄创办 Nile,为独立站品牌搭建面向 Agent 电商的基座,从 AI 原生商品信息、销售归因到私域个人 Agent 三方面重建商家系统。
Kimi K3 以 1679 分登顶 Arena 前端代码/Web Dev 榜单,力压 Fable 5 达 48 分,高于 GPT-5.6 Sol 61 分,官方博客坦承整体性能仍落后于最强的闭源模型。
Kimi K3 发布,成为全球第一个开源的3T级别大模型,在 Frontend Code Arena 排名第一并大幅领先 Fable 5。其编程能力在 DeepSWE 拿到 67.5 分,SWE Marathon 42.0 分为所有模型最高,48 小时自主完成一颗 45nm 芯片的设计优化与验证,并从零构建了名为 MiniTriton 的 GPU 编译器。
推荐理由:原文给出前端、编程与芯片设计等多维实测对比,读者可据此判断这款开源大模型的性价比与能力边界。
IDC 发布《中国AI编程市场份额,2025》报告,阿里 Qoder 以 47.6% 的营收份额位居中国 AI 编程市场第一,超过第二至第五名总和。报告显示 2025 年中国 AI 编程市场规模为 3.99 亿元,预计 2026 年底增长至 11.73 亿元。Qoder 于去年 8 月发布,今年 5 月上线 1.0 版本,用户规模已达 500 万。
量子位公布 WAIC 2026 全周期活动安排,7月17日至20日驻扎上海世博展览馆 H1-A134 展位,并于7月17日至19日开启专属探展直播。7月17日晚19:30 在黄浦江边举办闭门交流"真话局",议题为"AI聪明够了,行动呢?"。LingBot 团队将在本届 WAIC 首次集体公开亮相,7月19日18:00 举办闭门沙龙拆解 LingBot 2.0 版本研发故事。
月之暗面发布旗舰模型 Kimi K3,在 Arena 前端代码/Web Dev 榜单以 1679 分登顶,领先 Fable 5 48 分、高于 GPT-5.6 Sol 61 分。
推荐理由:Kimi K3 登顶 Arena 前端榜单并提价近 4 倍,读者可对照其稀疏 MoE 架构与真实任务成本的差异。
Decagon CEO Jesse Zhang 发文称,开源模型正在崛起,但企业市场对开源模型的支出占比反而在下降。Vercel 的 AI Gateway 仪表盘显示,过去一周 DeepSeek 的 Token 处理量升至第一,已占平台总 Token 流量三分之一以上,但 Anthropic 仍占该平台 AI 总支出的半数以上。
马斯克确认 Grok Build 已以 Apache 2.0 许可证开源,GitHub 上线不到 20 小时获得 1.21 万颗 Star,代码库含 844,530 行 Rust 代码。
推荐理由:原文把网络层测试证据与开源代码细节放在一起,读者能看清整库上传机制目前只被服务端开关暂时关闭。
谷歌宣布 AlloyDB AI 函数正式可用,并推出智能批处理与代理模型两项加速技术。智能批处理把多行数据合并为单次模型调用,谷歌内部测试最高每秒处理一万行,较逐行处理提升 2400 倍;代理模型先用样本在数据库内训练轻量本地模型执行 ai.if 查询,内部测试每秒十万行、吞吐提升 23000 倍、成本降至 1/6000,但该优化尚处预览阶段。
阶跃星辰 7 月 13 日发布终端品牌 STEPX、智能体操作系统 Step AOS、个人智能体 Amoo,并让首款智能体手机 STEPX Neo 亮相。该机未公布芯片、屏幕、电池、价格和上市日期,现阶段更像战略样机,用于验证模型、系统与终端闭环。阶跃此前完成超 50 亿元 B+ 轮融资,并推进赴港上市。
EgoScale 创始人袁日正称,国内真正能规模化交付 Ego 数据、被头部客户验收的团队不超过 5 家,EgoScale 交付量稳居前三。其自研双目相机帽子采集设备,月周转 1500 名采集员、全职团队不到 20 人,有效采集率达 80%,上个月完成 1.0 自动化,本月中将完成 2.0。
中山大学与 X-Era AI Lab 团队发现,VLA 模型在新视角、光照、纹理和传感噪声下的脆弱性主要来自空间建模错位,而非物理推理能力缺失。其 one-shot 鲁棒适应框架 FTM 仅用约 4K 参数,就把 LIBERO 新视角任务成功率从 48.5% 提升到 87.1%;FLA 用约 4.7M 参数达到 90.8%,参数量比 LoRA 基线减少约 99 倍。
KIMI K3 发布,Web 与 Desktop 端已上线 K3 Max、K3 集群·Max 和百万上下文,作者实测其在编码与 Agent 任务上与 Fable5、GPT-5.6 Sol 有来有回。
作者观察到推特时间线被 Kimi K3 刷屏,Kimi K3 在 Frontend Code Arena 排行榜上排名第一。此前海外常将中国模型的进步归因于蒸馏美国模型,如今评论区出现“从明年的美国模型蒸馏”等调侃;作者还提到自己首次将国内模型与 Claude 4.8 做了对比测试,称与 Opus 4.8 打得有来有回。
Kimi K3 上线后,作者用四个高难度前端场景与 Claude Opus 4.8 做一次性生成对比,结果互有胜负。K3 采用 Kimi Linear 混合线性注意力架构,支持 1M 上下文、参数量 2.8T,在视频还原等任务中体现出多模态优势,且为开源模型、价格在 Sonnet 级别。作者用同一套提示词与 GPT-5.6-Sol 对比后发现,5.6-Sol 效果更好。
月之暗面发布 Kimi K3,这是一个总参数 2.8T 的 MoE 开源模型,官方称其整体仍落后于 Claude Fable 5 和 GPT-5.6 Sol,但稳定超过其他所有模型。
推荐理由:官方给出了与 Fable 5、GPT-5.6 Sol 的评测对比和定价,读者可据此判断开源模型当前的位置与使用成本。
AI科技评论独家获悉,智谱以数亿元人民币收购 AI Infra 公司中科加禾,试图补齐模型底层工程能力短板。中科加禾聚焦编译技术,技术源头为中科院计算所编译实验室,其团队曾参与龙芯、神威、寒武纪、华为昇腾等国产芯片编译器研发,其 SigInfer 推理引擎宣称可将大模型推理时延最高降低 74 倍、吞吐率最高提升 3 倍、能效比提升 1.46 倍。