哥大李昀烛团队 FlexiTac 开源柔性触觉传感器进展:3 分钟组装,ADI 推进商业化
哥伦比亚大学李昀烛团队在 IROS 2026 介绍了开源柔性压阻式触觉传感器平台 FlexiTac 开源一年半后的进展,该传感器 3 分钟即可组装完成,可弯曲裁剪并适配手套、指尖或机器人皮肤等形态。团队已将其集成进 LeRobot 框架,并与 Analog Devices(ADI)合作推进商业化版本,该版本触觉分辨率达人类手指的五倍,基于半导体制造工艺量产。
微信公众号
哥伦比亚大学李昀烛团队在 IROS 2026 介绍了开源柔性压阻式触觉传感器平台 FlexiTac 开源一年半后的进展,该传感器 3 分钟即可组装完成,可弯曲裁剪并适配手套、指尖或机器人皮肤等形态。团队已将其集成进 LeRobot 框架,并与 Analog Devices(ADI)合作推进商业化版本,该版本触觉分辨率达人类手指的五倍,基于半导体制造工艺量产。
斯坦福大学助理教授吴佳俊在 IROS 2026 的 RoBoWoMo 研讨会上发表题为《Building Physical Agents via Structured Representations》的报告,提出用可学习的领域专用语言(DSL)描述任务,让基础模型自动发现谓词与原子动作及其前置条件、后置效果。
AI科技评论长文复盘AMD以约82亿美元全股票收购李飞飞创立的World Labs,交易后李飞飞出任AMD执行副总裁兼首席科学家,直接向苏姿丰汇报。文章梳理李飞飞从ImageNet、AI民主化到空间智能三次"挖坑"的角色变化,指出World Labs以2026年2月C轮54亿美元估值被溢价约52%收购,并以MI450性能提升和生态牵引作为检验这笔交易成败的标准。
推荐理由:原文把李飞飞三次出题与这次亲自答题放在一条线上梳理,并给出用 MI450 性能和生态牵引检验收购成败的具体标准。
Sharpa 在 IROS 2026 发布三款自研硬件:一体式触觉感知机器人本体 D01、全触觉灵巧手 W02 和外骨骼触感数据手套 AE01。D01 手臂载荷自重比接近 1:1,末端速度超 10.5 m/s,通信频率 1000 Hz,电子皮肤支持 100 Hz 触觉采样和 0.2 N 力分辨率。
Anthropic 发布 Claude Sonnet 5.5,API 单价不变、生成更快,Terminal-Bench、CursorBench 成绩明显上涨。Lovable 测试中 Tool Call 减少约三分之一,Shell Run 接近减半,Base44 应用构建平均迭代从 7.7 次降到 3.6 次。
推荐理由:文章把 Lovable、Base44 的运行数据与 Agent Runtime 工程分析结合,指出 Token 之外更应关注工具边界和执行图成本。
具身智能行业的数据竞争正从比拼「积累多少小时」转向追问「新增数据带来多少能力增益」。无问智科以「世界模型×数据工厂×世界模拟器」构建 Real2Sim2Real 虚实融合闭环,其 Raw Data 到 Model-Ready Data 处理效率提升 500% 至 1000%,Sim-Ready 资产构建从 3 天缩短至 5 分钟。
文章分析 AI for AI 如何重构大模型研发,指出中训练与后训练因实验周期短成为 AI 最先落地的环节。
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,把语音、视觉、推理和 Tool Calling 放进同一条持续运行的链路。
推荐理由:文章从异步 Tool、KV Cache 和调度角度拆解实时语音会话背后的系统问题,读者可以迁移到自己的 Agent Runtime 设计。
斯坦福助理教授吴佳俊在 ECCV 2026 演讲中提出,机器人行动的关键是获得结构化的世界表示,把复杂操作拆解为可验证、可组合的原子技能。他介绍了用状态、动作及二者关系构建组合式抽象的方法,并类比 Claude Code 在物理世界中的规划与验证,还提出 Neural Kinematics 让机器在无演示时从物体本身推断交互方式。
斯坦福大学助理教授吴佳俊在 ECCV 2026 演讲中提出,视觉、听觉、触觉是同一组物理属性在不同感官通道上的投影,主张用几何、材质、刚度等物理属性为多模态融合建立共同坐标系,而非直接拼接后喂给 Transformer。
慕尼黑工业大学 Angela Dai 教授在 ECCV 2026 提出以逆向自监督(SG-NN)将物理遮挡转化为结构先验,替代在 3D 场景重建中失效的 2D 去噪范式。
视触觉传感器常被质疑是「摄像头+硅胶」容易复制,但商用产品在凝胶配方、光学校准、批量一致性和软件栈上要求极高。戴盟、一目、千觉、纬钛等厂商已把帧率做到120-400Hz,防护达IP54至IP67,一目更将厚度压到3毫米。戴盟Daimon-Infinity开源1万小时触觉数据,千觉TacVerse 1k为首批1000小时真实交互数据。
NUS Show Lab 在 ECCV 2026 披露 Show-o 系列成果,首次将自回归与离散扩散融合进单个 Transformer,文本用自回归、图像视频生成切换至离散 Token 扩散模式,十几步迭代即可恢复完整视觉 Token。团队以循环一致性监督实现无标注数据的自监督进化,并用自研 Q1 实时骨干网实现远超前沿闭源大模型的推理速度,同时推进 VLA、世界模型与云端加端侧的具身落地。
清华大学朱军团队提出通用世界模型(GWM)框架,按理解、想象、行动三大认知能力划分世界模型,并给出五级进化路线图,与李飞飞团队的《A Functional Taxonomy of World Models》功能分类法形成互补。
光象科技在 ATC 上海国际汽车技术及零部件展览会上,将工业级具身机器人 Phi-Bot X1 放入蔚来焊接上下料场景,连续运行 3 天、累计 21.5 小时作业,实现零失误零中断。
OpenAI 于北京时间9月4日凌晨发布新一代旗舰模型 GPT-6 Astra,首批拿到模型的开发者已开始实测。有用户用一周时间在虚幻引擎里搭出一座曼哈顿,也有人让它在 Blender 里生成可直接在浏览器运行的3D游戏,耗时约30分钟到2小时,还能操控 Final Cut Pro 完成导入素材、调色、同步 clips 等剪辑流程。
元点机器人发布具身 Physical AI 全开源生态 OpenBridge,包含开源硬件设计方案 BRIDGE 与开源指令控制方案 FlowMimic,并启动筑桥者计划全球招募 200 位开发者。
自变量发布 TwinDEX 无本体数据采集与执行系统,机器人仅用数百条无本体数据、零真机数据即一镜到底完成 24 个子动作的化学实验。评测显示其训练效果近乎 100% 替代真机遥操作数据,数据采集效率达真机遥操作的 5.3 倍,并可适配 WALL-OSS、π0.5 等不同基础模型。
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,两者底层使用同一套模型,区别在于能力开放范围被单独拆出。Fable 负责通用编码、知识工作和 Agent 任务,Mythos 面向经过验证的网络安全和生命科学研究场景,可进入更深的工具调用和专业任务。
强化学习专家孙鹏正式加入星尘智能,负责机器人强化学习后训练。孙鹏博士毕业于清华自动化系,曾任腾讯 AI Lab 高级研究员、字节跳动游戏 AI 部门多智能体与大规模强化学习负责人,主导开发强化学习基础设施 ByteRL,并参与 ReFT、DeltaProver 等项目。星尘智能八月刚发布隐式世界动作模型 Lumo-2,其加入将加强公司在机器人强化学习及后训练方面的研发能力。
8 月 31 日,面向物理世界的自进化基础设施 PhyAgentOS v1.0.0 正式发布,由 X-Era Lab(拓元智慧)、中山大学 HCP 实验室与鹏城国家实验室具身智能研究所联合研发,以 MIT 协议开源,GitHub Star 数接近 2000。
DeepSeek V4 开放权重与参考推理代码后,其视觉链路可逐层拆解:图片经 32 层 ViT 编码后由 3×3 Aligner 压缩,进入 V4 序列的视觉 Token 预算为 384。
文章以"菜农、AGI 信徒和夏尔巴人"三重身份切入,重新认识 Sharpa 这家公司及其团队。原文未披露具体模型版本、参数规模或产品数据,仅附带 WRC 2026 具身数采与 Anthropic MHS 统一接口等相关内容导览。
存算一体芯片正从技术验证走向规模化交付:后摩智能M50采用数字存算一体架构,已于2026年2月量产,10W功耗下算力160 TOPS,可运行30B至122B大模型;知存科技基于NOR Flash的模拟存算芯片已在可穿戴终端实现千万级出货。2025年全球存算一体处理器芯片出货量突破8.9亿颗,其中SRAM架构占54%。
腾讯混元、清华与南洋理工在 ECCV 2026 提出一种「以小博大」的流式空间记忆方法,通过保留 25% 全注意力层、引入 3D 卷积与 Muon 优化器稳定在线更新,将显存和计算量从二次方降至线性。该方法在 VSI-Bench 与 MindCube 上验证,并通过 120 分钟长视频测试。
周伯文提出 AGI for Science 创新地图,将科学创新划分为“未知的未知(0→1)”“已知的未知(1→10)”与“已知的未知(10→100)”三个象限,认为没有任何单一协作机制能同时适配三者。
AI科技评论对 DeepSeek Harness 开源后的插件生态做了实测盘点:dsh-plugin 标签下 11,439 个仓库中 2,143 个可安装、955 个真有人用,作者自写探针插件在三档文件权限下九项试探全部成功,read-only 档也能列出 ~/.ssh 目录、从环境变量读到 API key 并连上外网。
Physical AI 公司 Ropedia 发布新一代多模态采集系统 HOMIE Gen2,用约 380g 头戴设备记录人类真实操作中的动作、时序与环境变化。该设备支持 4 目全景与 4 路空间音频,多传感器同步精度 50µs,可连续采集约 13 小时,部署速度比上一代快约 10 倍、采集成本降至约 1/12.5。Ropedia 称其已服务超过 20 家全球机器人及基础模型团队。
华东师范大学与上海交通大学团队提出 S²-VLA,用信念状态和自适应动态门控让 VLA 模型按任务阶段调整注意力,2B 参数模型在 LIBERO-Long 上达到 96.4% 成功率,超过多数 7B 甚至 8.5B 模型。该模型推理显存约 7GB、吞吐量 80.8 Hz,而同类 7B 模型通常只有几 Hz。
李飞飞、吴佳俊等人在 arXiv 发布论文 TrAct,提出用视觉轨迹作为机器人动作与世界模型之间的通用接口,把低维动作指令翻译成图像中关键点的运动路径,再交给世界模型预演,并由视觉语言奖励模型 VLAC 打分选动作。
Anthropic 发布面向物理设备的 AI 代理接口标准 MHS(Model Hardware Standard)预览版,已在全球实验室的显微镜、机械臂和量子计算机上使用,它让 Agent 用统一命令读写设备参数,并在驱动底层写入最大功率、最大运动范围等安全阈值。
在 WRC 2026“世界模型到服务人类的现实距离”论坛上,王坚主持,商汤王晓刚、奥比中光黄源浩等八位创业者讨论世界模型。王晓刚称世界模型需具备理解、生成、预测一体化,并分数据增强、模拟仿真器、World Action Model 三阶段;张玉峰提出用工业练技能、商业练泛化、最后进家庭的落地路径。
美图影像研究院(MT Lab)提出一致特征传输(CFT),将人像重打光建模为光照一致的特征传输问题,论文已被 ECCV 2026 录用并开源代码。CFT 在 Rectified Flow 框架下联合建模噪声、源图与目标图三个分布,用"同光照变换、不同内容"的图像对监督,在 SSIM、LPIPS、FID 上均取得最高分。
慕尼黑工业大学 W2 教授黎子玥在 IJCAI 2026 Early Career Spotlight 演讲中提出"PDE三角"框架,即感知(Perception)、决策(Decision)、解释性(Explanation),用于弥合学术研究与公共部门交通落地之间的鸿沟。
智谱 AI 认领 OpenRouter 盲测榜上的模型并正式命名为 GLM-5.3-Flash,月之暗面研究员陈广宇对比配置文件后发现,其线性注意力遗忘门下界 gate_lower_bound 与 Kimi K3 同为 -5。
浙江人形机器人创新中心首席科学家熊蓉在2026世界机器人大会上表示,团队用两年半将人形机器人带入3C电子、服装、物流、汽车装配等场景,部分已规模化落地,3C签约百台级、服装签下2000台订单。她指出物理世界具有不可约性,泛化不足、亚毫米级精度与执行效率仍是落地门槛,目前可实现工业级亚毫米精度和99.99%成功率。
AI科技评论在 A100 服务器上实测 8 月 14 日阿里 Qwen 团队开源的 Qwen3.8-27B,覆盖 vLLM、SGLang、Llama.cpp 标准部署、2bit 到 16bit 量化,以及接入 DeepSeek Harness 的 Agent 测试。
哈佛大学教授 David Parkes 在 IJCAI 2026 约翰·麦卡锡奖获奖演讲中提出,AI 的关键问题正从造出通用智能体转向为大量智能体设计协作机制。他用邮局问题、第二价格拍卖、伦敦公交组合拍卖和自动合同设计等例子,说明如何让智能体如实报告私人信息并实现有效分配。他列出智能体社会需要面对的五个方向:交互规则、可观察性、可验证性、资源争夺,以及人类对机构的控制。
银河通用在第二届世界人形机器人运动会的家庭、餐饮、商超三项场景赛中全程不遥操、完全自主,包揽三枚金牌,夺冠率100%。家庭场景以30分钟量级的最长赛程提前完赛并在技术复核中首次即满分,餐饮场景以6分55秒零失误最快完赛,商超场景包揽金银铜牌。
8 月 23 日,上纬新材旗下启元机器人正式开启启元 Q1、启元 T1 双产品预订,预计 9 月首发交付。Q1 站立高度 88 厘米、整机约 15 公斤,可折叠收纳,外观结构件开源并支持 3D 打印外壳定制;T1 采用 Transformer 跨形态一体化架构,室内为轮足人形模式,户外可转为四足形态。