跳到正文
AI科技评论 · 微信公众号·· 24 天前AI 评分33

斯坦福吴佳俊 ECCV 2026 演讲:用物理属性统一视觉、声音与触觉的多模态感知

不堆 Transformer,斯坦福吴佳俊如何用物理重新定义多模态融合?|ECCV 2026

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

斯坦福大学助理教授吴佳俊在 ECCV 2026 演讲中提出,视觉、听觉、触觉是同一组物理属性在不同感官通道上的投影,主张用几何、材质、刚度等物理属性为多模态融合建立共同坐标系,而非直接拼接后喂给 Transformer。

来源:AI科技评论 · 微信公众号 · mp.weixin.qq.com