98年哈工大教授杨朔创业破晓智能,发布触觉世界模型TouchWorld
哈工大(深圳)杨朔团队发布面向灵巧操作的触觉世界模型TouchWorld,让机器人预测接触状态并利用触觉反馈修正动作。该模型在浇花、插头插入等六个真实任务上平均成功率达65.0%,扰动场景下为57.2%,分别高出Pi-0.5、FTP-1、GR00T N1.7等最强baseline 15.7和16.0个百分点。杨朔已创办破晓智能(PHANES AI),目标构建人形机器人全身移动灵巧操作世界模型。
微信公众号
哈工大(深圳)杨朔团队发布面向灵巧操作的触觉世界模型TouchWorld,让机器人预测接触状态并利用触觉反馈修正动作。该模型在浇花、插头插入等六个真实任务上平均成功率达65.0%,扰动场景下为57.2%,分别高出Pi-0.5、FTP-1、GR00T N1.7等最强baseline 15.7和16.0个百分点。杨朔已创办破晓智能(PHANES AI),目标构建人形机器人全身移动灵巧操作世界模型。
中国科学技术大学张举勇教授团队联合上海人工智能实验室提出OMEGA,一套面向多机器人协作的embodied agent harness,把高层任务目标编译成任务图并分配给多个机器人并行执行。
英伟达在 Bilibili World 首次面向大众展示了搭载 RTX Spark 超级芯片的笔记本,该芯片由 Blackwell RTX GPU 与 20 核 Grace CPU 通过 NVLink-C2C 互联,配 128GB 统一内存,算力达 1Petaflop。
量子位不完全统计了97家国内具身数据玩家,其中70家做数据采集、27家做数据infra;过去一年15家独立具身数据服务商完成34起融资,合计约44.7亿元。行业现有年产能为160万至180万小时加7000万至8000万条,短期目标为未来1至3年内扩大15至20倍。半数以上独立数据服务商成立不到一年,尚无公司披露利润,纯卖数据能否成为赚钱的生意仍待验证。
vivo 蓝图实验室与中国科学院深圳先进技术研究院合作提出生成式摄影大模型 MagicBokeh,用统一扩散框架在一次推理中同时完成高倍长焦的超分辨率与可控虚化渲染,避免两阶段链路的误差传递与重复计算。该模型采用面向端侧部署的轻量化设计,支持焦点位置调节和虚化强度控制,论文已被 CVPR 2026 接收并入围 Best Paper Finalist。
邓文迪与默多克的二女儿 Chloe Di Murdoch 硕士毕业后加入 AI 编程智能体 Devin 的母公司 Cognition。Devin 于 2024 年 3 月发布,号称全球首个 AI 软件工程师;Cognition 今年 5 月融资超 10 亿美元,投后估值 260 亿美元,Devin 年化收入 run-rate 达 4.92 亿美元。
中科曙光7月10日在郑州宣布全国产AI超集群曙光8000(登峰)落成,十万张国产加速卡投入使用,并接入国家超算互联网向科研机构与产业界开放。该系统走原生超智融合路线,覆盖从FP64到INT8全精度,可同时承担科学计算与万亿参数大模型训练,海光等国产芯片、scaleFabric类IB原生RDMA网络、ParaStor分布式存储提供全链路支撑。
量子位将于 7 月 17 日 19:30 在上海浦东举办 WAIC 场外线下交流活动,主题聚焦 AI 从"会回答"到"能完成"的落地现实。活动设两场分享:Evomap 创始人兼 CEO 张昊然与记忆张量 CTO 李志宇谈 Agent 从聊天框到正式上岗,VAST CTO 梁鼎与脸谱心智创始人陆弘远谈模型从 GitHub 到与世界交互,之后为自由交流环节。
OpenAI 研究院 Ethan Knight 宣布,昨日刚发布的 GPT-5.6 用不到一小时完成了存在半个世纪的图论难题循环双覆盖猜想证明,过程中模型自行调度了 64 个子 agent。
淘天AI搜团队联合阿里巴巴Token Foundry等提出电商大模型ShopX,让大模型直接进入商品空间完成检索、排序与组合,减少意图传递中的Interface Loss。
《金融时报》爆料腾讯正在洽谈成为Manus最大股东,目的是撤销Meta此前对Manus的20亿美元收购,回购价格仍为20亿美元(约合人民币136亿元)。腾讯预计收下最大股份,但仍将保留少数股东身份,Manus会继续独立运营而非并入腾讯,交易仍在谈判中、细节尚未敲定。
分子之心创始人许锦波在 2026 上海国投前沿论坛上正式面向产业界开放 AI 原生生物经济操作系统 MoleculeOS(MOS),以研发意图为入口自动拆解任务并调度模型。
第三届蚂蚁 InTech 奖开放提名申报,距 2026 年 7 月 17 日 24 时截止仅剩一周,面向 AGI、具身智能、数字医学、数据处理与安全隐私四个方向的青年学者与在读博士生。
清华、上交、北邮学者提出记忆驱动 Slides Agent 框架 MemSlides,面向个性化幻灯片生成与多轮局部修改,闭环完成率 96.3%、严格通过验证率 53.4%、首次正确编辑时间 242.5 秒。
前头部新造车智驾团队负责人杜宇创办私人健康机器人公司智梦可,首款产品AI睡眠超充垫已在京东首发上市。该产品采用水循环控温与VitaEcho感知系统,可无感监测睡眠状态并动态调节温度,控温精度达±0.01℃、响应速度不高于10毫秒,并自研VitaNeuro健康垂类模型实现主动干预。
蚂蚁灵波发布 LingBot-VA 2.0,称其为全球首个具身原生的预训练 VA 基座模型,从架构、数据到训练目标都为机器人定制。该模型用语义视觉-动作分词器、从零训练的因果架构、稀疏 MoE 与 Foresight Reasoning 异步推理四项改动,把推理时间从 965ms/chunk 降到 142ms/chunk,异步控制频率从 33Hz 提升到 225Hz。
歌歌AI 从零预训练了一个十亿参数的端到端模型,可一次性生成 3 分钟人声与伴奏俱全的立体声歌曲,并同步输出独立人声与伴奏分轨。该模型采用原生双流设计与跨流注意力机制对齐人声伴奏,并注入拼音时间轴先验知识以稳定咬字。歌歌AI 已与字节跳动签署版权分成合作,生成内容可上架抖音、汽水音乐等平台,同时启动民乐专属 AI 模型研发项目。
1X Technologies 为自家人形机器人 NEO 发布了一款 25 自由度、肌腱驱动的机械手,其中手指和手掌占 22 个全驱动自由度,腕部 3 个,采用把传动比压到 5:1 至 15:1 的准直驱肌腱传动,实现原生力控和可反驱。
OpenAI 正式发布 GPT-5.6,ChatGPT、Codex 及 API 均已上线,并同步推出由 Codex 和 GPT-5.6 驱动的 ChatGPT Work。
推荐理由:原文列出 GPT-5.6 三档模型与 ultra 多智能体模式,读者可据此判断旗舰模型的能力与定价走向。
清华大学智能产业研究院(AIR)刘洋教授团队的数学智能体系统AIM,深度参与了AIR-求真书院联培学生王彦桥与刘锦鹏助理教授完成的前沿量子算法研究,提出符号嵌入量子算法(Sign Embedding Quantum Algorithms),形成一篇84页论文。该研究从"有理逼近能否成为量子算法设计原则"的模糊直觉出发,AIM参与定理组织、证明草稿生成和复杂度分析,人类研究者负责方向筛选与最终审计。
量子位将于 7 月 17 日 19:30 在上海浦东举办 WAIC 首夜线下活动,主题聚焦 AI 从"会回答"到"能完成"的现实考题。活动设两场分享:Evomap 创始人兼 CEO 张昊然与记忆张量 CTO 李志宇谈 Agent 从聊天框到正式上岗,VAST CTO 梁鼎与脸谱心智创始人陆弘远谈模型从 GitHub 到与世界交互。
原力灵机在开发者大会上发布新一代具身基础模型DM0.5,参数规模4B,较上一代DM0翻倍,数据量增加400%。该模型Zero-Shot导航成功率提升31%,Few-shot成功率提升45%,微调后任务成功率提升20%,推理效率提升25%,在H100上延迟低至50ms、4090上为90ms。同步推出DexDev开发者平台(含DFOL2.0、MaaS、DexOS)与多智能体混合作业系统Ferrata。
零一万物发布企业决策中枢平台"万策"及老板AI、销冠AI、投资官AI等产品,主打赋能企业一号位。李开复回应"没了李开复零一万物还有什么"时称,自己主要负责敲第一次门和维护关系,团队自主拿单比例持续上升,并透露已接触全球约两三千家目标客户中的五六百家。
复旦大学、阿卜杜拉国王科技大学、上海交通大学和华东师范大学团队提出 Afford-VLA,将可供性(affordance)内化进 VLA 系统内部,让模型自行生成任务相关的交互区域并直接送入动作生成模块。
OpenAI 正为 Applied AI 团队招聘投资银行领域专家(Subject Matter Expert, Investment Banking),坐标旧金山,年薪 18.5 万至 20.5 万美元另加股权,采用每周 3 天到岗的混合办公。
上海交通大学等机构提出投机解码方法 Domino,通过并行 draft backbone 加轻量 GRU causal encoder 补回 block 内因果依赖,在 Qwen3-4B 和 Qwen3-8B 上分别实现平均 5.47x 和 5.49x 端到端加速,GSM8K 等任务最高 7.92x。
xAI 发布旗舰模型 Grok 4.5,这是一款 1.5T 参数的 MoE 模型,主打更快、更省 Token 和更低成本。它支持最高 50 万上下文,推理速度最高 80 TPS,API 价格为每百万输入 tokens 2 美元、输出 6 美元,比 Claude Opus 系列和 GPT-5.5 便宜 60% 以上。
蚂蚁灵波开源了 LingBot-Video,一个号称全球首个面向具身智能的大规模 MoE 视频基础模型,定位为视频物理引擎。模型总参数 30B,凭借 MoE 单次生成约激活 3B 参数参与计算,训练引入超过 70000 小时的 embodiment-oriented footage,并采用课程式五阶段渐进训练与分层强化学习奖励体系。
剑桥大学Dawn超算在英国六月热浪中因冷却系统失效,从6月27日停摆至7月6日,超过350个正在运行的科研项目受影响。该超算由1024块Intel GPU和256台液冷服务器组成,是英国政府3亿英镑国家AI算力计划的核心部分,今年1月刚获3600万英镑扩容。冷却系统供应商USystems称设备在整个事件中按设计规格正常运行,原因是37.7°C的高温超出按历史六月纪录35.6°C设计的散热能力。
OpenAI 发布 GPT-Live 语音交互模型,采用全双工架构实现边说边听,ChatGPT Voice 接入 GPT-5.5 并支持 Instant、Medium、High 三档推理强度。
曾推出 RoboTwin 的团队发布统一仿真与真机机器人操作评测基准 RoboDojo,含 42 个仿真任务、18 个真机任务,集成 30 个主流机器人策略。仿真榜第一的 Hy-Embodied-0.5-VLA 平均成功率 8.80%,真机表现最好的 π0.5 为 12.8%,人类专家则分别为 76.03% 和 100%。榜单还显示最强模型在开放语义任务上的成功率仅约 1.67%。
魔芯科技联合浙江大学潘云鹤院士、华为发布首个全栈基于国产NPU的实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。该模型为14B参数MoE架构,支持2000帧超长训练与推理、6自由度相机控制及1080P以上分辨率,近期将开源权重和代码并基于国产NPU超节点对外提供服务。魔芯科技近期完成亿元美金融资。
智源研究院悟界·RoboBrain Orca Team 发布技术报告《Orca: The World is in Your Mind》,主张先让模型学习统一的世界状态表征,再从中读出理解、预测与行动能力,而非一开始就针对单一输出模态训练。
翁荔发布博客《Harness Engineering for Self-Improvement》,提出 AI 自进化更现实的路径并非让模型直接改写权重,而是先从模型外部的运行系统 Harness 开始。
北航、NTU、ETH 团队提出免训练扩散加速方法 MrFlow,采用低分辨率生成结构、像素空间超分、单步高分辨率精修的三阶段流水线,在 Qwen-Image 上把端到端生成时间从 49.32s 压到 4.77s、加速 10.35 倍,FLUX.1-dev 上加速 8.25 倍。
OpenAI 首席未来学家 Joshua Achiam 在 X 上宣布离职,将于 7 月 24 日正式离开这家待了 9 年的公司。他 2017 年以实习生身份加入,曾领导 Mission Alignment 使命对齐团队,今年 2 月该团队解散后转任首席未来学家。据 WIRED 消息,OpenAI 目前尚未宣布接替人选。
蚂蚁灵波发布面向复杂物理世界任务的通用VLA模型LingBot-VLA 2.0,并开源代码、技术报告和模型权重。其预训练数据达60000小时,由50000小时机器人轨迹数据和10000小时第一视角人类操作视频构成,覆盖20种机器人构型,数据规模较1.0的20000小时扩大至3倍。
路透社消息称,DeepSeek 正在秘密开发一款自研AI芯片,定位是推理而非训练,项目约一年前已经启动,目前仍处于早期阶段。知情人士透露,DeepSeek 已与芯片设计公司、晶圆代工厂和存储器供应商展开接洽,近几个月还在不公开发布职位的情况下招聘芯片设计工程师。该公司2026年6月完成成立以来首轮外部融资约510亿元人民币(约74亿美元),资金用途包括自研AI芯片和扩建以国产芯片为主的算力中心。
Meta MSL 发布图像模型 Muse Image,同步开启视频模型 Muse Video 预览。Muse Image 在 Arena 文生图、单图编辑、多图编辑三项均列第二,Muse Video 位列文生视频第三。
研究王阳明「知行合一」十余年的哲学教授 Harvey Lederman 加入 Anthropic 从事对齐训练,其「真知源于消除内心信念冲突」的框架与 Claude 的对齐思路高度呼应。