宇树上市了,但真正的大考才开始
宇树科技IPO注册申请获通过,从递交申请到注册生效只用了104天,招股书显示2025年公司营收超过17亿元、同比增长超3倍,人形机器人出货超过5500台并已实现盈利。虎嗅分析认为,宇树今天的优势在于把运动控制的“小脑”做到行业领先,但下一阶段竞争的关键是负责理解环境、识别任务、做出决策的“大脑”,也就是具身大模型,其80%以上销售依赖线下直销,主要客户为科研机构、高校、科技企业和展会等。
按公众号阅读文章与观点
宇树科技IPO注册申请获通过,从递交申请到注册生效只用了104天,招股书显示2025年公司营收超过17亿元、同比增长超3倍,人形机器人出货超过5500台并已实现盈利。虎嗅分析认为,宇树今天的优势在于把运动控制的“小脑”做到行业领先,但下一阶段竞争的关键是负责理解环境、识别任务、做出决策的“大脑”,也就是具身大模型,其80%以上销售依赖线下直销,主要客户为科研机构、高校、科技企业和展会等。
学者胡泳撰文分析生成式AI对年轻人就业的冲击,认为企业缩减初级岗位更多出于对AI未来能力的预期,而非当前已发生的自动化。文章引用哈佛大学一份工作论文称,采用生成式AI的公司自2023年以来初级岗位招聘人数每季度下降约80%,同一家公司的资深员工数量却在增长,研究者称之为偏向高资历的技术变革。
AI 科技评论梳理 ICML 十年重磅演讲,呈现一条从 AlphaGo 时代「算法能解决一切」到质疑「解决本身」的轨迹。2016 年 David Silver 用 66 页幻灯片讲深度强化学习,2025 年 Google DeepMind 的 Anca Dragan 则指出奖励函数与人类意图错位。
6 月 26 日,张江人工智能创新小镇联合 InfoQ 举办的 Top Tower Talk「Harness 时代的硅基团队治理」专场在上海张江举行,聚焦 Agent 进入企业核心流程后的可控、可信、可追责问题。
Anthropic 技术团队成员 Tariq Shihipar 表示,他们已经删掉了 Claude Code 80% 的系统提示词,理由是指令和示例越多越好的旧逻辑不再成立,新模型 Fable 5 比给出的示例更有想象力。
北京航空航天大学、复旦大学与浙江大学提出 QC-MHM 框架,通过问题校准、多跳建模与时序感知嵌入辅助任务,提升时序知识图谱问答能力。该方法在 CronQuestions 与 TimeQuestions 两个基准上均达 SOTA,复杂多跳问题 Hits@1 绝对提升 5.1%,整体 Hits@1 达 0.971。
在 2026 AICon 上海站专题上,阿里巴巴 Qoder 与慧博科技的四位实践者分享了 Agent 从 Coding 走向 Anything 的路径:Qoder Desktop 以 Experts Mode 多 Agent 协作实现自主交付。
虎嗅【AI 100闭门会】第五期邀请西门子数控(南京)总经理周郁荣、微亿智造CTO赵何、原力灵机联合创始人汪天才、清流资本VP茆雨豪、镁伽科技高级副总裁何源五位产业一线人士,于7月8日晚19:00拆解具身智能从Demo到产线赚钱的落地卡点。讨论聚焦VLA与世界模型、控制系统融合,以及稳定性、节拍、良率、接管率等生产可用指标。
英伟达 GEAR 联合李飞飞团队、佐治亚理工大学等机构发布 Real2Sim 系统 SimFoundry,只需一段真实世界视频即可自动生成可交互、可训练、可评测的机器人仿真环境。
阿里达摩院联合人大、国科大等机构发布超导材料发现智能体 ElementsClaw,用 28 个 GPU 小时扫描 240 万种稳定晶体,预测出 6.8 万种潜在超导体。团队选取部分材料合成验证,发现 4 种人类此前未知的新超导体,最高临界温度 6.5K,推荐命中率约 40%。240 万种晶体的超导预测数据库已对外开放,供研究人员使用。
蓝思科技创始人周群飞为彼得·戴曼迪斯与史蒂芬·科特勒新书《吾辈如神》撰写推荐序,提出 AI 时代真正的生存力源于认知持续迭代。她回顾消费电子行业早期放弃亚克力、押注玻璃盖板的逆势选择,并指出具身智能落地的核心瓶颈是精密化、标准化、规模化的量产制造能力,而非单一算法突破。
Anthropic 已与三星接洽,探讨围绕拟议自研 AI 芯片展开合作,但芯片的具体用途、部署方式和算力水平尚未确定。Anthropic 回应称,包含谷歌、Amazon 和英伟达芯片的多元化硬件架构仍是其计算战略关键支柱,此举被视为对 OpenAI 与博通发布 Jalapeño 推理芯片的回应。
开发者 dax 在 Claude Fable 5 的调用日志中发现降级原因字段标着 TOO_DUMB_TO_NEED_FABLE,并向 Anthropic 工程师 Thariq 求证,对方回复证实了该字段的存在。
ICML 2026 投稿量从去年 12,107 篇飙升至 23,918 篇,接收率仍为 26.56%。评审偏好集中于大模型机制可解释性(约 1,870 篇)、AI for Science 深水区(约 860 篇)与具身智能(超 420 篇)三大方向,纯工程调参和提示工程类工作遭明确排斥,数学理论硬度与鲁棒性安全性权重上升。
前阶跃 Agent 产品负责人钟十六提出,Loop 的价值不在重复跑任务,而在于带目标、状态、触发和记忆,随人的每次判断持续成长。他据此开源了 Codex 插件 Dittos Loop For Codex,目前为第一版。文中以定制刻字项链店主为例,展示多 Agent 分工执行、验证与修正,30 分钟触发一次或攒满 30 条反馈即自动运行。
GitHub 上开源了一套 Loop Engineering 框架,提供七套现成工作流和10个启动模板,已累计获得4.5k Star。用户可用 npx @cobusgreyling/loop-init 选择 daily-triage 等模式启动,适配 Claude Code、Codex、Grok 和 OpenCode。
华大智造子公司涌生智能与上海人工智能实验室联合发布多智能体系统 ProtoPilot 和评测基准 BioLab Bench,覆盖从自然语言实验意图到湿实验设备执行的完整链路。
Meta 正筹备一项云业务,计划出租多余的 AI 算力,并可能让开发者按算力用量付费访问托管在其基础设施上的模型,比如 Muse Spark。消息传出后 Meta 股价涨超 10%,CoreWeave 和 Nebius 分别下跌 10.8% 和 12.4%。
2026 年 6 月,蔚来向超过 70 万用户推送最新版世界模型,覆盖蔚来和乐道两个品牌、NT2/NT3 等四个平台,以及英伟达 Orin-X 和自研神玑 NX9031 两套芯片,2022 年 3 月起交付的 ET7 也在升级范围内。
一篇借《庄子》"伯乐治马"与"桔槔机心"两则寓言反思 AI 效率主义的评论文章。作者认为 AI 在提升效率的同时放大了效率的结构性问题——工具以解放之名让人承担更多任务,并追问 AI 究竟是帮人回归本心还是消解本心,最终给出"庄子不会喜欢 AI"的判断。
香港中文大学(深圳)刘桂良团队联合跨维智能提出 Focus-Then-Contact(FTC)框架,在卡片插入、挂钥匙扣、充电器抓取插入等 6 个真机接触任务中实现 100% 成功率,平均真机训练时间 27.5 分钟。
上海交通大学李永露RHOS团队联合上海创智学院、中国科学技术大学和Math Magic提出HAT-4D,仅输入一段单目视频即可由多Agent协作完成多物体4D交互重建,论文已被ECCV 2026接收。
纽约大学联合 LeCun 初创 AMI 提出 JEPA 系列新成果 AdaJEPA,让世界模型在部署中通过测试时自适应实时更新编码器和预测器参数,实现持续学习。在 PushObj 未见过形状上规划成功率几乎翻倍,PointMaze 未见布局中 GD 从 53.3% 提升至 78.7%、CEM 从 49.3% 提升至 70.7%,额外延迟仅 0.01 到 0.03 秒。
Claude Fable 5 回归后不久便收到大量用户吐槽,问题集中在安全机制频繁误拦问题、请求被暗中降级到 Opus 4.8,以及跑分明显下滑。评测机构 BridgeMind 用 BridgeBench 测得三项核心指标全线下跌,12 个 debugging 任务中只有 3 个未触发降级跑完,其余 9 个被判定不安全转交 Opus 4.8 并记为零分。
Anthropic 的 Boris Cherny 与 Cat Wu 在对谈中梳理了从 Claude Code 到 Claude Tag 的演进,Claude Fable 5 现已接入 Claude Tag。
Claude Fable 5 回归后向订阅会员开放 7 天,作者用它优化 AIHOT 网站的 SEO 和 GEO,模型自主开启 22 个 Agent 调研 40 分钟,推翻 Opus 4.8 遗留的 Cloudflare 方案改用火山引擎 CDN,并自行提交工单申请白名单、与工程师对话补问回源 IP 网段清单,还在官方方案上加了暗号校验防伪造。
Anthropic 已开始开发自有 AI 芯片,并与三星电子洽谈潜在制造合作。快手可灵 AI 完成近 30 亿美元融资,投后估值有望达 180 亿美元,创全球视频大模型公司最大额融资纪录。特斯拉告知员工自 7 月 6 日起 AI 使用支出上限为每周 200 美元。
2026 年上半年起,谷歌、微软、Meta 等大厂先后限制内部使用竞争对手的 AI 模型与编程工具。谷歌因容量不足限制 Meta 使用 Gemini 相关资源,微软取消大部分 Claude Code 内部许可证并因 Anthropic 数据留存要求限制 Claude Fable 5,Meta 则限制员工在模型构建中使用 Claude 和 Codex。
硅谷风投维贾伊·潘德撰文呼吁"让它崩",主张为烧掉自己资产类别的AI崩盘叫好,认为泡沫与崩盘正是通往黄金时代的道路。文章援引卡洛塔·佩雷斯的技术革命五阶段模型与巴塔耶"被诅咒的份额",指出狂热期是技术革命的必要环节,崩盘能完成基础设施建设、让资本恢复清醒并强迫社会重新设计规则。
美团发布并开源 1.6 万亿参数基础大模型 LongCat-2.0,成为国内首个基于 5 万张国产算力卡集群完成从预训练到推理全流程的大语言模型,业界推测所用国产卡为华为昇腾。这意味着国产算力从单点芯片突破进入系统交付阶段,高速连接器、电源管理芯片、液冷互连等高可靠环节的价值量被重新看见,华丰科技、意华股份、航天电器、杰华特被放在同一张产业链图谱里。
Palantir CEO Alex Karp 在电视采访中抨击 OpenAI 和 Anthropic 的商业模式,称企业客户花钱买的 token 并未创造匹配价值,反而把工作流程、客户数据等核心机密喂给模型,最终被卖给竞争对手。他认为按 token 计费本身说明产品无法大规模稳定创造价值,真正值钱的技术应直接谈利润分成而非收算力费。
WorkBuddy 支持通过"配置自定义模型"添加第三方大模型,供应商在预置列表中时填入 API KEY 即可保存使用。但预置模型存在版本滞后问题,如 KIMI Coding Plan 只到 K2.6、GLM 只到 GLM5,需手动修改 ~/.workbuddy/models.json 中的 id 和 name 才能用上 Kimi K2.7 Code 等最新模型。
Claude Sonnet 5 发布不到 24 小时便因性价比遭遇刷屏差评。一张来自 GitHub 的私有题库跑分图显示,MiniMax-M3 以 61.95 分领先,Qwen3.7-Plus 在极限分上与 Sonnet 5 持平,而同一套测试 Sonnet 5 花费 71.96 元,Qwen 与 MiniMax 分别只要 11.71 元和 11.64 元。
OpenAI Codex 团队负责人 Andrew Ambrosino 在与 Lenny 的对谈中表示,取消产品角色、宣称「所有人都是 builder」是很糟糕的主意,会抛弃产品管理积累的最佳实践。
OpenAI 工程师开发出一种优化技术,将应用该技术的模型推理成本降低了一半,用于未登录访客的 ChatGPT 服务时所需英伟达 GPU 降至几百块,但具体技术细节未公开。DeepSeek 与北京大学联合发布投机解码方法 DSpark,在 V4 模型上实现每位用户推理速度 60%-85% 的提升,无需重新训练权重,已在 MIT 许可证下开源,适用于 V4 Flash 和 Pro 模型。
图灵奖得主 Yann LeCun 两连推的 VISReg 提出新正则化方法,通过解耦尺度与形状并引入基于切片 Wasserstein 距离的素描目标,解决 JEPA 世界模型的表征坍塌问题。
据彭博报道,Meta 正在组建新业务,计划将过剩的 AI 算力出售给外部客户,消息引发 7 月 1 日美股 AI 硬件板块大跌,费城半导体指数暴跌 6.27%,美光、闪迪、英特尔、AMD、台积电及 Nebius、CoreWeave 等算力租赁商普遍下跌,Meta 则逆势上涨 8.81%。
尚美数智将客房AI音箱“尚小美”接入PMS、门锁、房态、支付等后台系统,住客说一句“续住一小时”即可在5秒内完成改房态、激活门锁并自动扣款。CEO马英尧称纯智能酒店第一步可减少约1/3前台编制,新员工无需培训即可上岗,目标把客需处理率拉到80%-90%。该方案以蓝牙音响外设部署,总成本与原有大堂自助机基本持平,预计单房收益增加10元、提升5%到8%。
优必选6月30日在深圳发布消费级超仿生人形机器人U1系列并开启预售,三款定价分别为11.98万元、16.98万元,以及男版99万元、女版88万元。截至6月30日15时已售出至少13361台,按Pro版17万元估算订单金额超22亿元,发布会当日股价盘中涨超18%、收盘收窄至7.48%。虎嗅在现场观察到Ultra版行走能力未展示、动作僵硬,Pro版皮肤为硅胶材质、对话出现卡顿,与预售宣传视频存在落差。
地瓜机器人发布世界模型 Uranus,定位机器人开发基础设施,用帧级闭环生成视频充当 VLA 与世界模型的评测基准和 manipulation 仿真器。它训练时只见过 2 秒片段,推理时可稳定运行 60 秒,支持 G1 人形机器人和 Franka 协作臂的跨具身零样本泛化,目前仅支持 manipulation 训练。团队计划今年下半年把数据从几百小时扩到几千小时量级。