Dwarkesh 播客:三位研究员辩论 RSI 还有多远
Dwarkesh Patel 最新一期播客邀请 John Schulman、Beren Millidge、Charlie O'Neill 三位研究员,用一个半小时讨论递归自我改进(RSI)还有多远,并在结尾给出各自的时间线预测。
按公众号阅读文章与观点
Dwarkesh Patel 最新一期播客邀请 John Schulman、Beren Millidge、Charlie O'Neill 三位研究员,用一个半小时讨论递归自我改进(RSI)还有多远,并在结尾给出各自的时间线预测。
陶哲轩联合25位菲尔兹奖得主发布题为《数学领域中人工智能的严重失衡》的联合声明,批评AI公司把攻克数学难题当作基准测试来推进,认为这与数学界的目标严重脱节。声明指出,近几个月大语言模型的数学能力大幅提升,但AI主导的解题成果往往仓促发布,来不及严谨论证、提炼新方法和规范引用前人工作,引发成果归属与抄袭争议。声明认为这属于更广泛的人工智能对齐问题的一部分,2026年菲尔兹奖获得者邓煜也在签署人之列。
推荐理由:声明全文与25位签署人名单完整呈现,读者可了解数学界对AI以解题跑分推进研究的具体担忧。
Anthropic 发布的 154 页威胁情报报告《Detecting and Countering Misuse of AI: September 2026》梳理了 2025 年 12 月至 2026 年 8 月间被发现并处置的 AI 滥用活动。
腾讯会议新版图文纪要上线,AI 会按每段讨论的逻辑结构自动适配表格、分栏色块、时间轴和流程条等排版,并抓取会议共享画面作为配图。纪要支持图文总结、学习笔记、汇报总结等六大模板,文字条目带时间戳可直接跳转到对应视频,还能通过问元宝联网搜索并生成邮件。
多名前端程序员在裁员和 AI 冲击下转行 PLC 工程师或上位机工程师,前者入行后月收入普遍过万,后者入行年薪普遍在 10 万至 20 万元之间。这两类岗位需全年奔波于各地工厂、24 小时响应现场需求,但不易失业、年龄歧视相对较轻。也有上位机工程师韩顺安反向回到互联网,2026 年春季拿到广州一家互联网外企外包岗位,薪资比上一份工作高出 50%。
《三体》"只送大脑"策略的核心是只保留最不可替代的环节,这一思维正被用来解释 AI 时代的组织变革。文章以耐克、ARM、宜家、Visa 为例,说明商业史一贯在"变轻":不拥有工厂、不设计具体芯片、让顾客自己组装、只卖标准。一篇 2026 年《Business Horizons》论文提出,AI 的下一阶段可能不是增加 Agent 数量,而是成为"组织协调层",重新分配决策权并嵌入治理规则。
苹果在9月10日凌晨发布会中更新健康应用 Apple Health,新增 Longevity 长寿页签、Health Age 健康年龄、Readiness 评分、Movement Evaluations 和 Labs 五项功能。
加州大学伯克利分校和麻省理工学院的研究人员开源了推理引擎 FreeToken,通过动态协同调度让消费级硬件运行前沿 MoE 模型。据论文基准测试,它在 8GB 显存的 RTX 4060 笔记本上运行 Qwen3.6-35B 约每秒 39 Token,相同 MoE 模型上解码速度比 Ollama、llama.cpp 快 3~4 倍,预填充快 6~30 倍。
普林斯顿大学人工智能创新中心主任王梦迪在 2026 Inclusion·外滩大会主论坛演讲中提出,大模型虽掌握大量人类知识,但尚未在物理、化学、生物等基础科学领域带来原创发现。
京东零售产研团队在 JDD 大会分享中指出,AI Coding 提升了代码产量,却未同步提升研发效率,反而加重了 Review、测试和评测环节压力,因为 AI 主要解决编码环节,而需求定义、架构设计等"上工程"仍是瓶颈。
慕尼黑工业大学 Angela Dai 教授在 ECCV 2026 提出以逆向自监督(SG-NN)将物理遮挡转化为结构先验,替代在 3D 场景重建中失效的 2D 去噪范式。
视触觉传感器常被质疑是「摄像头+硅胶」容易复制,但商用产品在凝胶配方、光学校准、批量一致性和软件栈上要求极高。戴盟、一目、千觉、纬钛等厂商已把帧率做到120-400Hz,防护达IP54至IP67,一目更将厚度压到3毫米。戴盟Daimon-Infinity开源1万小时触觉数据,千觉TacVerse 1k为首批1000小时真实交互数据。
2026 年蚂蚁 InTech 青年先锋论坛暨颁奖典礼在外滩大会举行,申报者来自全球 10 个国家和地区、50 余所高校,数量较首届激增近四倍。Michael I. Jordan、张宏江等院士与获奖青年学者围绕 Researcher Founder 创业、AI 消解知识权威、Conference 是否会消失等议题展开对谈。
openJiuwen 发布 RSI 递归自我改进框架,率先支持可插拔 Harness 与 Artifacts 双维度优化,并把完整流程落地到 WorkSwarm 蜂群办公智能体。
OpenAI 的 GPT-6 Astra 解出了 FrontierMath Tier 4 中此前唯一未被 AI 攻破的一道题,OpenAI 公布成绩为 97.6%,Epoch AI 据此判定 Tier 4 已饱和。
趋境科技将 SGLang HiCache 与 Mooncake Store 结合,把 KV Cache 从单机资源池化为集群级共享资源,线上 KV Cache 命中率稳定在 90% 以上。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均为全职,工作地点北京中关村,校招接受实习且可转正。产业方向关注芯片、AI Infra、云计算,财经方向关注创投与财报,产品方向关注 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附科技行业代表作品。
高德 9 月 10 日宣布扫街榜 2026 全面 AI 化,并推出空间智能核心引擎 ABot-Earth 0.7,号称全球首个 3D 原生城市世界模型。该模型仅需一张卫星图或一段文字,在消费级 GPU 上跑 10 分钟即可生成真实街景 3D 城市,效率比传统方法提升 1000 倍,已覆盖 190 多个国家、300 多座城市。
9月10日,高德地图发布扫街榜2026,并推出导航Live功能,用户点开搜索框旁的摄像头图标后,AI结合位置和方向把地图中的POI转化为与眼前环境对应的视觉引导。高德导航产品负责人孙冲称,导航Live的本质是具备时空上下文、现场感知与端到端行动力的具身智能体。硅星人实测了室内找厕所和逛街选餐厅两个场景,导航Live可直接识别取景框内的目标,并接上评分、人均消费和路线等信息。
《晚点LatePost》报道,2026 上半年国内具身智能融资总额超过 900 亿元人民币,估值超百亿的公司达 22 家。宇树 2025 年营收 16.99 亿元、卖出 5215 台人形机器人,但截至去年 9 月超过七成收入来自科研教育,明确用于智能制造等场景的收入只有 1570 万元。报道还提到数采工厂回购协议、地方国资合资与关联交易在推高部分订单收入。
推荐理由:以融资规模、订单结构与研发投入的对照,呈现具身智能高估值与真实技术进展之间的落差。
B 站首届 AI 创造公开赛落幕,获奖 UP 主扎克鸡认为 AI Coding 让产品开发获得接近内容的时效性,简单项目两三天可出第一版,复杂 Unity 游戏一到两周完成一次迭代。一等奖《猫娘计划 Project N.E.K.O.》作者 W 博士则判断,代码难以长期构成壁垒,用户、创作者与社区长期形成的“关系”才是难以复制的资产。
OpenAI 首席产品官 Tibo 宣布暂停 200 美元档 Pro 20X 的新增订阅,以保障现有用户流畅访问 GPT-6 Astra,目前订阅页面仅剩每月 100 美元的 5X 档。
推荐理由:从订阅档位定价与算力成本的对照,可以看出重度用户行为如何击穿包月套餐的毛利假设。
针对市场传闻寒武纪对下一代暂定命名690的芯片重新定价、较两个月前参考报价上涨20%至30%,寒武纪回应称并未发布涨价相关消息。微软计划到2032年将数据中心容量从约12吉瓦提升至超过38吉瓦,以缓解算力短缺。国产GPU企业燧原科技以142.18元/股发行价登陆上交所科创板,腾讯为第一大外部股东。
字节跳动将 AI 大模型列为绝对优先级,电商、本地生活等成熟业务从扩张模式转向算账模式,2026 年资本支出最高提至 700 亿美元,约为 2025 年投入的两倍以上。
针对"领福利的老美去看霉霉演唱会"这一假设,文章认为美国已进入消费社会,演唱会等消费本身创造财富,约束其消费反而减少社会总财富。200年前英国的福利制度旨在逼暂时失业者重返生产岗位,而美国制造业外迁后已无车间可返,故只能放任。马斯克预言的UBI将取代福利制度,AI先冲击标准白领,中国因蓝领占比高受冲击更晚。
OpenAI 向《纽约时报》确认,在攻克纳维-斯托克斯问题后,过去五天内又在另一千禧年难题霍奇猜想上取得实质性进展,正评估如何公布结果。约两周前 OpenAI 完成新内部模型 Aeon 的训练,其数学推理能力大幅超越 Astra,从零开始到解决纳维-斯托克斯方程仅用 88 小时。Anthropic 也传出接近解决伯奇-斯维讷顿-戴尔猜想。
OpenAI 用约 1 万个 agent 持续运行 88 小时,为纳维-斯托克斯方程交出一份证明,并附上 Lean 形式化验证,算力成本达数百万美元。OpenAI 还在最新博客中透露,仅数天就训出超越 GPT-6 智能的下一代模型。Sam Altman 对"用 1 万个 agent 抢发室温超导"的玩笑回复:you know what let's try。
领英发布《三重困境》AI性别鸿沟报告,分析全球27个国家招聘数据后发现,2025年拿到AI相关职位Offer的人中仅有26%是女性,AI企业高管中女性仅占13%。
科技股回调后资金溢出,游资主导了近期大消费板块的连板行情,机构近一月净流入仅约+5.9亿元,而电子、计算机、通信三大科技板块主力资金合计净流出约1214亿元。AI长剧《后西游记》带动传媒板块,芒果超媒连续两个20CM涨停,龙版传媒6个涨停,量化打板席位深度介入压缩了炒作周期。当前连板高度降至4板、炸板率超30%,行情已进入尾段分化。
兰德公司八月中旬发布64页报告《中美两国的AI发展》,从26629家公司中筛出1181家真正开发AI的企业,其中美国743家、中国438家。报告发现两国在Transformer(28%对27%)、扩散模型、强化学习(均为19%)的使用比例几乎一致,但形态明显分化:纯软件公司美国61%、中国26%,人形机器人美国2%、中国12%。
NUS Show Lab 在 ECCV 2026 披露 Show-o 系列成果,首次将自回归与离散扩散融合进单个 Transformer,文本用自回归、图像视频生成切换至离散 Token 扩散模式,十几步迭代即可恢复完整视觉 Token。团队以循环一致性监督实现无标注数据的自监督进化,并用自研 Q1 实时骨干网实现远超前沿闭源大模型的推理速度,同时推进 VLA、世界模型与云端加端侧的具身落地。
清华大学朱军团队提出通用世界模型(GWM)框架,按理解、想象、行动三大认知能力划分世界模型,并给出五级进化路线图,与李飞飞团队的《A Functional Taxonomy of World Models》功能分类法形成互补。
第三届「兴智杯」全国人工智能创新应用大赛已开启报名,由中国信通院、深圳市人工智能产业办公室、深圳市龙岗区人民政府共同举办,8 月 31 日在深圳龙岗启动。大赛设技术创新、行业赋能、生态协同三大主题赛及云智应用专项赛和总决赛,聚焦大模型智能体、具身智能、国模国芯适配等方向,总决赛预计 2026 年 12 月在深圳龙岗举行。
中国联通推出基于自研 Agent Harness 基座的元景数字员工,由元景 UniClaw 升级而来,具备沙盒隔离、数据不出网、开箱即用特性。实测版本支持 DeepSeek V4 Flash 和 GLM 5.2 模型,可一句话完成联网搜索、数据分析、图表生成到 HTML 研究报告输出的全流程,并能绑定微信 Clawdbot 定时推送科技日报。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均在北京中关村全职,校招接受实习且可转正。产业方向关注芯片、AI Infra、云计算,财经方向聚焦创投与财报,产品方向跟踪 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附代表作品。
RunningHub 将 MiniMax H3 的加速方案 H3 Lightning 在 GitHub 开源。在 4 张 RTX 6000D 上生成 5 秒、1344×768 视频,原始 BF16 50 步方案耗时 348.8 秒,加速后降到 28.7 秒,约 12 倍提速,并保留 BF16 精度。
中国科学院大学与字节跳动提出动态用户模拟框架 LiveSim,论文已被 EMNLP 2026 主会收录。
量子位正式启动 MEET2027 智能未来大会,定于 2026 年 12 月在北京举行,主题为「智行合一,驭见未来」,聚焦智能体、具身智能与机器人、AI Infra 与算力、世界模型等年度议题。同期启动「人工智能年度榜单」征集,从企业、产品、人物三大维度评选五类奖项,报名截止 2026 年 11 月 16 日,结果将在大会上公布。
当地时间 9 月 8 日,Meta 正式发布个人 AI 助手 Muse,定位为可全天候运行的个人 Agent,用户关闭应用后它仍能在独立云端虚拟机中继续执行任务。
京东在 JDD 全球科技探索者大会上发布由五大工业级原生模型组成的“超脑 3.0”和覆盖仓储、分拣、运输、配送的“狼族”集群,共九类产品、11 款机器人,已在全球超 10 个国家、全国超 20 个省份部署。