Founder Park 梳理实时交互模型赛道并对话 Reverie AI 创始人袁博地
Founder Park 梳理了实时交互模型这一尚未收敛的赛道,比较 Loopit、Reverie AI、SigmaZ AI 与 Runway、Vidu 在技术路线上的分歧,核心差异落在交互状态存放在可执行代码、外部模型还是像素生成中。
按公众号阅读文章与观点
Founder Park 梳理了实时交互模型这一尚未收敛的赛道,比较 Loopit、Reverie AI、SigmaZ AI 与 Runway、Vidu 在技术路线上的分歧,核心差异落在交互状态存放在可执行代码、外部模型还是像素生成中。
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,把语音、视觉、推理和 Tool Calling 放进同一条持续运行的链路。
推荐理由:文章从异步 Tool、KV Cache 和调度角度拆解实时语音会话背后的系统问题,读者可以迁移到自己的 Agent Runtime 设计。
B站2026年二季度日均活跃用户同比增长7%达1.17亿,月均活跃用户3.71亿,用户日均使用时长113分钟。AI知识内容消费时长同比增长72%,月均观看AI内容用户超1.9亿,AI广告收入同比增长超100%。首届AI创造公开赛收获超3万份投稿,1.34万名创作者参赛,非专业开发者占比超六成。
OpenAI CEO Sam Altman 在《财富》专访中宣布公司不会在2026年进行IPO,理由是AI安全风险加剧,并暗示头部AI公司即将宣布集体放缓开发协议。智谱宣布完成约50亿美元融资,用于下一代GLM基础模型、完全自训练体系及算力基础设施。Anthropic 已选择纳斯达克作为其潜在IPO的上市地点,一些估算认为其估值可能达2万亿美元。
Anthropic CEO 达里奥·阿莫迪发布长文《我们必须为前沿 AI 限速》,提出一套围绕可核验性的方案,OpenAI CEO 阿尔特曼转发表示支持,马斯克也表示认同。
一则科普视频讨论 Navier-Stokes 方程是否已被攻克。正文未给出具体结论、证明细节或相关研究者与机构信息,仅以标题形式提出这一疑问。
AGI Bar 上海店开始提供免费的 DeepSeek v4 flash 和 MiniMax H3,与北京店一致。两家店的模型均在北京本地推理,共用英伟达 DGX,速度达每秒 100+ token,并通过内网与中转系统跨地分发 token。用户连上店内 WiFi 后填写 Base 和 API Key(sk-agi_bar-static)即可调用,MiniMax H3 免费不限量。
拿到 GPT-6 Astra 一周内,作者用其完成三款产品上线:备考 PET 的网页游戏《星光远航》beta 版、日语实时字幕插件(已上架 Chrome Web Store)、睡眠辅助 App《You Must Sleep》(美区已上线,国区预计次日上线)。作者还尝试用 Astra 指挥 Blender,并称想法几乎都能很快实现并上线。
华为 Pura X Max 上市四个月发货量突破 120 万台,典藏版首销占比超 55%,9 月 7 日新增波尔多红、尼斯蓝配色并官宣全系支持升级鸿蒙操作系统 7。三天后苹果发布首款折叠屏 iPhone Duo,同样采用阔折路线,展开厚度 5.2 毫米、重 254 克,国行 15999 元起,但舍弃潜望式长焦且国行 AI 功能落地时间未定。
投行从业者邦比快跑在北大分享称,自己不会写代码,却用 AI 在下班后做出五个网站并每日更新,包括收录 98 封股东信的巴菲特知识库、232 个模型的芒格思维模型库和含 1151 家公司、58 个子行业的 AI 产业链地图。他通过定时任务让网站自动抓取情报、解析研报并翻译访谈,认为 AI 让个人无需成为分工中的一道工序,可直接面对受众完成更大的作品。
月之暗面法务部 9 月 12 日称网传 16 名人员被带走(含创始人杨植麟)纯属恶意造谣,已向警方报案。OpenAI CEO 奥尔特曼表示因 AI 安全担忧不会在 2026 年上市,并暗示多家领先 AI 公司可能宣布放缓发展速度的协议。Anthropic 威胁情报报告披露,某跨国诈骗团伙用 20 余款虚假约会 APP 和超 4700 个 AI 虚拟账号,两周内诱导 2.5 万名真实用户受骗。
KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026 上,CNCF、OpenInfra 与 PyTorch 三个开源社区首次同台,讨论 AI 进入生产后基础设施边界被重写。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均为全职,工作地点北京中关村,校招接受实习且可转正。AI 产业方向关注芯片、AI Infra、云计算,财经方向聚焦创投与财报,产品方向跟踪 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附科技行业代表作品。
画图 Agent Archify 单日最高新增 5000 Star,累计 5.88 万 Star、3.8k Fork,项目与开发者涂少坤双双登顶 GitHub 热榜,并拿下 GitHub 周榜第一。
亮源新创发布通用导航模型 LightNav-0,通过 Real2Sim2Real 数据引擎将 2,000+ 个互联网真实场景转为可复用仿真环境,生成 4,000+ 小时视觉、语言和动作后训练经验。
中国科学技术大学与阿里巴巴团队提出 PARPO 个性化智能体强化学习框架,将用户偏好引入 Agentic RL 训练目标,由 PSGM 技能记忆、两阶段偏好解耦奖励模型和 PARPO 优化器三部分组成。
DeepSeek 升级后思考链条从活泼吐槽变得理性紧凑,不少把它当“赛博男友”的用户感到陌生甚至“失恋”。原因是思考链本是给开发者看的草稿纸,模型迭代为提升答题准确率和推理效率压缩了冗余内容,而活人感恰恰藏在这些冗余里。
智谱于9月11日启动新一轮融资,包括约20亿美元股票配售和30亿美元可转换债券,总规模达50亿美元,折合人民币超过350亿元。资金将用于研发、算力资源及基础设施、业务扩张、战略投资和潜在并购,距其今年7月约40亿美元的配售仅两个月。
阿里与浙大联合提出 Astar,一个从 AI 系统自身 Git 提交与实验结果中学习演化经验的 LLM,用于自适应地给出系统改进方向。其 0.6B 版本单次生成有效优化方向的成功率 S@1 达 54.35%,高于 GPT-5.5 的 30.71% 和人类资深算法专家的 32.29%,8B 版本为 67.86%。
火思动力(Pyromind)开源 PyroDash,一种 token 级大小模型协同推理范式,由小模型在生成过程中自行判断何时把控制权交给冻结的大模型,单次请求最多触发一次大模型调用。
Anthropic 内部约 20 人的 Labs 团队采用高淘汰率的孵化机制,每两周评审一次项目,失败项目被直接砍掉或并入其他原型,团队规模超过 4 人即从 Labs 毕业,内部创意成功率约 20%-30%。
Shopify 工程团队提出 Gisting 技术,把 LLM 长提示词压缩为学习型 Gist 词元,无需修改模型核心权重。该技术将 Sidekick GraphQL 智能体的系统提示词从约 6000 个词元压缩至 1500 个词元,实现 4:1 压缩比且未牺牲预测质量。
在 2026 Inclusion·外滩大会主论坛上,作家刘震云与香港大学计算与数据科学学院院长马毅对话,讨论 AI 与人的边界。刘震云称网上以他形象、声音出现的视频“95% 都是假的”,但 AI 只能模仿已有作品,他没想到、没写出来的作品 AI 模仿不了。马毅认为大模型擅长人类积累的共性知识,却难以理解个体的个性与价值,并已在港大 AI 通识课程中鼓励学生全力拥抱 AI。
Anthropic CEO Dario Amodei 发布长文《We Must Pace the Frontier》,提出控制前沿 AI 发展节奏的三步计划:引入独立第三方机构长期驻场并取得接近内部风控的访问权限、联合美国前沿 AI 公司共设能力红线与安全检查点、再把这套框架推向全球分级协调。
BuilderHub 本周从新入驻项目中选出 6 个 AI 产品推荐,包括 AI 设计基础设施 VIRSE、AI 音乐平台 ACE、合规决策工具 Citely 和开源 API 网关 CCX 等。
Anthropic CEO Dario Amodei 发文呼吁主动控制前沿模型能力跃迁的节奏,给对齐与安全研究争取一到两年的窗口期,马斯克、Sam Altman 与 Andrej Karpathy 均表示支持。
1181家中美AI开发企业样本显示,美国61%的企业以纯软件形态提供AI,中国仅26%;涉及人形机器人的企业中国占12%、美国占2%。两国采用强化学习的企业占比同为19%,但美国多用于优化语言模型回答与推理,中国多用于控制机器人、训练自动驾驶或改进工业自动化。中国企业更多面向制造、交通和能源,美国企业则集中在医疗、科研和网络安全等知识密集型领域。
一篇面向老年群体的反诈分析文章拆解了从情感围猎、冒充公检法恐吓到AI换脸冒充子女等六类针对老年人的诈骗手法。文中引用公安部通报称,2026年第一季度全国AI辅助诈骗案件同比暴增300%,涉案金额突破50亿元,并列举天津AI换脸冒充老板骗走186万元、大庆老夫妇被AI拟声冒充儿子骗走18万元等案例。文章最后给出关闭境外来电、安装反诈APP、设置转账限额、约定家庭暗号等子女可操作的防骗措施。
今年外滩大会新增「AI 艺术节」,包含 100 余部 AI 影像作品展映、概念艺术展《纠缠,而后日以作夜》和 AI 歌手 Yuri 尤栗的首场线下公演三大模块。展区展出 AARON 于 1985 年创作的最早 AI 艺术作品真迹,Yuri 作为国内首位获官方数字人身份认证的 AI 虚拟偶像登上全亚洲最大巨幕。现场还设置由导览智能体驱动的发光箭头装置,探讨人是否将判断权交给 AI。
燧原科技于9月11日登陆科创板,发行价142.18元/股,发行市值约612亿元,募集资金总额约61.19亿元,首日收于397元、较发行价上涨179.22%。2025年燧原83.79%的营收来自腾讯,腾讯此前通过腾讯科技及一致行动人持股20.2580%,本次IPO又获配174.71万股并锁定3年。
Genspark 发布 PPT 专用模型 Gen-1 Slides,以 MiniMax M3 为底座、Fireworks AI 参与训练,用约 2000 个内部 Slides 任务做强化学习。
浙江大学 ZJU-REAL 团队开源 Agent 评测底座 ageval,通过插件解耦待测 Agent 与运行环境,在配置文件中改一行即可让同一份 dataset 在不同环境和不同 Agent 间切换。
OpenAI 于 9 月 10 日开放 Agents API 公测,开发者只需提供任务、模型、工具和运行环境即可创建 Agent,长会话上下文压缩、工具调度和 subagent 协作由 Codex Harness 托管。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,均为全职,工作地点北京中关村,校招应届生可实习并转正。三个方向分别关注芯片与 AI Infra 及云计算、创投与财报、AI 应用与硬件终端落地。简历投至 zhaopin@qbitai.com,需附科技行业代表作品。
京东云首次对外亮相AIGC工具平台京东灵境AIGC,东北师范大学动画系研究生徐威用它耗时4天完成AI短片《ARCADIA》,从20个参赛作品中斩获一等奖和30000元奖金。该平台以无限画布为主要创作空间,接入Seedance、Seedream、Wan、可灵、Vidu等模型,并覆盖策划、剧本、分镜、图像、视频和素材编辑流程。
加州大学伯克利分校和麻省理工学院的研究人员推出开源推理引擎 FreeToken,目标是让前沿 MoE 模型跑在消费级硬件上。论文基准显示,8GB 显存的 RTX 4060 笔记本运行 Qwen3.6-35B 约为每秒 39 个 Token,相同 MoE 模型下解码比 Ollama 和 llama.cpp 快 3~4 倍、预填充快 6~30 倍。
DeepSeek 团队成员崔添翼 9 月 9 日发推称,V4.1 Flash 在性能、费用、速度和总用时上全面超过 V4 Pro,V4 Pro 上线前所有发往 V4 Pro 的请求将被路由到 V4.1 Flash 并按 Flash 价格计费,而切换通知距生效只有一天左右,没有新旧模型并行的迁移期。
一篇评论以OpenAI与两位数学家的署名之争为切口,讨论AI正在把知识生产变成黑暗森林。据OpenAI公告,公司在听到有人可能解决千禧年难题的传闻后启动研究,动用约一万个并发AI智能体,约88小时取得带光滑外力版纳维尔-斯托克斯问题的解答并完成形式验证。数学家巴克马斯特称,对方曾提议在其执笔的论文中排除在Anthropic任职的合作者阿尔珀格,并在他考虑公开此事时提到可能毁掉职业生涯。
芒果 TV 和湖南卫视 8 月 31 日上线国内首部 AIGC 长剧《后西游记》,5 个交易日内芒果超媒股价累计上涨约 50%,市值增加约 132.84 亿元。
OpenAI 发布 GPT-Live 工程报告,详解其将延迟敏感的媒体处理与推理循环放在实时路径、任务委派与工具使用等应用逻辑放在异步 RPC 边界之后的架构设计。