InfoQ 编译 OpenAI Codex 负责人 Tibo 访谈:28 天每日改进承诺与 Dots 愿景
OpenAI ChatGPT 与 Codex 负责人 Tibo Sottiaux 承诺未来 28 天每天推出一项用户可感知的改进,否则重置使用额度。他在访谈中谈到个人智能体平台 Dots、Codex 与 ChatGPT 整合、插件收益分享机制(已签约 16 家合作伙伴),并自述入职第三天曾把生产环境弄宕机。
微信公众号
OpenAI ChatGPT 与 Codex 负责人 Tibo Sottiaux 承诺未来 28 天每天推出一项用户可感知的改进,否则重置使用额度。他在访谈中谈到个人智能体平台 Dots、Codex 与 ChatGPT 整合、插件收益分享机制(已签约 16 家合作伙伴),并自述入职第三天曾把生产环境弄宕机。
InfoQ 编译 Noam Brown 与 Dwarkesh Patel 的访谈。OpenAI 于当地时间 9 月 29 日在 DevDay 2026 上推出全天候智能体 Dots,并开放 Agents API;此前 OpenAI 宣布用 1 万个 Agent 花 88 小时、1300 亿 token 解决了一道千禧年大奖难题。
推荐理由:OpenAI 把多 Agent 做成产品主线的同时,o1 奠基人指出现有实验只测到 16 个智能体规模,贡献占比与协调效率都缺乏数据支撑。
InfoQ 编译整理 Anthropic 技术负责人 Nicholas Marwell 和 Sholto Douglas 的播客访谈。两位负责人认为蒸馏只能复制当前前沿、无法推进下一代研发,未来一次训练成本可能达 100 亿至 1 万亿美元;他们还判断模型 18 个月内从工具变成初级团队成员,未来几年可能实现 AGI,并称美国不会接受单边放慢 AI 竞赛的方案。
arXiv 于 10 月 1 日宣布,每位提交者每自然月最多提交 2 篇论文,覆盖全部学科分类,被拒投稿也占用额度,同时保留活跃投稿不超过 3 篇的限制。此举因 9 月单月投稿达 40363 篇创新高、cs.AI 分类论文两年增长超 6 倍,约 260 名志愿审核员难以承受低质量稿件压力。限额只计实际提交人,多人合著可换人提交,独立学者受影响更大。
推荐理由:报道梳理了 arXiv 限投新政的细则与背景数据,读者可借此评估其对论文公开节奏和不同类型研究者的实际影响。
StartLux(原点星辉)发布并完整开源专用决策模型 StartLux-Decision,一次性推出 0.8B、2B、4B、9B、27B 五档版本。
Google 发布新一代模型 Gemini 4 Argon,面向长流程软件工程、企业知识工作与网络安全防御,输出 Token 上限从 64K 提升至 100 万,初期每百万输入 Token 2 美元、输出 10 美元。
推荐理由:梳理了 Gemini 4 Argon 的跑分、定价与分阶段开放节奏,读者可以据此评估其能力与实际可用性之间的距离。
Phillip Mortimer 在 QCon London 演讲中指出,AI 使代码趋向只写且不可读,重写往往比调试更容易,人工无法规模化审查 AI 生成的代码。他建议用测试定义行为、将编码智能体作为 CI action 实现自动化审查,并让智能体监听可观测性平台自动发起修复 PR,将意图与实现解耦,让开发者专注于创造力。
蚂蚁集团阿福 Harness 架构组负责人肖汉松将在 QCon 上海站分享阿福 Agent 小队处理线上 badcase 的两阶段实践:先用 Harness Engineering 让 Agent 自主完成修复和验证。
Meta 宣布推出开源 React 设计系统 Astryx Beta,该系统源自 Meta 内部八年积累,采用 MIT License,要求 React 19 或更高版本。
InfoQ 报道云栖大会企业级 Agent 论坛,以极客邦一个忘关开关导致 AI 应用 Token 费用从预估一万元涨到三万元的案例切入,指出 Agent 落地需要权限校验、预算约束与全栈协同。
开源 AI Agent 平台 openJiuwen 推出 WorkSwarm 全双工多模态能力,将实时音视频交互与 Core Agent 后台执行接入同一任务,用户可随时插话打断播报,复杂工具任务在后台排队运行。
QCon 上海站将于 10 月 22-24 日举行,10 多位来自阿里巴巴、飞猪、淘天集团、千问事业部、速卖通的技术专家将分享 AI 落地实践。议题覆盖 Agent 生产级基建、Agent 持续优化、AI 视频工业化与 AI Native 质量保障,其中手淘 TEKO 实现三端 100% 覆盖、96% 操作成功率,飞猪将单需求验证周期从 3 天缩至 1 天。
阿里云在云栖大会发布智能体沙箱 Agent Sandbox,定位为面向智能的新型算力形态,每分钟可创建 10 万个沙箱,模板创建与冷启动 P99 小于 180 毫秒,热启动 P99 小于 20 毫秒。
千问于 9 月 20 日开源统一图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分仅 7B 参数、32 层 Single-Stream DiT,已上线 GitHub、Hugging Face 和 ModelScope。
Jürgen Schmidhuber 发布长文,梳理其自 1987 年毕业论文以来在递归自我改进(RSI)上的研究脉络,包括元进化、自修改策略强化学习、快速权重与自指神经网络、OOPS 课程学习和 Gödel Machine 等路线。
阿里巴巴开源的 AI 代码审查工具 Open Code Review 以单周新增超 14,000 Star 登顶 GitHub Trending 周榜总榜第一,领先第二名 Claude Code,Star 数突破 40,000,成为 Alibaba GitHub Org 中 Star 数第一的项目。
智谱 9 月 28 日公布 ZCode 数据上传争议补偿方案,付费用户可获 4 张周额度重置卡和 4 张 5 小时额度重置卡,9 月 28 日至 10 月 7 日期间每日向全体用户发放十万份 1 亿 token。
推荐理由:文章围绕 ZCode 开源与补偿方案,梳理了仍缺失的代码历史、数据规模披露和核查范围,可帮助读者理解 Coding Agent 数据边界的验证难题。
Richard Socher 在 Latent Space 访谈中介绍其新公司 Recursive Superintelligence,公司已获 6.5 亿美元融资,目标是构建能递归自我改进的超级智能系统 Eureka Machine。
InfoQ 作者松子(李博源)撰文批评 FDE 培训市场把项目部级别的企业交付能力包装成零基础短期课程,指出同一个 FDE 标签下实际混有至少五种不同深度的工作,OpenAI 公开岗位要求五年以上经验,而部分课程以两日无需代码工作坊颁发 FDE 认证。
加州大学伯克利分校和麻省理工学院的研究人员开源了推理引擎 FreeToken,通过动态协同调度让消费级硬件运行前沿 MoE 模型。据论文基准测试,它在 8GB 显存的 RTX 4060 笔记本上运行 Qwen3.6-35B 约每秒 39 Token,相同 MoE 模型上解码速度比 Ollama、llama.cpp 快 3~4 倍,预填充快 6~30 倍。
普林斯顿大学人工智能创新中心主任王梦迪在 2026 Inclusion·外滩大会主论坛演讲中提出,大模型虽掌握大量人类知识,但尚未在物理、化学、生物等基础科学领域带来原创发现。
京东零售产研团队在 JDD 大会分享中指出,AI Coding 提升了代码产量,却未同步提升研发效率,反而加重了 Review、测试和评测环节压力,因为 AI 主要解决编码环节,而需求定义、架构设计等"上工程"仍是瓶颈。
当地时间 9 月 8 日,Meta 正式发布个人 AI 助手 Muse,定位为可全天候运行的个人 Agent,用户关闭应用后它仍能在独立云端虚拟机中继续执行任务。
京东在 JDD 全球科技探索者大会上发布由五大工业级原生模型组成的“超脑 3.0”和覆盖仓储、分拣、运输、配送的“狼族”集群,共九类产品、11 款机器人,已在全球超 10 个国家、全国超 20 个省份部署。
Cloudflare 在智能体周发布 Cloudflare Wallets,为 AI 智能体提供稳定币余额和 cloudflare.pay 标识,目前仅开放标识认领,充值与支付功能预计未来几个月推出。其支付基于 Linux 基金会托管的 x402 协议,虚拟钱包受额度上限、商户白名单、单笔交易最大金额三项规则约束,但只能校验单笔支付,无法表达多笔交易间关系,并发场景下的额度实现逻辑尚未公开。
安全研究人员警告,服务器内置的 BMC(基板管理控制器)存在固件弱点与 IPMI 管理协议缺陷,可能让攻击者获得操作系统之下的控制权,影响成千上万台服务器。由于 BMC 独立于主操作系统运行,攻击者可在系统重装等传统恢复流程后仍保持持久访问,而端点检测与反恶意软件对其几乎不可见。在 GPU 云等大规模 AI 基础设施中,一台被攻陷的 BMC 还可能成为通往其他服务器的跳板。
前 Google DeepMind 研究员 Ilia Shumailov 与 Alexander Panfilov 的论文显示,Anthropic、OpenAI、Google 的前沿模型加密推理块可被重放到同家族的小模型中解码,无需破解任何密码学算法。
腾讯 QQ 飞车项目组 Agent 落地负责人任磊达在 AICon 2026 深圳站分享了 Agentic 研发转型中的 Loop Engineering 实践。
Cloudflare 在 GitHub 上以 Apache-2.0 许可开源 Cloudflare OS,供企业团队在安全沙箱内构建个性化、可共享的工作软件并自动化重复性工作流。
快手主站技术稳定性专家王泽锋在 AICon 上海站分享了稳定性 Agent 柯南 AI 的工程实践,目前其在内部大前端研发中的用户渗透率接近 60%,根因分析结果完整采纳率稳定在 50% 左右。
StartLux 发布 StartLux-V1.0-27B-Preview,以 Qwen3.6-27B 为基座、不改模型结构,围绕工具选择、多步执行、状态检查和结果验证等 Agent 能力做后训练。
OpenAI 即将推出的旗舰模型 Astra 采用了名为“循环深度”(recurrent depth)的新技术,让文本在同一网络层中循环处理多次,以参数复用换取性能提升,旨在大幅增强代码编写和计算机操作能力。
谷歌云发布 AI 驱动的数据库运维智能体,包含用于简化数据库设置的上线智能体(Onboarding Agent)和可自动完成故障排查、性能优化与参数调优的可观测性智能体(Observability Agent)。
英伟达 CEO 黄仁勋在 G20 创新部长级会议上称,建设 1GW 规模 AI 基础设施约需 500 亿至 600 亿美元,约为单座 250 亿美元先进制程晶圆厂的两倍。他预计到本十年末全球 AI 基建规模将达约 100GW,并称 AI 替代的是标准化任务单元而非工作本身。
TikTok 站点可靠性工程师 Salman Munaf 在演讲中提出,AI Agent 一旦调用外部服务就变成分布式系统,会遇到网络超时、重复请求等已被命名的故障模式。
英伟达宣布已与 Hugging Face 达成最终收购协议,将以 129 亿美元买下这家开放模型平台,交易预计 2027 年上半年完成,仍需获得监管批准。Hugging Face 目前约有 1800 万用户,CEO Clément Delangue 希望未来几年提升到 1 亿以上;公司三位创始人和全体员工将继续留在团队并加入英伟达,其中 10 亿美元用于员工留任。
推荐理由:从双方访谈可见交易由来与留人安排,读者可据此判断中立平台易主后开源生态的走向。
原DeepSeek核心研究员魏浩然已于近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。他今年上半年加入百度后主导端到端文档感知研发,团队于2026年6月22日开源Unlimited OCR模型,在OmniDocBench测试中取得全球第一。魏浩然是DeepSeek-OCR与DeepSeek-OCR 2论文第一作者,并曾参与DeepSeek V3.2、V4研发。
前 Yandex 搜索、AI 和云业务负责人 Andrey Styskin 联合创办的 Keenable 走出隐身状态,完成由 Accel 领投的 2600 万美元种子轮,其自建 Web Index 已覆盖超过 1000 亿份文档,美国东部查询延迟低于 250ms(p95),面向 100 RPS 以上大规模客户的价格可低至每千次请求 1 美元。
Cursor 推出基于 Git 的代码托管平台 Origin,内嵌在其 AI 编辑器中,面向 Pro、Teams 和 Enterprise 套餐用户开启早期 Beta,定位为面向智能体的 GitHub 替代方案。
OVHcloud 将于今年秋季上调产品目录中绝大多数服务的价格,创始人 Octave Klaba 将原因归结为 AI 算力建设挤占内存与存储组件的晶圆产能。2026 款游戏服务器涨幅最大达 87%,其他近期推出的服务器涨幅在 40% 至 59%,旧款产品线保持不变。Klaba 称内存采购价已达 2025 年 6 月的 6 倍,预计 2027 年初升至 12 倍,并表示不会自行承担成本上涨。