本周AI项目推荐:ego lite、OpenDesign、Monid——当Codex生态逐渐崛起
围绕 Codex、Claude Code 等 Coding Agent 的执行能力,一批创业项目正从单点能力切入补全 Agent 生态。
按公众号阅读文章与观点
围绕 Codex、Claude Code 等 Coding Agent 的执行能力,一批创业项目正从单点能力切入补全 Agent 生态。
OpenAI 即将推出的旗舰模型 Astra 采用了名为“循环深度”(recurrent depth)的新技术,让文本在同一网络层中循环处理多次,以参数复用换取性能提升,旨在大幅增强代码编写和计算机操作能力。
谷歌云发布 AI 驱动的数据库运维智能体,包含用于简化数据库设置的上线智能体(Onboarding Agent)和可自动完成故障排查、性能优化与参数调优的可观测性智能体(Observability Agent)。
英伟达 CEO 黄仁勋在 G20 创新部长级会议上称,建设 1GW 规模 AI 基础设施约需 500 亿至 600 亿美元,约为单座 250 亿美元先进制程晶圆厂的两倍。他预计到本十年末全球 AI 基建规模将达约 100GW,并称 AI 替代的是标准化任务单元而非工作本身。
TikTok 站点可靠性工程师 Salman Munaf 在演讲中提出,AI Agent 一旦调用外部服务就变成分布式系统,会遇到网络超时、重复请求等已被命名的故障模式。
OpenAI Codex 工程师 Thomas Ricouard 用 GPT-6 Astra 从一句提示词在 Blender 里生成可编辑的 3D 住宅场景,再导出到 Unreal Engine 5,做成可以像玩游戏一样走进去的实时版本。
作者用 GPT-6 Astra 配合 Blender 和 Three.js,仅凭从短视频平台下载的模糊参考图,就为世界最高多彩琉璃塔飞虹塔生成了交互式 3D 场景和演示视频。
《财经》杂志报道,投资人追逐 DeepSeek 新一轮融资份额数月,最终发现嘉兴时远、青岛浩正等机构兜售的通道份额均未出现在首轮融资交割名单中。多位参与交易人士称,DeepSeek 最新估值约5000亿元,计划在第二轮融资500亿元,并要求投资者锁定期五年。月之暗面已于8月14日声明不存在所谓的朋友基金、老股额度或授权中介,并已就虚假融资乱象向公安机关反映。
推荐理由:报道还原了围绕 DeepSeek 与月之暗面份额交易的虚假通道和高额费率细节,呈现一级市场 AI 融资的信息不对称。
GPT-6 Astra 已向所有订阅用户推送,作者在 ChatGPT 和 Codex 中实测后认为其综合能力追平 Claude Fable 5,速度比 GPT-5.6 Sol 大幅提升。前端与 3D 网页生成的细节和形式感提升明显,代码审查深度加强,一次系统性能审查列出大量问题并在约 2 小时内完成修复。作者还给出简化后的 AGENT.md 和手动开启 Codex 实验性上下文管理的配置方法。
推荐理由:作者以第一手实测对比 GPT-5.6 Sol,给出速度、前端 3D 生成和代码能力上的直观差异。
中国模型在海外获得开发者采用,但腾讯 WorkBuddy、阿里 QwenWork 国际版等大厂 AI 办公产品出海仍未打开局面。国产 AI 办公产品在海外渠道获取一名付费用户的成本约 270 至 280 美元,高于 Codex、Claude Code 的 170 至 180 美元。
一个让模型画 SVG、再由其他模型猜词的"你画我猜 Benchmark"公布首期结果:GPT-6 Astra 以 75.5 分险胜 Gemini 3.8 Flash(74.6)和 Claude Fable 5.1(74.3),三家置信区间重叠。八个参评模型共画 150 个词、1350 张图,反常识题全场得分仅 21-34 分,且思考 token 更多、花费更贵的模型并未稳定换来更高分。
AI研学营成为暑期研学市场最热的生意,携程数据显示今年暑期AI研学订单较去年同期增长370%,2026年全年国内研学市场规模有望突破2400亿元。五位家长的自述显示,12800元的上海AI创造营直到开课第一天孩子到现场才见到合同,一万多元的香港5天营结束后孩子对AI的了解与去之前差不多,6000元的6天AI小CEO营被家长形容为带AI概念的托管班。
OpenAI推出新模型GPT-6 Astra,其负责人宣称"欢迎来到AGI时代",沃顿商学院教授测试显示该模型可连续工作五天,将个人全部数据记录编译成知识库。文章认为AI正从任务层面替代分析师、律师助理等标准脑力岗位,中间层职业加速塌陷,而水管工、护理等需在场的手艺与服务岗位暂时安全。
微软 CEO Satya Nadella、英伟达 CEO 黄仁勋等科技领袖联署《开放权重与美国 AI 领导力》公开信,主张避免对开源模型过早施加限制。作者 Packy McCormick 认为 AI 更像可规模化生产、持续提炼的基础商品"石油",而非会产生意识、拥有自主目标的"上帝",限制廉价模型相当于向所有企业征税。
前 Yandex 搜索、AI 和云业务负责人 Andrey Styskin 联合创立的 Keenable 走出隐身状态,并完成由 Accel 领投的 2600 万美元种子轮融资,团队约 15 名工程师,从底层重做抓取、索引、检索与排序,把搜索能力通过 REST API、MCP Server 和 CLI 交给 Agent。
AI 前线采访 TiDB 唐刘、腾讯研究院茹炳晟、Floatboat 架构师 Remy 和字节 Trae 天猪,讨论模型能力趋同后 Coding Agent 的竞争焦点。
GPT-6 Astra 已全量开放,所有付费用户均可使用,Plus 用户只能在 Work 和 Codex 中调用,且同样任务的消耗速度约为 Sol 的两倍。作者实测大部分任务用 medium 档位即可,在 DeepSWE 上 medium 与 max 性能差距不到 1%,消耗速率却低 25%。
上海交通大学、新加坡国立大学、美团、香港中文大学等团队推出 UrbanGround,用香港真实三维地理数据搭建可连续行走的城市沙盒,评测 10 个多模态模型的空间导航能力。
盛大集团旗下 Alaya Lab 发布 Project Gear,包含面向游戏制作的 Gear Engine 与面向人机协作的 Gear Platform,探索下一代游戏工程与游戏形态。
OpenAI 于北京时间9月4日凌晨发布新一代旗舰模型 GPT-6 Astra,首批拿到模型的开发者已开始实测。有用户用一周时间在虚幻引擎里搭出一座曼哈顿,也有人让它在 Blender 里生成可直接在浏览器运行的3D游戏,耗时约30分钟到2小时,还能操控 Final Cut Pro 完成导入素材、调色、同步 clips 等剪辑流程。
陶哲轩发文警告,AI以黑盒方式抢先解决数学难题,可能抑制探索过程中那些有启发性的失败,反而阻碍数学发展。他提到GPT-6 Astra发布后在孪生素数猜想上用Lean形式化证明把连续素数间距上界从246推到186,Anthropic与Axiom同期分别宣布缩至188和212。他以纳维-斯托克斯方程全局正则性问题为例,指出若答案由AI在内部完成且过程不公开,这个问题将不再能像过去那样孕育新的数学思想。
光象科技联合清华大学李升波教授课题组发布第一代物理原生世界模型 Phi-WM 1.0 ActEffect,该模型只在训练阶段预测动作后果并反馈给策略,训练完成后退出部署链路。它在 LIBERO 上取得 98.8% 平均成功率,在 LIBERO-PLUS 上达 80.3%,在 29 维动作空间的 RoboCasa-GR1 上为 67.5%。
EMNLP 2026 Main Conference 接收的论文 LEAP 提出,把 LLM 预测从一次性读取全部证据直接作答,改为每次只分析一条证据的似然、再由显式概率模型统一计算 posterior。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均为全职,工作地点北京中关村,校招接受实习且可转正。截至 2025 年,量子位微信公众号订阅用户超 260 万,全网用户超 700 万,日均阅读量 200 万+。简历投递至 zhaopin@qbitai.com,需附科技行业代表作品。
一篇报道走访一线教师与课件定制商,呈现AI赋能课在赛课评审硬性要求下如何变成教师付费外包、上台表演的面子工程。山东一家30人公司三年为两三千名老师定制AI赋能课件,单价800元到10000元,赛课成绩与多地职称评定直接挂钩。教育部今年3月部署“人工智能+教育”并出台行动计划,但学生端缺少终端、评价体系仍以知识点考核为主,多数AI赋能课只能用来展示。
智本社文章以科斯、杨小凯和威廉姆森的交易费用理论,分析英伟达如何通过融资、采购承诺和延长账期组织AI产业链。截至2026年7月,英伟达采购承诺从1190亿美元升至2790亿美元,应收账款631亿美元、应付账款151亿美元,并为部分投资级客户提供90天至一年的付款期限。文章还提到英伟达以129.3亿美元收购Hugging Face,并指出市场担忧其循环融资与风险集中。
英伟达宣布已与 Hugging Face 达成最终收购协议,将以 129 亿美元买下这家开放模型平台,交易预计 2027 年上半年完成,仍需获得监管批准。Hugging Face 目前约有 1800 万用户,CEO Clément Delangue 希望未来几年提升到 1 亿以上;公司三位创始人和全体员工将继续留在团队并加入英伟达,其中 10 亿美元用于员工留任。
推荐理由:从双方访谈可见交易由来与留人安排,读者可据此判断中立平台易主后开源生态的走向。
原DeepSeek核心研究员魏浩然已于近日带队转入百度基础模型研发部,出任文心大模型多模态算法负责人。他今年上半年加入百度后主导端到端文档感知研发,团队于2026年6月22日开源Unlimited OCR模型,在OmniDocBench测试中取得全球第一。魏浩然是DeepSeek-OCR与DeepSeek-OCR 2论文第一作者,并曾参与DeepSeek V3.2、V4研发。
前 Yandex 搜索、AI 和云业务负责人 Andrey Styskin 联合创办的 Keenable 走出隐身状态,完成由 Accel 领投的 2600 万美元种子轮,其自建 Web Index 已覆盖超过 1000 亿份文档,美国东部查询延迟低于 250ms(p95),面向 100 RPS 以上大规模客户的价格可低至每千次请求 1 美元。
Cursor 推出基于 Git 的代码托管平台 Origin,内嵌在其 AI 编辑器中,面向 Pro、Teams 和 Enterprise 套餐用户开启早期 Beta,定位为面向智能体的 GitHub 替代方案。
深圳团队 EvoMap 推出 EvoX,用无中心调度的蜂群模式组织多 Agent 协作。同一 Claude Haiku 4.5 模型在 563 道逻辑、数学与物理题上,单 Agent 正确率 26%,Sub-Agent 模式 38%,蜂群模式升至 70% 以上。
Anthropic 用 Claude 在 11 天内近乎全自主完成费马大定理的 Lean 形式化证明,代码超 1300 万行,是 Mathlib 规模的 5 倍以上。
推荐理由:Claude 在 11 天内完成费马大定理的 Lean 形式化,读者可据此了解机器验证在数学审查中的实际进展。
GPT-6 Astra 全量发布,Pro、Business 和 Enterprise 用户可在 ChatGPT 和 Codex 中使用,API 同步上线,支持一百万上下文,知识截止到 26 年 4 月 30 日。
沙特国家 AI 公司 HUMAIN 发布主权大模型 HUMAIN M3,基于 MiniMax M3 后训练,加入超过 1 万亿阿拉伯语 token,并做了面向沙特的对齐与 guardrail,在七项阿拉伯语 benchmark 上平均分第一,超过 GPT-5.6 SOL 和 Opus 5。
多项调查与案例显示,因AI裁员的企业正陆续回聘员工:Careerminds对600名HR的调查中,只有8.4%认为AI驱动的重组完全达到预期,35.6%的公司补回了超过一半此前裁掉的岗位。
蔚来二季度营收321.4亿元、同比增长69.1%,上半年总营收576.7亿元居新势力第一,但Non-GAAP经调整净利润仅2610万元,财报后港股、美股两日累跌近10%。李斌称最大压力来自AI数据中心(AIDC)抢购内存等资源,二季度单车成本较去年底上涨约1.4万元,下半年预计再涨两三千元,AIDC影响至少还要持续两年。
胡渊鸣所在的 Meshy 团队发布互动游戏生成架构 Mora(Multimodal Open-world Real-time Architecture),早期版本 Mora 1 已上线 mora.fun 可体验。
元点机器人Bridge“小桥”9月2日开售首日销量突破600台,登顶京东人形机器人销量榜,首发价8888元、整机约13公斤。该本体采用“形态与控制协同设计”,可完成双足行走、避障、舞蹈和后空翻,并支持手柄、VR和动作捕捉全身遥操作。元点还规划OpenBridge开放SDK、运动控制接口和训练资源,通过Skill Hub承载模型、数据与动作链。
OpenAI 发布 GPT-6 Astra,API 模型编号 gpt-6-astra,上下文窗口 1.05M Token、最大输出 128K Token,知识截止 2026 年 4 月 30 日,定价为每百万输入 Token 10 美元、每百万输出 Token 50 美元,目前只向部分组织开放。
推荐理由:原文给出了 GPT-6 Astra 在操作电脑、ARC-AGI-3 与安全对齐上的具体数字,读者可对照 GPT-5.6 Sol 看能力变化。
一位用户称已完全卸载 OpenClaw、Hermes Agent,转而使用 Grok Bot,认为它才是真正的 Jarvis。