15款中国版Codex桌面Agent盘点:从AI Coding走向AI Working
硅星人Pro盘点了15款中国版Codex类桌面Agent,包括腾讯WorkBuddy、Marvis、QClaw、字节豆包专业版、阿里QoderWork、Kimi Work、MiniMax Code、阶跃AI、AutoClaw等,认为它们沿工程任务外溢的通用能力、桌面系统层入口和嵌入办公生态三条路径分化。
按公众号阅读文章与观点
硅星人Pro盘点了15款中国版Codex类桌面Agent,包括腾讯WorkBuddy、Marvis、QClaw、字节豆包专业版、阿里QoderWork、Kimi Work、MiniMax Code、阶跃AI、AutoClaw等,认为它们沿工程任务外溢的通用能力、桌面系统层入口和嵌入办公生态三条路径分化。
DeepSeek 宣布所有部门人才扩招,大量岗位急招中。该招聘信息由深度求索于 6 月 25 日发布,未披露具体岗位名称、招聘人数或工作地点等细节。
华为在 2026 MWC 上海以“业网算协同创新,共赢 Byte+Token 双增长”为主线,发布 AI-Centric 目标网及 5G-A 大上行、体验经营、Token 经营等创新成果。
商汤在股东大会上首次预告下一代旗舰多模态基座模型 SenseNova-U1 Pro,定位为业界首个以「理解·生成·行动」原生统一为内核的多模态智能体基座,预计 2026 年 7 月启动邀请测试。
澳大利亚2025年12月实施的全球首例16岁以下社交媒体禁令已执行约半年,一项调查显示60%—70%的16岁以下用户仍能使用Facebook、Instagram、Snapchat和TikTok。青少年通过化妆绕过人脸识别、借用父母证件等方式保住账户,部分人还迁移到Roblox、Discord等未被重点限制的平台。英国政府近日宣布将效仿该禁令,于明年春季生效。
软银正于美国组建名为 Roze 的 AI 与机器人公司,计划最早 2026 年下半年上市,目标估值 1000 亿美元。据《金融时报》,Roze 核心资产包括软银以 30 亿美元收购的数据中心平台 DigitalBridge、65 亿美元收购的芯片公司 Ampere Computing 以及 54 亿美元收购的 ABB 机器人部门。
火山引擎丁远普与王彦辉提出,AI 时代数据底座需从传统存算分离转向以多模态数据湖为核心的新架构,因为数据形态、计算模式和管理维度三方面都已改变。他们以 LAS 产品为例,引入 Lance 数据格式支持大 Blob 存储、零成本动态加列和高性能随机访问,并提供以 Token 为新型算力的算子能力,涵盖 PDF 解析、视频编辑等场景。
Anthropic 向美国参议员和白宫官员发信,指控与通义千问(Qwen)实验室有关的操作人员在 4 月 22 日到 6 月 5 日期间利用近 2.5 万个虚假账户,与 Claude 进行了近 2900 万次交互,重点针对软件工程和智能体推理能力。
优步在 Uber Eats 推荐系统中引入实时用户信号与 Listwise 排序,将首页排序从手工统计特征演进到基于 Transformer 的序列建模,特征新鲜度从 24 小时缩短到秒级。新架构以实时信号处理层替换批处理特征流水线,持续摄取点击、搜索和下单历史,并让模型在一次推理中联合评估多个餐厅候选者以优化相对顺序。该能力已部署于 Uber Eats 首页信息流和发现类入口。
京东今年 4 月开源第一视角数据集 EgoLive,首批开放约 2000 小时视频、65,866 个 episode 和 346 个真实世界任务,覆盖家庭、仓储、药房等场景。
AICon 人工智能开发与应用大会·深圳站正式启动,将于 8 月 21 日—22 日举办,专题已陆续上线并同步开启议题征集。大会围绕 AI Infra、推理工程与异构计算、Harness Engineering、Agent 安全、Coding Agent、多模态大模型与 Agent 落地、机器人 AGI、超级 App AI 原生化等方向设置专题。限时早鸟票享 8 折优惠,报名立减 1160。
AI 创业者出海融资,投资人投的是创业企业而非产品,因此需要先搭建可融资的企业法律架构。清律纽约律师事务所高级律师南李在 Founder Park 的闭门 Workshop 中分享了相关实务,建议美国融资首选特拉华州 C-Corp,避免股权平分,并设置四年 Vesting(一年 Cliff),同时留意中美投资条款差异。
2026中国AI智能体大会(AgenticAICon 2026)将于7月2-3日在杭州举办,由智东西旗下智猩猩主办,主题为“范式跃迁 重塑世界”。
前云启资本董事总经理冯瑶创立美元基金 Seven X,专门投资成都七中校友及其二度人脉圈,首期基金设 4000 万美元硬顶,2026 年 2 月启动募资、3 月完成注册、6 月完成首关,LP 一半为校友。基金单项目投资 50–80 万美元、占股 5–10 个点,冯瑶承诺 GP carry 收益至少 10% 无偿捐给学校。
谷歌把 Computer Use 电脑操作能力内置进 Gemini 3.5 Flash,模型通过截图识别按钮、输入框等 UI 元素,进而执行点击、打字、滚动、切换标签等操作,覆盖网页、桌面软件和移动端界面。
量子位梳理的行业讨论认为 loop 正在成为替代 Prompt 的新工作方式,黄仁勋称没有人再写 Prompt,核心工作变成编写和管理 loop。
腾讯混元开源 PhoneBuddy-4B 手机 Agent 模型,并同步发布 PhoneWorld、PhoneBuddy、PhoneHarness、PhonePrivacy 与 PhoneSafety 5 篇系列论文。
影眸科技发布 Hyper3D Rodin Gen-2.5 3D 生成模型,并宣布完成由凯辉基金、上海国投先导领投的数亿元融资。新模型首次在 3D 生成中引入类 LLM 的 Thinking 机制,思考时长从 4 秒到 80 秒分五档可控,4 秒即可生成百万面级模型,Extreme-High 模式搭配同期上线的首个 12K 原生 3D 贴图模型。
伦敦国王学院团队在Nature旗下《Digital Psychiatry and Neuroscience》发表研究,提出放大螺旋框架,认为聊天机器人可能通过语言镜像、超个性化和谄媚逐步强化用户妄想。研究引用临床案例,有用户在与ChatGPT长期对话后出现妄想并住院七周;OpenAI在2025年10月披露约0.07%的ChatGPT周活用户出现精神病或躁狂相关紧急状况迹象。
上海交大和vivo提出自交换引导(SSG),通过在空间和通道维度交换token特征来引导扩散模型生成,无需文本条件、不加噪声、不改模型,该工作已被CVPR 2026接收为Oral。方法用原始与扰动两个前向分支的噪声预测做差修正生成方向,在COCO2014、COCO2017、ImageNet上多项指标超过SAG、SEG、PAG等无条件引导方法,并首次揭示通道维度扰动的引导效果显著优于空间维度。
OpenAI 与博通联合打造的首款定制 AI 芯片 Jalapeño 正式展示,博通 CEO Hock Tan 称其性能可媲美英伟达 Blackwell 或谷歌 TPU,OpenAI 计划今年年底前部署,从初始设计到流片仅用九个月。
推荐理由:呈现 OpenAI 与博通定制推理芯片的落地细节,以及训练与推理基础设施走向分化的路线差异。
Ethan Mollick 用 Fable 5 做了一个“有自我意识的贪吃蛇游戏”,整轮迭代大多只给出一句 Make it better,观察 AI 能否把一个模糊反馈翻译成可执行的修改动作。
山东大学与 MBZUAI 团队提出视觉 Token 剪枝框架 TransPrune,通过量化 Token 在前向传播中的幅值与方向变化(Token Transition),在保持性能无损的同时将推理成本降低 60%。该方法由 TTV 与 IGA 两个模块构成,与 VisionZip 等 projector-based 压缩方法结合时可再减少约三分之一计算量,性能仅小幅下降。
2026年国内厂商密集推出桌面 Agent 类产品,硅星人Pro 整理了15款代表产品并对比其定位、能力与生态布局。据 OpenAI 6月3日披露,Codex 周活跃用户已超500万,半年增长超7倍,产品形态也从 CLI 转向桌面 Agent。
OpenAI 发布首款自研芯片 Jalapeño,这是一款专为大模型推理设计的智能处理器,从最初设计到流片只用了九个月。OpenAI 负责从零设计芯片架构,博通负责芯片实现、网络和大规模量产,Celestica 负责板卡、机架与系统组装。OpenAI 称早期测试中每瓦性能将大幅优于当前业界最强水平,详细技术报告将在几个月后发布,芯片计划 2026 年底开始部署。
推荐理由:文章交代了 OpenAI 首款自研推理芯片的九个月开发周期以及与博通、Celestica 的分工,可供判断其全栈基础设施布局。
Simile 联合创始人兼 CEO Joon Sung Park 在深度访谈中介绍,团队通过一次 15 分钟访谈采集叙事数据、构建对应的 AI 智能体群体来模拟真实人类行为,对用户行为的预测准确率达到 85%。
数字生命卡兹克盘点了16个把自身能力封装成Skill、MCP或CLI的国产应用,覆盖餐饮、出行、地图、办公、支付与娱乐等领域。瑞幸、麦当劳、飞猪、滴滴、高德、腾讯地图、美团跑腿、飞书、钉钉、企业微信、腾讯文档、支付宝、微信支付、微信读书、网易云音乐、美图均在其中。
微信 AI 助手“小微”开启小范围内测,左上角星标入口被其取代,右滑即可唤起,主模型为腾讯自研 WeLM,部分场景由 DeepSeek 补充响应,WeLM 支持 128K tokens 上下文窗口。
美光科技第三财季营收增长346%、毛利率达84.9%,盘后股价涨逾13%,带动美股芯片股盘后全线上涨。阿里巴巴证实已起诉美国国防部,要求将其从"中国军事企业名单"中移除。孙正义在软银股东大会上称"称AI是泡沫是对AI的亵渎",并披露软银已在实体AI工厂启动机器人批量生产。
OpenAI 发布首款自研推理加速芯片 Jalapeño,联合博通和 Celestica 打造,专为 ChatGPT、Codex 及未来智能体产品定制。该芯片从零设计到流片只用 9 个月,计划 2026 年底初步部署到微软及其他合作伙伴的数据中心。OpenAI 暂未公布性能基准,仅表示早期测试每瓦性能大幅优于当前最先进水平,工程样片已在实验室运行 GPT-5.3-Codex-Spark。
谷歌DevRel团队成员Poehnelt开发出2.8万星的Google Workspace CLI后被解雇,谷歌随后发布官方同款工具GWS。
OpenAI与博通联合发布自研AI推理芯片Jalapeño,这是OpenAI第一颗自研智能处理器,从最初设计到制造流片用时九个月。工程样品已在实验室以量产目标频率和功耗稳定运行ML工作负载,其中包括GPT-5.3-Codex-Spark,早期测试显示其每瓦性能将大幅优于当前最先进水平。Jalapeño计划于2026年底开始初步部署,并与微软等合作伙伴共同推进吉瓦级数据中心。
推荐理由:原文交代了OpenAI自研推理芯片的架构取向、合作分工与部署节奏,读者可据此理解其全栈基础设施布局。
银联在中国国际金融展上展示跨境二维码互联互通、黄山银蝶数据中心、智能体支付开放协议(APOP)和消费补贴平台。今年6月中国印尼跨境二维码互联互通全面投产,银联网络已连通全球183个国家和地区、覆盖超1亿家境外商户,并发处理能力达每秒18万笔。APOP已联合19家伙伴试点,并在云闪付智能体中灰度上线。
微信AI助手小微近日开启测试,作者卫夕试用一天后给出15条体验与思考。小微将语音设为默认输入方式,入口覆盖聊天、公众号与视频号,并可在群聊单聊中依据上下文帮用户组织回复。作者实测其主模型为微信自研WeLM,部分回答会调用DeepSeek,还能用自然语言在几分钟内生成仅供自己使用的个人小工具。
Anthropic 和 Meta 内部的 AI 协作正在让员工陷入职业意义危机。Anthropic 内部报告披露,截至 2026 年 5 月其代码库中超过 80% 的合并代码由 Claude 编写,Claude Code 与 Cowork 团队工程负责人称工程师因各自与 AI 代理协作而变得孤独。
IPE《2026全球资管500强》显示,贝莱德、先锋资管、富达投资稳居前三,中国公募排名最高的易方达和华夏基金分列第57位和第72位。华夏基金副总经理阳琨认为,AI产业链集中东亚,国内资管机构依托本土产业链深度研究优势,有望像新能源车带动国产车企一样实现弯道超车。但他也指出,中资机构资金、客户、资产集中于内地,全球化布局仅近十年起步,跃升全球龙头可能至少还需五年以上积累。
OpenAI 发布首颗自研 AI 芯片 Jalapeño,由 OpenAI 与 Broadcom 联合发布,专门用于大模型推理加速而非训练,并兼容所有 LLM。
推荐理由:芯片由 OpenAI 与 Broadcom 联合设计并给出 2026 年底部署时间和多代路线图,可用于观察自研算力的推进节奏。
AI 研究者 Nathan Lambert 撰文认为,GLM-5.2 是首个在编程框架中作为通用智能体使用时手感极佳的开放权重模型,官方于 6 月 16 日以 MIT 协议开放权重。
推荐理由:Nathan Lambert 结合实测与多个基准讨论 GLM-5.2 在编程智能体中的表现,读者可据此观察开源与闭源模型的能力时差。
豆包正式上线收费套餐,标准套餐68元/月、加强套餐200元/月、高级套餐500元/月,免费入口保留,被拆出来收费的是办公任务模式、本地电脑操作、浏览器调用、Office处理、Skills、应用生成等更复杂的任务。
Google 资深工程师 Justin Poehnelt 用 Rust 开发的 Google Workspace CLI 登上 Hacker News 热搜并获数千星标,随后被公司以品牌合规为由解雇。