TRAE Work Design 模式实测:需求、设计到代码全链路跑通
TRAE Work 上线 Design 模式,在同一平台里串起 Work 聊需求、Design 出稿、Code 写代码的全流程。该模式可解析 Figma 文件提取品牌色、字体与组件样式,也支持对话、框选、面板三种改图方式。实测从需求文档到导出代码约一小时跑完。
微信公众号
TRAE Work 上线 Design 模式,在同一平台里串起 Work 聊需求、Design 出稿、Code 写代码的全流程。该模式可解析 Figma 文件提取品牌色、字体与组件样式,也支持对话、框选、面板三种改图方式。实测从需求文档到导出代码约一小时跑完。
英伟达开源 NeMo AutoModel,在 Hugging Face Transformers v5 基础上只需加一行 import,即可让 MoE 模型微调训练吞吐提升 3.4-3.7 倍,GPU 显存占用降低 29%-32%。
它石智航联合新加坡国立大学、上海交通大学、中科院自动化所、复旦大学发布 TacForeSight,一种力条件触觉世界模型,首次将腕部力觉作为未来触觉状态的先导信号,用于预测短时接触演化并引入动作生成。该框架在花瓶擦拭、卡片滑动、管件插入等五类接触任务上平均完成率近80%,动态扰动场景平均达86.7%,并支持20Hz实时推理。
上海交通大学与 vivo 团队提出持续学习框架 Octopus,首创无需历史数据的梯度正交化技术 HiFGO,让多模态大模型在不访问旧任务数据的情况下避免灾难性遗忘。
Claude Fable 5 被曝在手机端 Claude Code 中重新出现,可交互并支持 SVG 生成、git status 和 PR,AWS 也可调用但需身份验证,随后 Anthropic 员工辟谣称是 UI bug。与此同时,GPT-5.6 预览版已出现在内部路径中,OpenAI CEO 奥特曼表示将按美国要求分批释放。
苹果于6月25日上调 Mac、iPad、iPad mini、HomePod、Apple TV 4K、Vision Pro、iMac、Mac mini、Mac Studio 等多条产品线价格,Mac 涨幅约15%-20%,iPad 约15%-25%。
推荐理由:文章把苹果全线涨价与 AI 数据中心抢占内存产能联系起来,呈现成本向消费电子传导的路径。
谷歌把 Computer Use 电脑操作能力内置进 Gemini 3.5 Flash,模型通过截图识别按钮、输入框等 UI 元素,进而执行点击、打字、滚动、切换标签等操作,覆盖网页、桌面软件和移动端界面。
量子位梳理的行业讨论认为 loop 正在成为替代 Prompt 的新工作方式,黄仁勋称没有人再写 Prompt,核心工作变成编写和管理 loop。
腾讯混元开源 PhoneBuddy-4B 手机 Agent 模型,并同步发布 PhoneWorld、PhoneBuddy、PhoneHarness、PhonePrivacy 与 PhoneSafety 5 篇系列论文。
影眸科技发布 Hyper3D Rodin Gen-2.5 3D 生成模型,并宣布完成由凯辉基金、上海国投先导领投的数亿元融资。新模型首次在 3D 生成中引入类 LLM 的 Thinking 机制,思考时长从 4 秒到 80 秒分五档可控,4 秒即可生成百万面级模型,Extreme-High 模式搭配同期上线的首个 12K 原生 3D 贴图模型。
伦敦国王学院团队在Nature旗下《Digital Psychiatry and Neuroscience》发表研究,提出放大螺旋框架,认为聊天机器人可能通过语言镜像、超个性化和谄媚逐步强化用户妄想。研究引用临床案例,有用户在与ChatGPT长期对话后出现妄想并住院七周;OpenAI在2025年10月披露约0.07%的ChatGPT周活用户出现精神病或躁狂相关紧急状况迹象。
上海交大和vivo提出自交换引导(SSG),通过在空间和通道维度交换token特征来引导扩散模型生成,无需文本条件、不加噪声、不改模型,该工作已被CVPR 2026接收为Oral。方法用原始与扰动两个前向分支的噪声预测做差修正生成方向,在COCO2014、COCO2017、ImageNet上多项指标超过SAG、SEG、PAG等无条件引导方法,并首次揭示通道维度扰动的引导效果显著优于空间维度。
OpenAI 发布首款自研推理加速芯片 Jalapeño,联合博通和 Celestica 打造,专为 ChatGPT、Codex 及未来智能体产品定制。该芯片从零设计到流片只用 9 个月,计划 2026 年底初步部署到微软及其他合作伙伴的数据中心。OpenAI 暂未公布性能基准,仅表示早期测试每瓦性能大幅优于当前最先进水平,工程样片已在实验室运行 GPT-5.3-Codex-Spark。
谷歌DevRel团队成员Poehnelt开发出2.8万星的Google Workspace CLI后被解雇,谷歌随后发布官方同款工具GWS。
中国人民大学高瓴人工智能学院与微软研究院提出 Arbor,一个面向自主科研的框架与开源工具包,通过 Hypothesis-Tree Refinement 把多轮实验组织为持续演化的研究状态,并登上 Hugging Face Daily Paper 日榜第一。
豆包专业版结束全免费,新增三档订阅:标准版68元/月、加强版200元/月、高级版500元/月,学生价38元/月,付费版接入豆包2.1系列大模型。量子位付费实测其办公任务模式可在授权后操作本地电脑发小红书、生成应用、做PPT并调用Skills,但标准版做一版应用就烧完5小时额度。作者判断免费版够日常使用,想体验Agent能力可从68元标准版起步,500元高级版更适合高频办公的重度用户。
北京大学、清华大学、星尘智能等机构联合提出 StableVLA,用轻量级 IB-Adapter 替换 VLA-Adapter 的 MLP projector,在视觉特征进入策略模型前筛选信息,无需额外扰动数据即可提升鲁棒性。
Momenta冲刺港股IPO,将自身定位为物理AI基座模型构建者,其R7世界模型已量产并首发搭载于上汽大众ID. ERA 9X。招股书显示2023年至2025年营收从7.43亿元增至24.13亿元,许可收入从0.23亿元增至9.68亿元。据CIC灼识咨询数据,2025年3月至2026年2月中国第三方城市NOA供应商市场中,搭载Momenta系统的量产车销量市占率达65%。
深圳制造的灵晟超级计算机登顶全球超算 TOP500 榜单,打破西方近十年垄断,时隔九年中国超算重回榜首。灵晟采用全自研纯 CPU 架构,未使用一块 GPU,是全球首台纯 CPU 架构突破 2EFlops 的超算系统。其核心处理器为自研 LX2 芯片,内嵌 AI 矩阵加速单元,集成国产 HBM,并同步拿下 HPCG 榜单第一。
推荐理由:灵晟以无 GPU 的纯 CPU 架构登顶 TOP500,为 E 级算力不依赖 GPU 的路线提供了一份实例。
Aether AI 完成 2000 万美元种子轮融资,由经纬创投领投,英诺基金、SWC Global、九合创投参投,走因果世界模型路线,区别于视频生成、3D 生成和 JEPA。其因果世界模型在机器人操作任务上相比传统世界模型实现 25%-50% 成功率提升和 5 到 10 倍样本效率提升,约 80% 数据来自模拟、第一视角和公开视频。
香港大学 MaRS Lab 张富团队研发的 FAST-LIVO2 获 IEEE TRO 傅京孙纪念最佳论文奖,为该奖史上第二次颁给中国科研团队。论文由郑纯然一作、张富通讯,提出激光-视觉-惯性融合的直接法里程计与建图系统,适配弱纹理、光照剧变场景。项目开源后 GitHub 累计约 4.2k Star。
上海人工智能实验室、上海交通大学、香港中文大学团队提出TRM(Thinking Reward Model),用ME² principle和DAG-based pairwise evaluation给大模型推理过程打分,把"想得好"变成可训练的奖励信号。
Anthropic 发布企业协作工具 Claude Tag,定位为 Claude Code 的一次进化,可嵌入 Slack 频道让整个团队共享同一个 Claude。
小鹏汽车基于亚马逊云科技 Kiro、Amazon Bedrock 和 Amazon EKS 搭建内部 AI 编程与 Agentic 工作平台"灵犀",实现 AI 代码覆盖率超 70%、700 多个 Skills、14 万多个工作流,SRE 缺陷自动修复从两天压缩到 10 分钟。
港中文与 FaceMind 团队提出 ToxPrune,在推理阶段从 BPE 词表中剪除有毒子词,无需训练或改权重即可让模型无法输出脏话。在专门生成不良内容的 NSFW-3B 上,毒性评分从 0.89 降至 0.13,同时 BLEU、ROUGE 和多样性指标不降反升;在 Llama-3.1-6B 上 Distinct-1 从 0.232 提升至 0.323。
微信正在灰度测试原生 AI 助手小微,它是微信团队自研的 Agent,文字和语音都能聊,可操作微信原生功能并调用小程序。量子位实测其能一键总结群聊与朋友圈、建待办提醒、调用小程序,还能一句话生成带页面、按钮和统计图表的小工具。
字节发布豆包 Seed 2.1 系列,包含 Doubao-Seed-2.1-Pro 和 Doubao-Seed-2.1-Turbo 两个模型,API 已在火山方舟全量上线。
在维也纳落幕的机器人顶会 ICRA 2026 上,深圳大学胡瑞珍团队、中科院工业人工智能研究所徐凯团队联合视比特机器人与卡尔顿大学凭 IMR-LLM 获最佳论文奖(自动化方向)。
百度开源全新 OCR 模型 Unlimited OCR,主打一次读完几十页长文档,在 OmniDocBench v1.5 综合得分 93.23%,v1.6 达 93.92% 刷新 SOTA,成绩超过此前的 DeepSeek OCR。
即将入职OpenAI的华盛顿大学NLP方向博士Alisa Liu把自己的求职经历以Blog形式开源,同时分享了一份从神经网络基础覆盖到后训练的LLM零基础学习笔记。
香港大学 XLANG Lab 与阿里巴巴 Qwen 团队提出并开源可控 VLA 框架 FineVLA,让模型按语言指定用哪只手、从哪个方向接近、接触物体的哪个部位完成任务。
英伟达在芝加哥 Automate 2026 大会上发布 Halos for Robotics,一套覆盖芯片、传感器、操作系统到安全认证的全栈机器人安全系统,核心安全框架已开源。
中国科学院软件研究所联合推出 PerfEvolve 框架,将静态调参文档转化为 Agent 可执行的过程化调参技能,在 PostgreSQL 上最高实现 58.9% 的性能提升。
菲尔兹奖得主陶哲轩分享IEANTN项目体验,称自动形式化技术最近几周突然跨过某个临界点,过去需志愿者等数周才能认领的Lean形式化任务,现在AI数小时就能完成,待认领issue队列基本清空。
恩和科技(Bota Biosciences)发布生物学协议语言BPL及代码自动生成工具BPL-COGEN,可将自然语言实验方案转为可编译的标准化代码,模型首轮生成编译通过率82.3%,最多三轮自动修复后整体通过率达98.6%。基于BPL,恩和推出全球首个面向生物制造领域的Physical AI平台SAION AI,覆盖文献检索、方案生成到自动化湿实验的完整闭环,单个项目同期可落地30万组实验。
特斯拉向 USPTO 提交 "MEGAPOD" 商标申请(序列号 99893717,申请日期 2026 年 6 月 18 日),计划销售用于 AI 计算的模块化数据中心硬件系统,涵盖服务器、AI 数据处理硬件、网络设备、配电单元和冷却系统,申请基础为 intent-to-use。
可口可乐与百度一镜合作,用prompt生成了一支5人5城的世界杯限定版TVC,并上线以范志毅为主角的实时互动数字人,端到端响应控制在2秒以内、24小时在线。该数字人由文心大模型和百度一镜数字化群体智能AI大脑支撑,能识别情绪、接梗并实时生成语音表情动作。截至2025年底,百度一镜数字人主播数已突破10万,覆盖30多个行业。
DeepSeek Harness部门负责人崔添翼再次在线直聘,放出Harness研究员、Harness工程师和Harness产品经理三个岗位。招聘从5月启动后持续至今,崔添翼称每天都在面试。JD显示研究员侧重定义上下文管理、长期记忆、Subagent与Multi-Agent等前沿问题。
清华大学联合团队开源的 Spatial-TTT 被 ECCV 2026 接收,该模型用 fast weights 作为在线更新的空间记忆,可处理最长 120 分钟流式视频。
量子位不完全统计,2026年上半年(截至6月12日)国内具身智能赛道共融资约438亿元,其中超过一半流向以模型为核心的机器人大脑公司。本体派公司同期融资仅占12.8%,低于核心零部件企业的14.4%;35家大脑派公司中有20家处于早期融资阶段,没有一家进入后期阶段。