普林斯顿团队发布全开放文生图模型 i1,3B 参数在五项基准领先 29.5 个百分点
普林斯顿大学刘壮团队发布 3B 文生图模型 i1,训练代码、模型权重与数据配方全部公开,其结论来自 300 多组控制实验和超过 70 万 TPU v6e 小时。
微信公众号
普林斯顿大学刘壮团队发布 3B 文生图模型 i1,训练代码、模型权重与数据配方全部公开,其结论来自 300 多组控制实验和超过 70 万 TPU v6e 小时。
在第二届世界人形机器人运动会开幕式上,银河通用的网球机器人与网球冠军郑洁先搭档完成全球首场人机混合双打表演,随后进行全球首场人形机器人与人类运动员的网球单打。比赛由银河通用自研的具身智能大模型银河星脑(AstraBrain)支撑,机器人自主看球、判断落点、移动和挥拍,训练结合人类动作数据与虚拟网球环境,再通过 Sim2Real 迁移到真实赛场。
DeepSeek 向其 API 用户发布通知,自北京时间 8 月 23 日 00:00 起调整峰谷计费规则,周末全天不再区分峰谷时段,统一按低谷时段价格收费。此前 V4-Flash 和 V4-Pro API 已改为峰谷计费,高峰时段价格最高是低峰的 2 倍,开发者可把批量任务放到周末运行。有用户称一周的活两天干完、账单减半,同时也有短剧团队和程序员团队开始按算力峰谷时段调整作息。
Google 提出 EnvHarness,一种类比 agent Harness 的环境侧组件,通过环境布置、交互规则、链接环境三类组件控制环境与 agent 的交互方式,且不改变环境原有 reset/step/obs 接口。
UC Berkeley、MIT 等机构联合团队开源边缘端推理系统 FreeToken,可在单卡 RTX 5090 上运行满血 DeepSeek-V4-Flash 284B、在笔记本 RTX 4060 上运行 Qwen3.6-35B,论文与 GitHub 仓库已公开。
匿名模型 Ox Alpha 近日出现在 OpenRouter,拥有 100 万 token 上下文,支持文本、图片和视频输入,可调用工具,目前完全免费。
超脑未来、未来宇航与希云柔控达成战略合作,启动 SpaceClaw(太空龙虾)计划,目标在 6 个月内完成首阶段在轨验证,并同步发布太空具身智能基准 OrbitBench。
微软、南京大学等机构的研究人员提出 LoopsBench,一个面向 long-horizon software engineering 的 Coding Agent Benchmark,将长周期任务拆分为 Development Unit 并表示为 Dependency DAG,用 Ready Frontier 和 Regression Obligation 观察执行过程。
美图影像研究院(MT Lab)提出一致特征传输(CFT),将人像重打光重构为光照一致的特征传输问题,在 Rectified Flow 框架上显式学习源图与目标图分布间的光照变换,该成果已被 ECCV 2026 录用。
据彭博社报道,Anthropic 正在组建内部芯片团队,并聘请前谷歌 TPU 核心负责人 Amir Salek 加入计算部门,他将向计算平台主管 James Bradbury 汇报。
维他动力在 WRC 首次公开人形机器人 Vbot ATOM 并开启预订,同时发布「Vbot Embodied Genome|具身基因组」技术体系,包含 Vbot-OmniDuplex、Vbot-WorldModel、Vbot-EvoMorph 三大模型,分别负责多模态流式全双工交互、动作条件未来预测与策略评估、共享策略骨干与多本体 Real-Sim-Real 进化。
OpenAI 产品设计负责人 Ian Silber 结合 ChatGPT 和 Codex 的产品实践表示,AI 已能加速页面与原型生成,但无法独立完成产品判断,设计师重心正从方案制作转向问题定义、方向判断和结果验证。他认为设计师需持续测试模型能力边界,判断需求该由模型行为、上下文还是界面流程解决,产品、设计与工程的职责边界会进一步重叠。
极佳视界 8 月 19 日发布新一代具身基础模型 GigaBrain-0.7,首次提出 System-3 概念,把世界模型放进机器人实时决策回路,让机器人先预演判断再执行动作。该模型在 8 月 14 日上线的智元 RoboColiseum 平台包揽 4 项评测第一,并在自研本体 Maker H01 上实现超 20 分钟、超 10 个任务的长程复杂操作一镜到底,模型与代码将在不久后开源。
DeepSeek 在 API 平台上线多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,开发者把请求中的 model 参数设为 deepseek-v4-flash-vision-exp 即可调用,模型名末尾的 Exp 表明这是实验性版本。
深势科技正式发布玻尔·科学空间(公开测试版),为科研人员提供连接本地与云端数据、计算和实验资源的统一桌面工作环境,并内置 SciMaster、BioMaster、PharmMaster、MatMaster 等 AI 学科专家。
Spark-to-Paper 是一套以 13 个可组合技能运行在现有编程助手内的端到端论文生成系统,可从一句研究想法完成文献检索、实验设计执行、论文写作与可编辑配图,直至输出可直接编译的 LaTeX 项目。
墨奇智能在世界机器人大会首次公开亮相轮式机器人 MORPHI KINO,并发布 Agentic-Native 技术路线与 MoRA(MORPHI Reasoning & Autonomy)具身模型架构,将目标维护、执行记忆和进度判断从 System 2 下沉到 System 1。
豆包工作任务模式密集更新,上线技能商店、连接器和可以分工协作的工作伙伴三项能力,让 AI 从一问一答转向规划步骤、操作电脑并在飞书等系统中交付结果。机器之心用一段不到 400 字的提示词搭起从选题到成稿的编辑部流程,豆包可操作 Windows 电脑、在云电脑中持续运行并由手机远程查看和调整。
AutoDesign 提出 MetaHarness Optimization,让 DesignHarness 通过内外循环自我进化,Paper-to-Poster 任务的得分经多轮自迭代从 49 提升至 80.9。
据彭博社报道,Anthropic 正加速公开上市进程,计划最早于今年8月底向 SEC 公开提交 S-1 招股说明书,目标估值1.5-2万亿美元,募资规模有望持平或超越 SpaceX 创下的750亿美元纪录,预计最快今年第四季度挂牌。
推荐理由:材料给出 Anthropic 的上市时间表、募资体量和营收运行率数据,读者可据此看清前沿模型实验室登陆公开市场的节奏与规模。
小红书 FireRed 团队发布语音生成与编辑模型 FireRedTTS3,用同一套 LLM-DiT 框架打通零样本音色克隆、自然语言声音设计和精准语音编辑,并开源代码与技术报告。
自变量机器人(X Square Robot)在 WRC 用同一套端到端世界统一模型 WALL-B 同时驱动家庭服务与物流分拣:家庭场景可完成铲猫砂、叠衣服等数十个任务,物流产线公开直播实测分拣效率达 1816 件/小时,比 Figure AI 的 1248 件/小时快 45% 以上,部署成本约为其 30%,准确率 98%。
深圳鸿元智通以自研鸿蒙发行版 ZhihongmetaOS 和端侧智能体 ZhihongmetaAI 两大技术资产构建鸿蒙 AIOS,切入垂直行业鸿蒙 AI 赛道。公司已在警用、通信、港口三大领域落地警鸿智能网关、中移智鸿灵犀屏等终端并批量商用,同时联合公安部一所、中国移动、青岛港参与行业 OS 标准共建。其核心团队均有十余年华为多岗位经历,深圳国资已战略入股。
埃夫特机器人(688165.SH)与旗下启智 Openmind 共同研发智能机器人通用技术底座,由 HumanGPT 专用基础大模型、大衍数据平台、墨斗 IDE 和 Openmind OS 构成,串联真人采数据到本体执行的全链路。
openJiuwen(由华为 2012 实验室、华为云、终端、计算联合构建)上周将蜂群智能体升级为 WorkSwarm 蜂群办公智能体,同时推出跨平台、多等级的 Agent 安全沙箱 JiuwenBox。
跨维智能创始人兼 CEO 贾奎在 WRC 2026「物理 AI 引领者论坛」发表《Physical Token 经济学》演讲,提出以「单位可靠物理智能」衡量机器人的智能生产成本,核心指标是获取新能力的边际成本。
新加坡南洋理工大学 AutoMan Lab 团队以 F1 级别自动驾驶方程式赛车为平台,构建了以世界模型为中心的具身智能体架构,同时预测对手交互、自车动力学与可行运动范围。
DeepSeek Harness 放出 RC.8 版本更新,距 RC.7 发布仅两天,覆盖多模态输入、子代理、工具调用、Windows 终端与底层存储等多个方向。
北京大学与微软亚洲研究院提出 Bernoulli-Continuation Policy(BCP),冻结基座 VLA、仅训练 16.4M 参数的轻量级 head,把「执行多久」拆解为一系列「继续执行还是重新规划」的伯努利决策,并用 GRPO 从轨迹级结果优化。
银河通用在 WRC 论坛首次发布双足人形机器人 Galbot ET1,搭载自研全身全手端到端具身大模型 AstraBrain,其中通用小脑 AstraBrain-WBC 1.0 负责将运动意图稳定映射为全身动作,AstraBrain-Agent 负责理解与决策。
腾讯广告算法大赛(TAAC)与 KDD Cup 2026 联动赛事上周在韩国济州岛落幕,学术赛道、工业赛道冠军及两项原创突破奖揭晓,工业赛道冠军团队「日之光面」没有调用 API、全程只用一个 DeepSeek 网页对话框完成比赛,获得 15 万美元奖金。
机器之心报道,J-Space Cognition Suite V3.6 号称以 Skill 形式让 DeepSeek V4 Pro 在 Terminal Bench、NL2Repo、DeepSWE 等基准上大幅提升并超过 Fable 5,社区复测却未复现这一提升。
智象未来(HiDream.ai)提出 DreamWorld,将 3D Foundation Model 的空间结构先验引入 Video Diffusion,采用 Geometry-then-Appearance 两阶段框架,先生成目标视角几何结构特征再合成 RGB 视频,该工作已被 ECCV 2026 录用。
鹿明机器人 8 月 19 日在 2026 世界机器人大会开幕当天发布具身智能进化引擎 Lumos NexCore,将数据资产、模型训练、评测验证、技能封装和设备运营整合为平台服务,让机器人能力像云服务一样被调用、训练和验证。该平台采用平台订阅加训练算力、真机验证和技能授权的组合收费模式,已覆盖科研、工业制造、服务行业和文娱产业等场景。
复旦大学与引望智能提出 WAM-Diff2,通过 Block-Causal 注意力与三级层次化蒸馏,将基于 Qwen3-VL 的多任务自回归自动驾驶 VLA 平滑迁移为离散扩散架构。
OpenAI 发文称已暂停其最新、计划用于部署的模型的强化学习训练两周,用于加固研究环境、红队测试并扩大内部监控,部分风险较低的训练已恢复,但原计划的最大规模前沿模型 RL 训练仍处暂停状态。
推荐理由:原文给出暂停 RL 训练的两个导火索和三层安全措施,读者可据此了解前沿训练为何把安全要求前移到训练阶段。
MirroS 联合清北、Berkeley、MIT、xbench、英伟达等 15 家机构发布 HarnessEval,将 Harness 概念引入评测系统,推动评测从静态 benchmark 走向可执行工作流。其首个落地场景为交互式世界模型,开源 HarnessEval-w 从观测质量、状态转移正确性和世界持续性三个维度组织评测,输出可追溯的 evidence tree 而非单一分数。
OpenAI 的一个未公开模型推翻了匈牙利数学家 Paul Erdős 在 1946 年提出的单位距离问题猜想,原文称这是人工智能首次自主解决数学领域的核心著名未解问题。
MemoraX Code 推出面向 Coding Agent 的长期记忆系统,已完成对 Codex、Claude Code、Deepseek Harness、OpenCode 四个主流 Coding Agent 的支持,可在新对话和跨 Agent 切换时继续沿用此前形成的项目经验。
清华 AIR 与域变换联合推出闭环在线学习自进化物理智能体 Zetta ζ,通过动作级、批量候选优化和验证门控三个时间尺度的闭环,在 LIBERO-Pro 上把平均成功率从 34.5% 提升到 90.8%,RoboCasa 从 73.6% 提升到 93.6%。