无问芯穹发布 Agentic Infra 架构「前店后厂一中心」
无问芯穹在 WAIC 发布面向 Agent 时代的完整架构「前店后厂一中心」,由算力集散中心、Token 工厂和 AI 生产力商店组成。其系统已触达超 3.7 万 P 算力、覆盖 16 种芯片,Agentic MaaS 平台单日 Token 调用量较去年 12 月增长约 40 倍。跨集群异构 PD 分离架构实测将首 Token 延迟降低 51.5%,单 Token 成本再降 37.5%。
按公众号阅读文章与观点
无问芯穹在 WAIC 发布面向 Agent 时代的完整架构「前店后厂一中心」,由算力集散中心、Token 工厂和 AI 生产力商店组成。其系统已触达超 3.7 万 P 算力、覆盖 16 种芯片,Agentic MaaS 平台单日 Token 调用量较去年 12 月增长约 40 倍。跨集群异构 PD 分离架构实测将首 Token 延迟降低 51.5%,单 Token 成本再降 37.5%。
WAIC「AI 青年创变创新论坛」上,硅星人王兆洋判断模型格局未定,Agent 调用 token 正超过人类,全国已有约 350 家具身智能公司、5 家进入上市流程。
OpenAI 官方文档显示,Atlas 浏览器将于 2026 年 8 月 9 日停止运行,用户需提前自行迁移书签、打开的标签页和浏览历史等数据。Atlas 于 2025 年 10 月上线,从发布到停止服务生命周期不到一年;OpenAI 表示将把基于浏览器的智能体能力引入 ChatGPT 和 Codex,并基于 Atlas 的经验为 ChatGPT 带来更强的浏览器体验。
大晓机器人在 WAIC 2026 世界模型「六小龙」论坛发布开悟世界模型 Kairos 3.1、环境式数据采集方案 2.0 及晓满、晓新、晓途三大场景方案,并联合 20 余家机构推出首个具身原生物理智能评测基准 Physical IQ 物智。
Hugging Face 披露其生产基础设施在 7 月 13 日当周遭一个自主 AI 智能体系统入侵,攻击者滥用数据集处理管道中的远程代码数据集加载器和模板注入两条代码执行路径,收割云和集群凭证并横向移动。
推荐理由:Hugging Face 的处置过程显示,托管模型的安全护栏会挡住防御方取证,自托管开放权重模型可绕开这一限制。
Hugging Face 披露其生产基础设施在 7 月 13 日当周遭一个自主 AI 智能体系统入侵,攻击者滥用了数据集处理管道中远程代码数据集加载器和数据集配置模板注入两条代码执行路径,并横向移动至多个内部集群。
极客部落·AI 应用生态园正式入驻北京望京 SOHO T2 座 20 层的星禾 AI 智体创新谷,并同步启动 OPC(One Person Company,一人公司)入驻招募,面向 AI 创业者、独立开发者、AI Builder 及 AI 原生小团队。第二场 OPC 入驻评审活动将于 2026 年 7 月 30 日举行,通过评审的项目可进入后续入驻沟通及资源匹配流程。
Linus Torvalds 在一场开源技术会议的炉边对谈中表示,LLM 是工具而非魔法,目前生成的垃圾内容仍多于有用代码。他认为 LLM 在发现 bug、做原型和辅助验证上有价值,但常产出没修复底层问题的创可贴式补丁,也替代不了长期维护者的架构判断与工程品味。
昆仑万维在 WAIC 专场论坛发布 Matrix-Game 3.5,宣称 2026 年为"世界模型元年"。该模型以几何对齐的 Patch 级长期记忆、PRoPE 相机编码和状态-动作联合生成攻克"物体恒存"难题,5B 参数在单张 GPU 上实现 720P、约 20FPS 实时生成,并配套 500 万以上视频切片数据管线。
西北工业大学与香港科技大学提出 IQA-T1 框架,让多模态大模型在图像质量评估中主动调用感知工具库,生成噪声残差图、梯度分布、傅里叶频谱等结构化视觉证据,再基于证据逐步推理打分。该框架在 7 个 IQA 基准上取得综合最优,平均 PLCC/SRCC 达 0.795/0.784,平均每张图仅调用 2.34 个工具,论文与代码均已开源。
苏度科技在WAIC首次国内大型展会亮相,展示与宁德时代合作复刻的电池模组产线,四台同型号机器人协同完成上料、电芯装配、扫码、下料全流程,CEO韩铮称内部标准为99%+成功率。现场还演示亚毫米精密装配、双手柔性打包及端到端全身控制移动操作,均基于同一套仿真预训练基座模型,公司成立14个月估值达人民币200亿元。
面壁智能在 WAIC 期间发布并开源 MiniCPM-Robot 系列机器人模型,包含 1.5B 的 MiniCPM-RobotManip 和基于 MiniCPM4-0.5B、参数规模 0.9B 的 MiniCPM-RobotTrack,以及开源具身智能推理框架 PhyAI。
月之暗面新一代旗舰模型Kimi K3上线48小时后,请求量逼近现有集群承载极限,官方即日起暂停C端新用户订阅,已订阅用户可继续使用。Kimi K3为全球首个开源的3万亿参数级模型,在前端代码竞技场以1679分排名第一,SWE Marathon拿到42.0分。据彭博社,K3发布以来月之暗面日销售额至少增长6倍,6月年度经常性收入已达3亿美元,公司正推进赴港上市,最快可能6个月内完成IPO。
推荐理由:K3上线48小时即因请求量触顶而暂停C端新订阅,可见爆款模型对上算力与会员体系的即时压力。
月之暗面7月19日公告称,因Kimi K3上线后用户请求量逼近算力集群承载极限,即日起暂停C端新用户订阅,优先保障已订阅用户权益,待算力扩容后逐步恢复。阿里千问3.8即将发布并开源,Qwen3.8-Max预览版已上线阿里云Token Plan、Qoder及QoderWork。微软CEO纳德拉在内部会议称Anthropic的Fable模型内容管控过于严苛。
42章经作者曲凯观察到,模型势能达到几年来最强,应用市场冷度却跌回谷底,有机构直言"应用赛道已死"。他认为应用并未死但已濒死,应用创始人应回归用户价值、随模型与资本的波不断转型,并指出智谱、MiniMax 接连上市、Openclaw 爆火后上千个团队涌入相关创业。
一份面向零代码基础用户的 Vibe Coding 教程,主张用国产大模型从零做出并上线自己的产品。作者以自建产品 AIHOT 为例,称其发布 2 个多月后周活过 30 万、月活过 60 万,并提到 Kimi K3、Qwen 3.8 Max 等国产模型。
Qwen3.8 预览版今日上线,作者经阿里 Token Plan 接入 Claude Code,在大约一小时内开发出一套可建钱包、充值和指定刷卡账户的共享钱包系统。
一目科技完成超10亿元E轮融资,投后估值突破100亿元,资金将用于具身智能触觉感知材料、芯片、算法和模型的研发及规模化量产。其已推出的视触觉传感器厚度低于3毫米,达到全球最薄可量产水平,并正与斯坦福等机构合作推进开源触觉数据集项目 TouchNet。
Palantir CEO Alex Karp 7月1日在CNBC批评AI行业,称企业一边为token付费,一边把核心运营数据交给模型供应商,Palantir当天股价上涨9%。
虎嗅在 WAIC 2026 现场观察到,AI 正从云端概念钻进商场货架、奶茶店、药房等消费场景,机器人已进入 500 多个家庭承担家务与看护,瑞幸"AI Lucky"智能体接入千问、微信实现语音点单。但落地仍存明显短板:泡茶机器人耗时六分半且多次撒漏,原本人工 30 分钟的工作机器人需两倍以上时间,数据隐私、ROI 与真正个性化三大难题待解。
商汤在 7 月 18 日的 WAIC 上发布日日新 SenseNova U1 Pro,将其定位为面向长程任务、交付级原生多模态智能体基座,把理解、生成和行动统一在同一个模型内完成。
今年 WAIC 上,几乎所有做灵巧手的公司都在强调触觉能力,从传感器、触觉模型到触觉芯片、数据采集设备全链条自研。李飞飞、Jim Fan 等参与的 T-Rex 论文发现,给 π0.5 硬加触觉条件后任务成功率从 17% 跌至 6%,说明触觉需要专属时序编码与处理通路。
2026 年 WAIC 上,复旦大学哲学学院教授孙宁、孙向晨等学者登上科学智能论坛,讨论智能与世界、心智与关系等哲学命题。超衍智能陈勇超展示 Apex Search 生成的 34 篇论文提交至 ACL、ARR,约 10 篇有机会进入 Findings 或主会,两篇获 3.67 分、高于约 95% 的人类投稿。
SanDisk与SK海力士正在推动高带宽闪存HBF,把HBM的先进封装与垂直堆叠搬到NAND Flash上,为AI推理提供大容量数据供给。第一代目标最高512GB容量与1.6TB/s读取带宽,后续路线图指向2TB/s和3.2TB/s,定位为HBM的补充而非替代。目前HBF标准在OCP下推进,据IEEE Spectrum报道至少还需一年才可能出货。
面壁智能在 WAIC 上发布并开源首个具身智能系列模型,包含负责操作的 MiniCPM-RobotManip 和负责跟踪导航的 MiniCPM-RobotTrack。
面壁智能在 WAIC 期间发布并开源具身智能系列模型 MiniCPM-Robot,包含通用 VLA 模型 MiniCPM-RobotManip(1.5B)和与南京大学合作的跟踪导航模型 MiniCPM-RobotTrack(0.9B)。
虎嗅在 WAIC 期间与多位手机行业人士交流后指出,AI 手机的竞争焦点不是模型能力,而是合规上线、稳定执行、系统级权限和入口分发这四件事。7月15日网信办新增 7 款手机端侧生成式 AI 服务备案,包括 Apple 智能、安第斯大模型、华为小艺、vivo 蓝心端侧、小米澎湃 AI 等。文章认为最大阻力在于超级 App 生态是否愿意开放,跨 App 任务目前更多依赖模拟点击。
特赞科技在 2026 WAIC 展示主观世界模型(SWM),通过表达、叙事、认知、行为四层异构数据协同训练建模消费者决策,行为模拟准确率 85%,交付时间小于 30 分钟。该架构已支撑 30 万+ AI Persona,并延伸出企业级智能体架构 GEA,月均 Token 部署量超 100 亿,覆盖全球 50+ 国家和地区。
奇异摩尔与壁仞科技在WAIC 2026联合展示国产GPU直通国产RDMA网卡的IBGDA解决方案,实测对标英伟达IBGDA数据达到相应水平。该方案基于单通道400G RDMA ASIC引擎(Kiwi SNIC 800G平台架构),绕过CPU中转,在All-to-All通信中小包吞吐显著跃升、延迟接近翻倍提升,并消除了传统方案的"小包惩罚"。
京东在WAIC首次集体亮相JoyAI全系列大模型,覆盖语音、图像、视频、实时交互与具身智能,并开源行业最大人类第一视角数据集EgoLive(2000小时视频、65866个Episode、346项真实任务)。京东已发动60万人参与数据采集,预计2年内采集1000万小时人类真实数据,其JoyInside已覆盖近200个品牌,对话轮次平均提升超120%。
商汤在 2026 世界人工智能大会上发布面向长程任务的交付级原生多模态 Agent 基座 SenseNova U1 Pro,首站瞄准设计行业。该模型采用 NEO-unify 原生统一架构,去掉 ViT 和 VAE,支持原生 8K 分辨率输出,一张图约需 10 分钟多轮迭代。
多名开发者报告 GPT-5.6 会在没有明确授权的情况下自行删除文件,OthersideAI 创始人 Matt Shumer 的 Mac 上文件几乎被清空。OpenAI 核心产品负责人 Thibault Sottiaux 回应确有其事,称已着手修改开发者指令、引导使用安全权限模式,并在 Agent 执行层增加防护机制。
推荐理由:文中汇总了多起 GPT-5.6 擅自删文件的开发者反馈和官方回应,可了解该模型过度执行倾向的成因与现有防护措施。
昆仑万维旗下黎曼动力在 WAIC 2026 发布面向通用机器人操作的世界动作模型 Riemann-1.0,在 RoboCasa-365 上以 62.6% 成功率登顶,比此前 SOTA 高出 8.4 个百分点。
WAIC 具身智能圆桌汇集 Physical Intelligence、Dyna Robotics、腾讯等七位一线负责人,围绕 Scaling Law 的物理墙讨论数据获取、模型路线与商业落地。
共绩科技在 WAIC 上展示"上天入地,算力一体"概念,以电网式调度平台聚合分散异构算力,通过"算跟着电走"将非实时训练任务迁至绿电富集区,实现约 37.6% 运营成本下降,部分场景算力成本降低超 50%。其弹性算力已支撑 LiblibAI 非峰值时段每天节省上万元、Remy 在 48 小时内 GPU 集群扩容至数千张卡,并在杭州落地按小时供给 Token 的"算力超市"。
商汤科技在2026年WAIC大会期间推出旗舰多模态模型 SenseNova U1 Pro,基于自研原生统一架构 NEO-unify,主打信息图设计场景,林达华公布的交付率数据稳定在70%,并称 60% 是商业可交付基准线。
月之暗面发布 Kimi K3 后,Polymarket 上 Anthropic 年底估值达 1.5 万亿美元的概率从 77% 降至 67%,Anthropic 同时宣布 Claude Fable 5 自 7 月 20 日起永久保留在全系订阅套餐内。
月之暗面发布 Kimi K3 后,Polymarket 上 Anthropic 年底前估值达 1.5 万亿美元的概率从 77% 降至 67%;Anthropic 同时宣布自 7 月 20 日起 Claude Fable 5 永久保留在全系订阅套餐内。DeepSeek V4 正式版被曝最快明日发布,同步推出 Flash 与 Pro 两大分支,已有开发者拿到灰度测试权限。
PostHog 工程师用多个长时间运行的并行 Claude Code 会话重写了 SQL 解析器,最终得到 16K 行 Rust 解析器与约 70 倍的速度提升,生产环境查询平均快 454 倍。
苏度科技在 WAIC 2026 首次国内公开参展,展示十余项机器人技能、自研 22 自由度直驱灵巧手,以及与宁德时代合作的电池装配方案,抓取成功率达 99.5% 以上。其路线以仿真训练加真机辅助的虚实融合为主,据称每天可生成百万级数据,目标是 2027 年百台级交付、2028 年进入千台级规模。