openJiuwen 发布业界首个企业级分布式蜂群架构,联合邮储落地金融生产环境
openJiuwen 开源 AI Agent 平台发布企业级分布式蜂群架构,将 JiuwenSwarm 蜂群能力扩展到企业级分布式集群,并内置与昇腾、鲲鹏算力基础设施亲和的算力亲和设计。中国邮政储蓄银行已基于该架构构建金融领域蜂群智能体平台并投入生产环境,成为分布式蜂群架构首次落地企业级生产环境。该平台已全部开源。
按公众号阅读文章与观点
openJiuwen 开源 AI Agent 平台发布企业级分布式蜂群架构,将 JiuwenSwarm 蜂群能力扩展到企业级分布式集群,并内置与昇腾、鲲鹏算力基础设施亲和的算力亲和设计。中国邮政储蓄银行已基于该架构构建金融领域蜂群智能体平台并投入生产环境,成为分布式蜂群架构首次落地企业级生产环境。该平台已全部开源。
Keep 借 88 全民健身日推出「超级AI会员」,主打 AI 语音互动跑:跑步中可直接提问,AI 结合实时状态判断节奏,并调用节拍器执行,还能切歌,但拒绝点外卖等越界请求。该会员面向需要个性化安排、实时判断和持续陪伴的用户,与提供课程和工具的普通会员并存。Keep 自研运动健康大模型 Keepace.ai 已于今年 4 月亮相,覆盖课程生成、运动问答和数据解读。
AI科技评论以 IJCAI-ECAI 2026 论文阵容验证"IJCAI 在推理、规划、知识方面最顶级"的判断:本届总投稿超 5400 篇、录用 990 篇,录用率约 18%。
香港科技大学(广州)陈昶昊教授团队提出 AdvNav,一个面向视觉语言导航任务的黑盒行为引导对抗攻击框架,相关成果已被 ACM Multimedia 2026 录用。
HAMi 于 7 月 2 日通过 CNCF 技术监督委员会评审,正式进入孵化阶段,项目已被数百家企业直接或间接采用。HAMi 是异构 AI 计算虚拟化中间件,把整张 GPU 切分为可隔离、可调度的细粒度资源;据张潇介绍,部分推理场景中企业原有 GPU 利用率不足 20%,采用开源 HAMi 后提升至 40% 至 50% 左右,企业产品目标接近 70%。
一份流出的DeepSeek股权投资材料声称,未发布的V4-Pro编程性能仅比Claude旗舰低0.3%,DeepSeek Harness团队负责人崔添翼在社交平台调侃“也不能说完全是瞎编,对吧?
SpaceX 宣布与英伟达合作,联合设计名为 Starmind AI1 的天基 AI 计算卫星载荷,搭载 NVIDIA Rubin GPU 和 Vera CPU。
OpenAI 将 ChatGPT 免费版默认模型换成 GPT-5.6 Luna,Chat 模式不再限制聊天次数,本周内陆续推送。
2026年8月5日,在 Google 工作27年的 Jeff Dean 与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 一同离职创办 AI 科研公司 Discovery Loop。
推荐理由:文章把 Google AI 三年组织调整与人事变动串成一条线,便于理解 Koray 接掌模型业务背后的权衡。
SkyPilot 结束隐身,宣布完成 2000 万美元种子轮融资,由 Lux Capital 领投,Coatue、Amplify Partners、Foundation Capital 等参投,个人投资者包括 Jeff Dean、Clem Delangue、Ali Ghodsi。
同济大学任捷量子声子学与量子人工智能课题组提出无监督 AI 框架 TFCAD(时间波动复杂度放大距离),仅凭可观测量子时序数据即可自动划分量子动力学相,无需物理先验知识。该成果发表于《Physical Review E》2026年6月刊,在五大量子体系上验证了分类优越性与鲁棒性,代码与理论公开于论文补充材料。
华尔街对冲基金 Point72、Citadel、Millennium 遭 AI 语音克隆入侵,攻击者通过监听通话模仿声音、语调和措辞,诱使员工泄露账户信息或授予系统访问权限。
月之暗面Mooncake与NVIDIA CMX共同指向一个趋势:推理状态正成为AI基础设施的一级资源,存储进入Token生成实时主链路。
由国内外二十多所高校与研究机构联合发起的 Agent Memory Leaderboard(AML)正式发布,并启动首届 Agent 记忆挑战赛,报名于 2026 年 7 月 29 日开放、8 月 7 日截止提交,8 月中旬放榜。
OpenAI 在 ChatGPT 中推出 GPT-5.6 Sol 和 GPT-5.6 Luna,付费用户的 Sol 侧重事实准确与回答克制,免费和 Go 用户默认模型将升级为 Luna。
OpenAI 更新 ChatGPT,免费用户和 Go 用户的默认模型换成 GPT-5.6 Luna 并获得无限文本对话权限,Plus 和 Pro 用户即日起可用 GPT-5.6 Sol。
大语言模型推理同时撞上容量墙和 I/O 墙,SSD 正从模型文件的静态存放设备进入推理实时数据路径,成为 HBM、VRAM、DRAM 之后的正式存储层级。英伟达 2026 年推出 CMX 上下文内存存储平台,在 Vera Rubin 中增加面向 KV Cache 优化、由 BlueField-4 管理的以太网闪存层级。
OpenAI 更新 ChatGPT,免费用户和 Go 用户默认模型换成 GPT-5.6 Luna,并获得无限文本对话权限,Plus 和 Pro 用户则可使用更新后的 GPT-5.6 Sol。
ChatGPT 免费版默认模型换成 GPT-5.6 Luna,Chat 模式取消次数限制,本周内陆续推送。Plus 和 Pro 用户在 Chat 中使用的 GPT-5.6 Sol 获得更新,官方称事实准确性和回答质量均有提升,Work 和 Codex 中的 Sol 不在本次范围。
宇树科技8月6日公布科创板IPO战略配售结果,深度求索获配93.339万股,按150.80元/股发行价计算认购金额约1.41亿元。公告将深度求索列为具有战略合作关系的产业投资者,双方计划在通用人工智能研发、高性能通用机器人采购及大模型训练服务等方面合作。深度求索所持股份锁定期为36个月,高于多数产业战略投资者12个月的期限。
深圳具身智能产业催生"数据采集员"岗位,应届生头戴摄像头头盔、腰挂电池包,在超市或写字楼反复做拿取、叠衣等动作上百次,为机器人采集动作数据。该岗位初期月薪可达8000至10000元,今年已流水线化转为时薪或计件制,正常月入降至6000至7000元,并下沉至二三线城市居家采集。
8月5日 Google DeepMind 领导层调整,Demis Hassabis 不再负责 GDM 日常运营,转任 GDM 董事长和 Alphabet 首席科学家,由原 DeepMind CTO Koray Kavukcuoglu 接手日常运营并负责包括 Gemini 在内的模型开发,直接向 Sundar Pichai 汇报。
推荐理由:文章串起 Gemini 3.5 Pro 延期与 DeepMind 组织调整,帮助读者看清这次高层变动与核心人才出走的关联。
OpenAI 宣布 ChatGPT 免费用户文字聊天不再受限,默认模型升级为 GPT-5.6 Luna,免费及 8 美元 Go 套餐用户可用新的"思考"按钮,更新预计下周发布。DeepSeek 公告计划近期整体上调 API 定价,预计涨幅较大。美股存储芯片股大跌,西部数据跌超 13%,SK 海力士跌约 5%。
工信部等部门自2026年起密集落地汽车监管新规,可靠性试验强制准入、OTA新规以及针对L2级辅助驾驶、L3/L4自动驾驶和动力电池的三项强制性国家标准将在2027年前后实施,车企让消费者充当测试员的公测模式走向终结。
8 月 6 日字节跳动全员会上,梁汝波与管理层明确 AI 战略转变:C 端维持豆包产品竞争力,战略重心转向 ToB 生产力赛道,此前一周飞书产品团队已并入豆包、其市场销售与客服体系划入火山引擎。文中提到腾讯 WorkBuddy 6 月单月访问量 2097 万次、居国内 PC 端 AI 原生办公智能体首位,豆包月活 3.45 亿,豆包大模型日均 Token 调用量 180 万亿。
至知创新研究院(IQuest Research)与合作伙伴拆解了 Hyperball 优化器 MuonH 的训练动态,发现其优势主要来自隐式形成的角有效学习率调度,而非更优的更新方向。
黎曼动力、光轮智能和诺亦腾机器人宣布共建具身智能数据底座,计划到2026年底完成100万小时机器人训练数据采集。三方分别负责模型训练、仿真与评测、真实动作数据采集,并将共建数据规范、标注标准和评测基准,部分具身训练数据面向社区开源。据亿欧智库报告估算,当前全球高质量具身交互数据仅约50万小时,而黎曼动力此前已用23.2万小时数据训练出Riemann-1.0。
虎嗅第7场 AI100 闭门会上,智魔科技郭炜凯、智梦可杜宇、维塑科技朱继和云沐资本李津瑶指出,AI 健康硬件把测量精度提升等同于健康问题解决是典型误判。维塑体测仪由教练完成服务交付,智梦可睡眠产品让设备直接干预,智魔足疗仪分体加电池后开机率提高两倍以上。收费方式取决于价值交付给谁:持续影响个人决策可订阅,提高专业机构效率由 B 端付费,即时舒适感靠多 SKU 与耗材复购。
Mistral AI 发布 3B 级规则自适应多模态安全分类器 Shieldstral,可通过统一接口审核文本、图片以及图文混合内容。它把不同审核任务统一为 Yes/No 判断题,支持在推理阶段用自然语言输入自定义审核规则,规则变更时无需重新训练分类器。
Jeff Dean 官宣离开工作 27 年的谷歌,与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创立 AI 初创公司 Discovery Loop,方向是机器学习、科学发现与工程开发的自动化。
推荐理由:文章以 Jeff Dean 离职创业为线索,梳理了 Google Brain 走出的一批 AI 创始人去向,可作观察当下 AI 人才版图的参照。
在新加坡 AGI Playground 2026 上,WIZ.AI、Ateve、易点天下、Airwallex 四位创业者讨论 ToB Agent 落地:能否把工作从头到尾做完是分水岭,若最后 10% 仍需人接手就会成为流程瓶颈。
8月5日,Google DeepMind CEO Demis Hassabis 转任 DeepMind 董事长并出任 Alphabet 首席科学家,Gemini 的研发和交付改由原 DeepMind CTO Koray Kavukcuoglu 负责、直接向皮查伊汇报。
推荐理由:梳理谷歌AI六周内四次股价受挫的时间线,把核心人才离职、模型延期与资本开支压力放在一起看。
菜鸟8月5日正式发布“全球三日达(72小时达)”服务,以香港至英国线路为例,跨境包裹最快2天妥投,3日达妥投率达90%。该服务依托每周约170架次包机包板及AI物流能力,0.5kg欧洲小包单票成本较国际快递节省约58%,推动极速时效进入普惠阶段。
国内AI办公产品在1到2亿电脑办公人群中的渗透率仅10%到20%,远未触及天花板。腾讯将WorkBuddy与CodeBuddy团队合并升格为云产品六部,阿里把QoderWork、悟空、MuleRun三合一推出千问办公并于8月公测,百度则以3月22日全量上线的桌面级通用Agent百度搭子为统一入口,整合月活过亿的GenFlow和积累3500多万用户的秒哒。
Vibe Coding 带来海量 AI 生成应用,蚂蚁灵光上线四个月累计生成超 3000 万个闪应用,每个应用都需要独立的数据空间和 SQL 计算能力。OceanBase 采用逻辑独立、物理共享的方案,将 Schema 与数据内容分层存储,通过 JSON Table SDK 和 JSON_TABLE() 把标准 SQL 自动映射到共享存储,避免物理表随应用数量线性增长。
快手提出从"研发效能"切换到"AI 生产力"的新命题,并落地主航道 + 快速路双轨策略:主航道以 L2+ 需求占比达 80% 为目标,快速路挑选 30 多个规模 10 至 100 人的 AI 先锋团队探索 L2 上限与 L3 图景。
Meta 发布首款编程智能体 Muse Code 和编程优化模型 Muse Spark 1.2,扎克伯格在 X 上宣布,称其能在大型代码库中执行完整的软件工程任务。
大晓机器人联合南洋理工大学 S-Lab 开源 L5 级多模态具身物理智能数据集 ACE-Data-0,包含 1700 万帧视频、200 个任务类别、50 名参与者和 7.5 万个交互片段,覆盖 2 个真实家庭场景。
Meta 开放 Muse Code 测试并更新 Muse Spark 1.2。Muse Code 接收完整工程任务,一条命令安装,带后台观察智能体、子智能体 Git worktree 隔离和本地事件日志回放,同意上传数据的贡献者版可获0.5折,比 DeepSeek 还便宜。
Jeff Dean 宣布从工作 27 年的谷歌离职,将创办新公司 Discovery Loop,使命是实现机器学习、科学和工程的自动化。他是谷歌第 30 号员工,参与或主导了 MapReduce、BigTable、Spanner、Protobuf、LevelDB、TensorFlow 和 TPU 等项目,并联合创立谷歌大脑。