蚂蚁 inclusionAI 开源 LLaDA2.2 扩散语言模型,原生 128K 上下文对标自回归 Agent
蚂蚁 inclusionAI 团队开源千亿参数 MoE 扩散语言模型 LLaDA2.2,原生支持 128K 上下文,并称其为全球首个大规模 Agentic 扩散模型。
按公众号阅读文章与观点
蚂蚁 inclusionAI 团队开源千亿参数 MoE 扩散语言模型 LLaDA2.2,原生支持 128K 上下文,并称其为全球首个大规模 Agentic 扩散模型。
英伟达与 Ilya Sutskever 创立的 SSI(Safe Superintelligence Inc.)宣布结为长期战略合作,英伟达将授予下一代 Vera Rubin 平台的使用权,预计未来一年内把 SSI 的算力规模提升 10 倍。
智在无界(BeingBeyond)发布 Being-H0.8,称其为首个基于人类视频数据的隐式触觉世界动作模型,把触觉放入预测—执行—反馈链路,先预判接触再依触觉反馈调整动作。
斯坦福经济政策研究所发布政策简报指出,暂无足够证据表明AI正在造成大规模失业,受AI影响最高与最低职业的失业率分别上升0.77和0.85个百分点。但2026年初美国应届毕业生失业率达到5.6%,比三年前上升1.6个百分点,在软件开发、客户服务等AI高暴露职业中,年轻员工就业人数明显下降而资深员工基本稳定。
月之暗面正式开源 Kimi K3,参数量 2.8 万亿、激活参数 1040 亿,支持 100 万 token 上下文并具备原生视觉理解,同步发布技术报告。
推荐理由:技术报告公开了注意力、跨层残差与 MoE 负载均衡的具体改动,可借此看清单个开源模型在万亿参数规模上的工程取舍。
Thinking Machines 联合创始人翁荔宣布,明天是她在该公司的最后一天,理由是工作强度太大、身体撑不住。此时距公司首个开源模型 Inkling 发布刚过去12天,她加入公司约20个月。她表示仍然喜欢读论文追前沿,但想去一个更可预期的地方、做边界更清楚的角色,不再担任联合创始人;Mira Murati 和现任 CTO Soumith Chintala 等人在 X 上留言送别。
月之暗面开源 Kimi K3 的模型权重和技术报告,2.8 万亿参数 MoE,具备原生视觉理解能力,支持 100 万 token 上下文窗口。
推荐理由:权重、技术报告与训练 Infra 一并公开,呈现 2.8 万亿参数 MoE 从架构到线上服务的工程链路。
Kimi K3 于 7 月 17 日发布,2.8 万亿总参数、1040 亿激活参数,原生视觉能力,100 万 Token 上下文,并在 7 月 27 日按承诺开源模型权重、47 页技术报告以及 MoonEP、FlashKDA、AgentENV 等关键训练 Infra。
推荐理由:梳理了 Kimi K3 开源权重之外放出的 MoonEP、FlashKDA 等训练基础设施,可供了解超大 MoE 训练的底层方法。
长三金7月27日在A股上市首日股价上涨超过465.82%,总市值超过工商银行、宁德时代和贵州茅台,位居A股第一。按合肥国资体系约36.79%的持股比例计算,对应账面市值已超过1.2万亿元;其前瞻PE约21.6倍,高于美光约6倍、SK海力士约4.6倍。作为中国唯一具备DRAM全流程IDM规模化量产能力的企业,其HBM3被市场预计在2026年底量产。
月之暗面发布 Kimi K3 模型权重与技术报告,该模型为 2.8 万亿参数 MoE 架构,具备原生视觉理解能力并支持 100 万 token 上下文窗口,同时开源 MoonEP、FlashKDA 和 AgentEnv 三项 Infra 技术。苹果股价报 335.36 美元,总市值 4.93 万亿美元重回全球第一;长鑫科技登陆科创板首日涨 465.82%,收盘总市值 3.28 万亿元。
思想钢印复盘2000年科网泡沫见顶前后120天的八个信号,并对照当前AI行情,认为目前Token需求仍高速增长,更像1998年或2000年初的中途调整。文章列出的左侧信号包括思科开始谈订单正常化、运营商资本开支讨论增多、光通信板块率先见顶和IPO疯狂,右侧信号包括没有商业模式的2B板块率先崩掉、硬件公司盈利预警增多、股票融资链断裂和微软反垄断案败诉。
Safe Superintelligence(SSI)宣布与英伟达达成长期战略合作,英伟达将对其进行大规模投资,帮助 SSI 在未来 12 个月内把算力规模扩大 10 倍。具体财务条款没有对外披露,SSI 此前算力主要依赖谷歌的 TPU 芯片。今年 3 月,英伟达也曾与前 OpenAI 首席技术官 Mira Murati 的 Thinking Machines Lab 达成类似投资协议。
7 月 26 日一名 Reddit 用户发现,用谷歌检索 site:claude.ai/share 可批量搜到成千上万条 Claude 用户的共享对话记录,分享生成的公开网页无需登录即可访问。
NVIDIA、Google、OpenAI、Meta、Microsoft、Mistral、Hugging Face 等机构联署一封支持开放权重模型的公开信,Anthropic 未出现在名单中,引发开发者社区讨论。
虎嗅在 WAIC 期间举办「AI账本公开日」直播与 AI 决策者闭门会,整理出 42 句来自产线、预算表和组织阵痛的一线判断。核心观点包括:Token 不是价值、结果才是,企业付费正从按 Token 数量转向按任务和结果付费;Agent 进入大型企业需翻知识梳理、系统改造、权限治理三座大山。AI 行业正从「技术能不能实现」进入「经营上能不能成立」。
AI科技评论对 Agnes AI 的 AgnesCode 桌面端和 Agnes 2.5 Pro Alpha、2.5 Flash 做了实测,在 OpenHands 环境里让两个模型跑同一套约 30 个文件的 Python 项目,并导出客户端运行日志分析。
8 位 AI Infra 公司决策者在 WAIC 2026 复盘称,行业关注点已从千卡集群、GPU 性能转向稳定低成本批量产出 Token,并支撑 Agent 持续运行。
苹果与美光就存储涨价隔空互怼,苹果 6 月 25 日将 MacBook、iPad 及家居设备价格上调最多 54%,将原因归于存储芯片成本压力,美光首席商务官则称存储短缺源于大客户长期压价。文章认为这反映出 AI 产业链的瓶颈正持续向上游迁移,英伟达、美光等上游企业从周期供应商变成战略节点,下游巨头则通过自研芯片、出租算力等纵向一体化策略争夺租值。
7月27日,国产存储芯片龙头长鑫科技登陆科创板,开盘报49.5元/股,较8.66元发行价上涨471.59%,总市值达3.31万亿元,成为A股市值第一。小米、蔚来、奇瑞各出资1.58亿元获配约1824万股,锁定期18个月,意在锁定车规级DRAM的优先供应权。长鑫科技是全球DRAM市场排名第四的IDM企业,也是唯一的国产规模化供应商。
陶哲轩在ICM大会演讲《Mathematics in the age of AI》中提出,数学正从「证明稀缺」进入「证明过剩」时代,并把AI带来的冲击拆成生成、验证、表述、发表、正典化五段流水线,认为每一环都会出现「证明消化不良」。
有人拿 FrontierCode 编程基准把 Opus 5 的推理档位从低到高扫了一遍,发现性能天花板不是拉满的顶配档位,medium 才是顶峰。档位越高只代表推理预算越大,信息提取、分类这类边界清晰的简单任务上 low 和 high 输出质量几乎无差别,代码场景拉高强度后模型还会擅自重构无关函数、调整导入、重命名变量。
ChatGPT Health 上周向美国用户推出,作者实测其可分析 Apple Watch 的健康数据。作者以长期偏低的有氧适能为例,GPT 判断该指标只针对徒步和跑步测试,因此长期没有机会被触发。配合 ChatGPT Pro 效果更好,它还会检索权威健康信息网站,并可按周生成健康报告,目前该功能仅面向美国市场。
景鲲、刘靖康、OpenAI、AMI Labs 以及 50+ 投资机构确认出席同一场活动,完整议程已公布。
Anthropic 宣布为 Opus 5、Fable 5 等模型删掉超过 80% 的系统提示词,网友陈成(@chenchengpro)实测却发现 Opus 5 真正收到的系统提示词比 Opus 4.8 增加约 72%。
黄仁勋发起的开源倡议公开信签署方已从首批约25家扩大到70多家,OpenAI 也加入其中,Anthropic 成为主要未签署方。Anthropic 技术人员 Julian Schrittwieser 在 X 上反讽回应,提议英伟达也应开源 CUDA 和 GPU driver,吴恩达则为黄仁勋辩护称每个人都有权不公开自己的代码。
Pinecone 全面上线面向 AI 智能体的知识引擎 Nexus,可将企业分散的业务上下文整合为智能体可直接查询的结构化数据层,词元消耗降至原先的约 1/9 到 1/15。
范式智能系统研发专家杨守仁将在 8 月 21 日—22 日举办的 AICon 深圳站分享《从 HAMi 到 HAMi-DRA:异构环境的算力资源管理实践》。HAMi-DRA 是 HAMi 社区在 DRA 方向的最新实践,可在不牺牲核心调度能力的前提下,将现有 GPU 虚拟化调度体系平滑迁移至 DRA 资源模型,在调度性能和精细化管理方面带来显著提升。
7 月 24 日,黄仁勋在开通个人 X 账号后的首条推文中分享了英伟达参与签署的公开信《开放权重与美国 AI 领导力》,称世界既需要前沿闭源模型,也需要前沿开放模型,微软 CEO 纳德拉等人一同表态,Anthropic 未在首批 25 家签署方之列。
2026世界杯决赛西班牙1比0击败阿根廷,靠的是无单点故障的位置足球体系:罗德里与法比安·鲁伊斯切断梅西接球通道,阿根廷常规时间零射门,门将埃米利亚诺·马丁内斯扑出11次射门创决赛纪录。西班牙全场仅丢一球,这套体系历经近二十年打磨,德拉富恩特自2015年执教U19起积累核心班底,2024欧洲杯起终结连续136场控球率领先纪录。
黄仁勋在 YC Startup School 2026 长访谈中解释自己发出首条 X 推文、联署《开放权重与美国 AI 领导力》公开信的原因,并披露英伟达物理 AI 相关业务营收已接近 100 亿美元。
千问办公已在网站 qwenwork.cn 上线,定位为独立 Agent 办公产品,隶属 ATH 部门并打通钉钉生态,官方尚未正式发布。该产品可调用钉钉的消息、群聊、日程、待办、文档、知识库、考勤、审批等功能,并支持配成云端定时任务、结果推送到钉钉。
香港科技大学(广州)、南洋理工大学、阿里巴巴集团和其域创新科技联合发布《3D Gaussian Splatting Rasterization: A Survey》,以可微光栅化器为核心重新梳理 3DGS 技术版图,并在 Mip-NeRF 360、Tanks&Temples、Deep Blending 的 11 个场景上统一评估 27 种代表性方法。
中国科学院计算技术研究所"知境"团队发布社会心智大模型技术体系,含评测基准 SoMBench、训练方法 Zing 与部署架构 Actio。Zing-27B 在 5 项国际社会心智评测上综合均值 79.80,超过 GPT-5.5 的 78.44;Zing-32B 综合均值 76.32,略超 DeepSeek-V4-Pro 的 75.90。
飞书深诺于7月23日将出海营销 AI 产品 Marvy 升级至 2.0,把市场洞察、媒体策略、智能创意、智能投放和数据分析五大 Agent 放进同一套 AgentOS,由 Supervisor Agent 拆解任务并交叉验证。官方数据显示,某消费电子品牌尼日利亚项目中整体优化效率提升74%、人工耗时减少89%,创意预测准确率最高达95%以上。飞书深诺还计划推出更轻量的 Marvy Lite。
XYZ AI Lab 发布 Deep Search Agent XYZ-Aquila-mini 和 XYZ-Aquila-pro,前者在总参数量低于 40B 的开放权重比较组中七项指标居首,后者在低于 400B 组中六项居首。
香港中文大学(深圳)理工学院发布 2026 翔龙鸣凤科学论坛之全球青年学者论坛招募信息,面向全球青年学者开放。内容由该学院授权发布,具体报名与参会细节需查看原文。
千问办公于7月27日低调开启内测,QoderWork、悟空、MuleRun三条Agent线整合为一个产品,由钉钉新任CEO陈宇森牵头,网址为 https://qwenwork.cn/。客户端和钉钉版本已上线,网页版未来推出;钉钉侧边栏可处理群聊、日程、待办等工作,还能一站式生成HTML网页并配好域名、数据库和托管。
亚马逊裁掉了负责模型定制、后训练的 AGI 团队一批员工,同期 GitHub 上线面向企业管理员的 Copilot 看板,按过去 28 天使用行为把开发者划分进不同 AI 采用阶段。
李飞飞团队联合伯克利等研究者发布 T-Rex 论文,提出给灵巧手单独开辟触觉通路的架构,在 12 项真实操作任务上平均成功率达 65%,比最强纯视觉基线的 35% 高出 30 个百分点。
前 Kimi AI 搜索负责人曾歆勋创办 AI 婚恋产品良配,用 AI 红娘 20 分钟访谈生成平均约 460 字资料,再经分层匹配后进入排他 1v1 聊天。2026 年 7 月上线两周获约 5000 名注册用户,约 20% 进入过 1v1 状态,此前已获今日资本徐新 200 万美元天使轮。其 2000 元保结婚会员承诺三年内未领证全额退款。