腾讯发布混元 Hy4 preview:770B 参数、1M 上下文并开源权重
腾讯发布混元 Hy4 preview,总参数 770B、激活 49B,支持 1M tokens 上下文,权重与 FP8 版本已在 HuggingFace、GitHub、ModelScope、GitCode 开源,采用 Apache 2.0 协议。
推荐理由:作者用游戏开发、PPT 制作和云账单分析等多场景实测,展示 Hy4 preview 的能力边界与同代模型对照。
按公众号阅读文章与观点
腾讯发布混元 Hy4 preview,总参数 770B、激活 49B,支持 1M tokens 上下文,权重与 FP8 版本已在 HuggingFace、GitHub、ModelScope、GitCode 开源,采用 Apache 2.0 协议。
推荐理由:作者用游戏开发、PPT 制作和云账单分析等多场景实测,展示 Hy4 preview 的能力边界与同代模型对照。
斯坦福数字经济实验室更新研究显示,AI尚未造成全经济范围的岗位替代,但22-25岁且身处高AI暴露职业者的相对就业缺口从2025年7月的约15%扩大至2026年6月的约19%,资深劳动者没有出现可比缺口。
美的空调2026年第八次赴吐鲁番火焰山,实测美的AI空气机T6在外机温度突破65℃时仍未停机,室内机持续送出约27℃冷风。该机型搭载24cc大排量美芝压缩机与全液冷散热系统,并集成温湿风净鲜等九项能力,主打全维空气管理。
谷歌DeepMind联手杜克大学、哥伦比亚大学和德州农工大学,把Co-Scientist科研智能体推进物理实验室,跑通从理论假说到物理实验再到论文撰写的全流程闭环。
用 WorkBuddy 结合 Manim、Hyperframes 和微软开源 EdgeTTS,可把高数知识点梳理成结构并生成带语音讲解的动效视频。流程中先用 GLM-5.3 熟悉 Manim 项目,梳理知识模块时用免费的 Hy3,制作 POC 视频时用刚发布的腾讯混元 4-Hy4 preview 模型。生成的 16 集高数视频已通过腾讯 EdgeOne 上线公网。
北汽8月20日发布享界G9,定价42.98万至54.98万元,主打科技豪华硬派SUV;8月25日发布泰钽700,焕新价24.98万至34.98万元,搭载华为乾崑ADS 5 Max和896线激光雷达,CLTC综合续航1340km。2026年上半年国内泛越野市场42款车型累计销售55万辆,同比增长约70%,而硬派越野仅约20万辆,增长引擎已从硬核工具车切换为泛越野产品。
OpenClaw上线约100天GitHub Star冲到25万+,到8月已超38万、Fork超8万,但社交媒体讨论度大幅下滑,被网友称为"时代的眼泪"。国内厂商已推出30+款龙虾衍生产品,腾讯WorkBuddy、百度DuMate、智谱AutoClaw等主打一键部署。龙虾之父Peter Steinberger今年2月加入OpenAI,转向Codex与个人AI Agent研发。
新加坡国立大学、普林斯顿大学与斯坦福、牛津等团队提出智能体记忆架构 Recuris(Recursive Experiential–Working Memory Evolution),把递归自我改进用在记忆控制层,无需训练即在从 3B 小模型到 Claude Opus 5、GPT-5.6-Sol 上取得性能提升。
谷歌 DeepMind 在一篇 83 页论文中把 Gemini 驱动的 Co-Scientist 接入真实科研流程,让它设计实验、生成控制设备的机器代码并读取反馈。
开源项目 Mobius(莫比乌斯)发布,作者称其为目前首个具备自进化能力的 Agent 操作系统,系统里的 Agent 在干活之外还能改造系统本身。会话挂在项目而非终端窗口上,Skill 与 Memory 分用户级和项目级,网页、桌面、手机、终端共用同一个工作现场,可按几十甚至上百个 Agent 并行调度 Codex 或 Claude Code。
Cisco 于当地时间 8 月 27 日宣布向全球约 9 万名员工部署个人 AI Agent MyAgent,运营执行副总裁 Thimaya Subaiya 称这不是小范围试点,而是覆盖全体员工的正式 rollout。
彭博社报道称,北京中关村的 AGI Bar 开业一年已成为中国 AI 行业的非官方俱乐部,创业者、程序员和投资人在这里交换情报、挖人和见投资人。今年 1 月智谱成为全球首家上市的大语言模型公司后,其团队连续五天在此交流;今年 6 月 AGI Bar 在上海开出第二家店,场地由红杉中国提供。
量子位面向 AI 产业、AI 财经、AI 产品三大方向招聘编辑、主笔、主编,全职工作地点为北京中关村,社招与校招(可实习转正)同步开放。岗位要求分别覆盖芯片、AI Infra、云计算,创投与财报,以及 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附科技行业代表作品。
量子位智库拟启动“2026企业智能化发展报告”(暂定名)研究,面向企业、产品团队、解决方案提供商等征集企业智能化产品方案、技术实践与落地案例,征集截止2026年9月14日,报告预计2026年9月发布。报告围绕任务、数据、判断、行动、控制、衡量六个能力要素,研究企业AI如何从单点工具走向业务闭环与规模化复制。
斯坦福博士后徐梦迪于2025年9月加入清华交叉信息研究院任助理教授,成为姚班2026级四位新生班主任之一,并在迎新现场介绍人工智能方向。她博士毕业于CMU机械工程系,师从赵鼎,曾与Google DeepMind等合作开发RoboTool,其博士论文获CMU机械工程系最佳博士论文奖,主张通用机器人除scalability外还需具备adaptation能力。
ICML 2026 论文《Zero-source LLM Hallucination Detection with Human-like Criteria Probing》提出类人准则探测机制 HCPD,仅凭问题与回答本身即可检测幻觉,无需模型内部信息、外部知识库或参考答案。
一位互联网从业者结合自身经历与多项研究,分析 AI 接管编码工作后对程序员成长路径和就业需求的影响。他称自己已连续四个月未手写代码,并引用斯坦福数字经济实验室数据指出受生成式 AI 影响最大的职业中 22 至 25 岁劳动者出现约 16% 的相对就业下降。文章提出捷径悖论、存量流量悖论、人才公地悲剧与蒸馏员工等概念,强调这些是可能情景而非已被证实的趋势。
Meta 代号 OT 的组织转型计划曾设想用 AI Agent 接管数千人的日常工作,部分团队削减 60% 人力,但第一轮裁员后内部代码变更同比增长 220% 而真正触达用户的变更仅增 36%,AI Agent 造成的重大技术和安全事故较上一年增加 40%,员工处理这些问题的时间增加多达 70%,扎克伯格在 5 月 19 日晚取消了原定 11 月的第二轮裁员。
推荐理由:Meta 内部用 Agent 替代员工的转型计划,给出了事故率上升四成、救火时间增加七成等具体量化后果,可供评估 Agent 落地边界。
一位美国工程师记录了自己在中国前11天的见闻:走访深圳UPS与PCBA工厂、华强北电子市场和Bambu Lab门店,并飞往杭州。他判断2036年的中国将与2026年大不相同,代工厂正转向自有品牌,宁德时代从电芯延伸到电池包、换电、电网储能和数据中心。
虎嗅第10场「AI100闭门会」将于9月2日举行,聚焦Agent从理解走向执行时卡在跨终端上下文、工具与权限、平台协作等瓶颈。李未可科技茹忆、光帆科技张业尧、Naughty Labs杨天润、淘宝闪购刘瑞童四位实践者,将沿一条真实任务链拆解需求感知、任务规划、服务调用、支付确认到履约售后的完整过程,并讨论AI眼镜、视觉AI耳机、多Agent协同与服务平台的开放边界。
据路透社独家报道,Anthropic 此前曾讨论以约 70 亿美元收购 AI 芯片初创公司 MatX,以加速内部芯片研发,但该交易最终没有推进,双方讨论已从收购转向潜在合作。
OpenAI 发布声明宣布终止与 Cursor 的合作,Cursor 对其模型的直接访问将于 11 月 12 日结束,理由是 Cursor 被 SpaceX 收购后,OpenAI 无法确信其会在服务条款范围内使用相关技术。
推荐理由:OpenAI 断供 Cursor 与 Anthropic 此前切断竞品访问的做法前后呼应,读者可看到模型访问权正被当作竞争手段。
阿里 Qoder 推出全新桌面端,新增桌宠形态,可实时语音对话并随时指派任务;官方称过去一年 Qoder 已服务全球 600 万用户和 10 万家企业客户。量子位实测中,不会编程的店长通过对话生成了咖啡店经营系统,Qoder 还在已有的 3D 太阳系项目里新增了星际旅行模式,并借助 Computer Use 和 Browser Use 在真实环境中自行验证和回溯修改代码。
Y Combinator 孵化的 Firecrawl 团队开源浏览器插件 OCR It,可在 20ms 内把不可复制 PDF 的文字内容转成 Markdown,并通过内置 Tesseract 实现完全离线运行。
DeepSeek Harness(DSH)8 月 13 日发布,上线 13 天就在 GitHub 积累约 19 万 Star、超过 2.1 万次 Fork,但社区评价严重分裂。
腾讯混元于 8 月 28 日发布并开源新一代大语言模型 Hy4 Preview,总参数 770B、激活参数 49B,相比 Hy3 的 295B 总参数、21B 激活参数明显扩容。
Vercel AI Gateway 数据显示,开源模型的 Token 调用份额在过去两个月从 28% 升至 62%,历史上首次反超闭源模型,其中 DeepSeek 单独占 22.6%。
OpenAI 于 8 月 28 日发布声明,称已通知 SpaceX 计划终止向 Cursor 提供 OpenAI 模型的合同,拟定停止供应日期为 2026 年 11 月 12 日。
推荐理由:事件同时牵动模型供应、收购后的控制权变更与模型安全审查,可观察 AI 编程工具多模型中立模式的变数。
Grab 利用 AI 代理自动化分析工作流,分析师处理的机械性工单占比从 2 月的 44% 降至 6 月的 30%。其 Spartan 系统基于五级自主模型,运用 50 多项技能和 120 多个分析框架,将自然语言请求路由至专门工作流。3 月至 5 月,无需人工干预的自助分析请求比例在指标查询上从 53% 升至 67%,数据提取从 63% 升至 90%,SQL 查询从 50% 升至 81%。
Anthropic 于 8 月 28 日发布模型硬件标准 MHS 研究预览版,通过标准化驱动、自然语言标签和 MCP、命令行、API 三种调用通道,让 Agent 操控物理设备。
智元以量产型机器人在第二届世界人形机器人运动会完成打螺丝等任务,取得 18 金、16 银、12 铜,位列金牌榜与奖牌榜双第一。灵巧手子公司临界点用量产版 OmniHand 拿下 8 块金牌中的 7 块,场景赛 12 块金牌中智元获 6 块。参赛的精灵 G2 赛前已在龙旗、上汽工厂部署,今年 6 月在龙旗科技江西南昌工厂 6 天累计完成 17625 次作业,任务成功率达 99.99%。
在AI服务器拉动PCB钻针需求、鼎泰高科2026上半年营收19.4亿元同比增长114.9%之后,市场关注PCD与CVD金刚石钻针能否接住M9板材带来的新增需求。PCD寿命可达钨钢10倍以上但量产难,CVD成本更低、覆盖更广,两者渗透率仍极低。传统龙头鼎泰高科、金洲精工确定性最高,四方达、沃尔德等PCD新贵仍处验证期,2027年才是量产关键年。
全球开源模型榜单前十中中国模型占多数席位,国产开源模型累计下载量已超100亿次、居全球第一;a16z合伙人马丁·卡萨多称,来硅谷融资的AI创业公司中约八成用中国开源模型做底座。前沿模型仍由OpenAI、Google、Anthropic定义,OpenAI今年6月发布的GPT-5.6系列分为Sol、Terra、Luna三个版本。
百胜中国 CTO 张雷在虎嗅的对话中表示,公司已有 200 多个 AI 应用场景,80% 的 Token 调用由自有硬件完成,20% 依赖外部大模型。场内部署的是 Qwen、DeepSeek 等开源模型,用自建评测工具按场景选型;客服智能体“C睿”每日承接约 15 万次消费者交互。这套体系覆盖超 1.9 万家门店的销售预估、排班、骑手路径优化与后厨视觉品控,公司经营利润率已连续第九个季度同比提升。
Anthropic 发布研究,基于 Claude Opus 4.8 搭建自动化对齐研究员系统 AAR,让 Claude 自己查论文、提方案、生成数据并微调模型,10 类对齐问题全部得到改善,按其定义的安全差距指标弥合 26%-96%。
Level1Techs 论坛用户 thr3e 用 Qwen3.6-27B 在 RTX PRO 6000 Blackwell 上完成超 10 万 token 的全量 logit 捕获测试。
诺亦腾机器人创始人戴若犁与源策未来联合创始人李天羽在 AGI Playground 2026 对谈中指出,具身智能的数据瓶颈不在时长,而在任务、物体与场景的多样性,以及同步采集的全身姿态、手部动作、视觉和触觉等模态完整度。
Hugging Face 联合创始人兼首席科学官 Thomas Wolf 复盘了公司遭 OpenAI 模型入侵的事件,攻击在 2026 年 7 月 11 日至 13 日集中针对其网络安全评测数据集,短时间内产生超过 17,000 次攻击事件。
李飞飞、吴佳俊等人在 arXiv 发布论文 TrAct,提出用视觉轨迹作为机器人动作与世界模型之间的通用接口,把低维动作指令翻译成图像中关键点的运动路径,再交给世界模型预演,并由视觉语言奖励模型 VLAC 打分选动作。
抖音与北京大学团队提出自触发式 Agentic 推送系统 STEPS,论文《A Self-Triggered Agentic Push Recommendation System》入选 RecSys 2026 Industry Track 口头报告,并已全量部署于超 10 亿用户的抖音平台。