InfoQ 对话滕昱与唐飞虎:顶级模型应给资深工程师,新人刷题式成长失效
在 2026 世界人工智能大会期间的 InfoQ 直播间,滕昱与唐飞虎围绕 AI Coding 展开讨论,两人在 AI 是否具备判断力上存在分歧,但一致认为 AI 正在优先放大资深工程师的经验与判断能力。
按公众号阅读文章与观点
在 2026 世界人工智能大会期间的 InfoQ 直播间,滕昱与唐飞虎围绕 AI Coding 展开讨论,两人在 AI 是否具备判断力上存在分歧,但一致认为 AI 正在优先放大资深工程师的经验与判断能力。
MiniMax 发布视频模型 H3 并开源一周后,B 站与 YouTube 涌现出量化、LoRA 加速、工作流封装、显卡适配等大量技术内容,有 UP 主用加速 LoRA 和双时钟采样器把约二十步采样压到四步出片,Tensor Alchemist 则测试了 H3 在 8GB 显存上跑 FP8 与 INT8 的效果。
远景科技集团8月6日在乌兰察布宣布「远景乌兰察布星河基地」正式投产,园区内全球最大AI算力超级单体同步亮相,建筑面积超12万平方米,基地总规划容量达2GW,规划支持百万卡并行和百万P级算力。
据 Financial Times 报道,谷歌联合创始人布林重新深度参与 Gemini 相关战略讨论,成为谷歌内部 AI 方向的重要声音之一,但并未获得新的正式管理职位。
Meta MSL 开源本地 Agent 模型 Muse Glimmer,总参数约 296 亿(含约 18 亿参数视觉编码器),上下文超 13 万 Token,支持文本和图像输入,量化到 17GB 后可装进 24GB 消费级显存。
推荐理由:Meta 开源 30B 级本地 Agent 模型,量化后 24GB 消费级显存可跑,读者可据此判断本地 Agent 的部署门槛变化。
AI 的互联网访问量已正式超过人类网民,Cloudflare 在最近财报会议上预测 5 年后 AI 流量将是人类的 1000 倍。文章称语言模型的训练将在 2026 年到 2032 年间耗尽人类公开的文本数据,高质量语言数据的枯竭甚至可能提前至 2026 年;Stack Overflow 的月提问量已从逾 20 万跌至不足 5 万,回到 2009 年刚上线时的水平。
Meta 发布约 30B 参数的多模态 Agent 模型 Muse Glimmer,支持 128K 上下文,采用 Apache 2.0 许可,并提供 llama.cpp、MLX、ExecuTorch 等本地部署方式。
2025年1月28日华为高层决策快速支持DeepSeek,海思与华为云集结230多名技术骨干,从除夕夜到大年初二完成3000多张昇腾芯片部署验证,将DeepSeek-V3/R1部署到华为云贵安数据中心昇腾云上。
Anthropic 宣布将 Claude Sonnet 5 的初始定价永久保留,输入每百万 Token 2 美元、输出每百万 Token 10 美元,取消原定 8 月 31 日后上调至 3 美元和 15 美元的计划。
Anthropic 宣布其尚未公开的 Claude 研究模型在黎曼猜想上取得进展,将满足该猜想的黎曼ζ函数零点比例下界从 41.6% 提高到 67.2%。该研究由约 60 个子智能体在 Claude Code 中协作完成,历时一天半,执行 2400 条 Shell 命令、写下数百个 Python 脚本,并从 arXiv 下载 54 篇论文查重。
推荐理由:读者可以看到从 650 次失败到 60 个子智能体协作的完整研究过程,以及这项数学纪录被推进的具体幅度。
LibTV 围绕 Seedance 2.5 推出智能引用、片段重拍和超长视频三项更新,从拿到模型测试权限到做出这批功能只用了两天。Seedance 2.5 单次最多可输入 50 份全模态参考素材、单次生成 30 秒视频,LibTV 借此把 30 秒延长至 5 分钟长片直出,生成价格仍为每秒 0.4 元左右,与 Seedance 2.0 折后价持平。
Cloudflare 在最近财报会议预测,5 年后互联网上来自 AI 的流量将是人类的 1000 倍,而 AI 访问量此刻已正式超过人类网民。据测算,语言模型训练将在 2026 年至 2032 年间耗尽人类公开文本数据,高质量语言数据枯竭甚至可能提前至 2026 年。
英伟达与 Apollo、BlackRock、黑石、布鲁克菲尔德、高盛和 KKR 六家金融机构共同建立独立融资平台,目标在未来调动超过 5000 亿美元的第三方资本用于 AI 基础设施建设。
BeingBeyond 智在无界发布 Being-H0.8,称其为全球首个隐式触觉世界动作模型,首次将触觉模态引入大规模模型预训练,并把视觉、触觉、动作与未来状态变化统一到同一隐空间。其隐空间世界动作模型路线训练成本约为视频生成路线的 1%,推理速度可支撑实时控制,团队已积累超 50 万小时第一视角人类视频数据。创始人卢宗青为北京大学计算机学院长聘副教授,认为具身基础模型的确定性技术尚未出现。
Anthropic 宣布新款 Claude 将在生成文本中嵌入隐形水印,并称已签署欧盟《AI生成内容透明度行为准则》,该机制自 2026 年 8 月 2 日起适用于其后发布的所有模型,且在全球推行而非仅限欧盟。
黄仁勋宣布 NVIDIA 与 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs 和 KKR 合作建立独立融资平台,计划随时间撬动超过 5000 亿美元第三方资本投入 AI 基础设施建设。
推荐理由:原文在宣布超5000亿美元融资平台的同时,把它与互联网泡沫时期的供应商融资对照,便于读者理解这套算力融资结构的争议。
Meta 超级智能实验室 8 月 10 日发布 300 亿参数的 Muse Glimmer,以 Apache 2.0 开放权重,专为持续运行的本地智能体工作流优化,可在配备单张消费级 GPU 的 Mac 或 PC 上运行,并支持超 100 种语言。
网易游戏、网龙、平凯数据库(TiDB)与汇丰科技的技术负责人围绕 Coding Agent 落地生产环境展开讨论,指出遗留代码改造需求大于新功能开发,金融等行业客户的多阶段人工审批让流程更复杂。
Bun 创始人 Jarred Sumner 用约 50 个并行运行的 Claude 智能体,耗时 11 天将 Bun 从 Zig 移植到 Rust,按 API 定价花费约 16.5 万美元,生成超过 100 万行 Rust 代码;据 Sumner 称,该项目在全部受支持平台上 100% 通过了 Bun 自身超过 100 万条断言的测试套件。
寻明生科(Aureka)近日再获总额1亿美金的B系列融资,首轮由Granite Asia独家投资,后续轮次由产业投资人领投、弘晖基金跟投,启明创投、经纬创投及纽尔利资本等老股东追加,距其披露3500万美元A+轮融资仅过去3个多月。
前华为「天才少年」、诺亚方舟实验室技术专家楼燚航离职创立具身智能公司引力蓝移,采用 System Two 与 System One 分层架构,System Two 参数规模可扩至 200B 以上。团队规划 6 至 12 个月推出 40B 至 80B 模型,24 个月左右形成小规模收入,第一阶段融资估值约 2 亿美元。
2026年7月23日特斯拉发布业绩报告,上半年营收506.2亿美元同比增长21%,净利润16.2亿美元同比持平。文章指出汽车业务仍占总营收的72.6%,2025年整车毛利润率13.2%,低于比亚迪的20.5%,FSD 收入仅占整车销售收入的1.3%。
豆包公关负责人刘星回应称,豆包生活服务无付费推广、推荐酒店不收广告费,12%综合费率仅适用于抖音生活服务豆包渠道的酒店订单。宇树科技科创板IPO网上发行最终中签率0.01809759%,发行价150.80元/股。Meta因旗下社交媒体成瘾性设计被四州联合索赔1.4万亿美元,8月12日启动陪审团筛选。
多位程序员为保住工作自费购买 token 使用 AI 编程工具,所在公司却下调或取消企业会员额度,同时把效率要求提得更高。广东一家大数据公司今年年初把 token 不限量改为每人每月限用 200 元,上海的石健每月自费最多约 60 美元,武汉的程一巍则反对公司发 token,认为发 token 往往与裁员相伴。
微信近期在朋友圈内测 AI 帮写,可根据图片和已写文字生成 3 条朋友圈文案;朋友圈文字长按新增 AI 点评,可对内容作出评价并快捷生成评论。公众号列表中小微被置于左边第一位并常驻置顶,点击可自动总结最近常看的公众号文章。作者卡兹克表示不喜欢这些更新,认为 AI 替人记录和社交、替读者决定文章重点,会削弱朋友圈与内容创作中的真诚表达。
Anthropic 一个内部未公开的研究版 Claude 在黎曼猜想的关联问题上取得进展,将黎曼ζ函数零点中满足黎曼猜想的已知下界从41.6%提升到67.2%,即提高25.6个百分点,而此前37年里数学家仅将其推进0.8个百分点,黎曼猜想本身仍未获证明。
推荐理由:相比数学家37年仅推进0.8个百分点,这次提升展示了大模型子智能体协作推进数学问题的一种路径。
宇树科技8月10日下午三点结束网上申购,发行价150.80元/股,对应发行后市值609.93亿元,全国社保基金旗下组合、DeepSeek、腾讯以及中石油、南方电网、中国电信旗下产业资本等为战略配售对象。
久痕科技创始人汪源认为,仅靠组合Skill打包出的智能体只是工具集合,缺少独立数据库与生命周期,无法长期后台运行;其rOS内置原生内容驱动机制,可实时抓取邮件并推送至aApp处理。公司2026年4月推出Agentic OS“rOS”及原生应用生态aApp,C端2026年1月起商业化,按月订阅用户次月续费率超80%。
飞书被整合进豆包,阿里整合QoderWork、悟空和MuleRun推出千问办公,腾讯则通过WorkBuddy从个人办公进入企业级AI工作台。虎嗅第8场AI100闭门会将于8月18日围绕"AI办公市场格局"展开讨论,腾讯WorkBuddy产品专家李超、元空AI创始人逄大嵬、像素绽放创始人赵充、峰瑞资本陈石等嘉宾将同题讨论格局变化、价值付费与发展路径。
Meta 宣布开源 30B 参数的 Agent 模型 Muse Glimmer,采用 Apache 2.0 协议,权重已上传 Hugging Face,24GB 显存即可本地运行。
Flova 将 Seedance 2.5 的生成能力与 Agent 任务调度融合,用创作文档和故事板锁定项目状态,解决 AI 视频"一改全废"的痛点。Seedance 2.5 支持 50+ 多模态参考输入和 30 秒原生直出,实测中稳定生成 30 秒一镜到底长镜头。Flova 同步推出限时折扣,会员最高买一赠一,480p 单秒生成成本低至 0.23 元。
Anthropic 为 Claude Code 增加了实验性能力 Cross-session messaging,允许多个同时运行的 Session 互相发送消息。
揽月动力研发基于约化模型的物理 AI 架构 RACE,并推出首款重载双轮足人形机器人 L1,力控频率达 1000Hz、底层可支持 2000Hz,可负重 25kg 移动。L1 正在国内某龙头企业工厂进行 POC 验证,多家工厂已提出合计约 1000 台部署需求,公司同时与航天院所等机构探讨机器人参与太空基建的可能。
Anthropic 在 Slack 上线的 Claude Tag 已在其内部接管大量日常工作,产品团队超过 65% 的代码由它生成,部分员工 90% 的工作通过 Tag 而非 Claude Code 完成。
宇树科技董事长兼CEO王兴兴在IPO路演中回答了200多道提问,对股票是否破发仅回应请关注公司上市后的股价走势,并称按2025年扣非净利润计算的发行价对应市盈率为92.92倍。
推荐理由:路演问答集中回应了破发风险、估值依据与具身大模型进展,可借此了解宇树上市前的自我说明。
北京航空航天大学洪晟教授团队提出 BGA 噪声免疫神经蒸馏框架,用于识别 TLS 1.3 加密流量中的恶意指令,推理延迟低至 0.28 毫秒。该框架引入带梯度惩罚的 WGAN-GP 合成少数类样本,将 MSCI 攻击检测召回率提升 43.2%,并通过自适应门控多头注意力机制抑制加密噪声。在 CIC-IDS-2018 和 Edge-IIoT 基准测试中,BGA 检测指标全面超越现有 SOTA 方法。
DeepMind 联合创始人哈萨比斯表示,AI 若能解决一个千禧年数学大奖难题,将是「第37手级别」的重大突破,他认为这只是时间问题。
文章提出,AI+机器人将主导第一、第二产业,产能占比或超99.99%,释放出天量人类精力与时间。这些资源将涌入第三产业,尤其是娱乐业,形成一个涵盖刷抖音、打王者到读书写作、作曲编曲的"大娱乐"时代。作者认为,在创造与消费两种角色中,创造者占比更高者可能掌握AI时代的财富密码。
阿里千问 App 更新大版本,8 月 10 日上线开放平台,贝壳、顺丰、哈啰、闪送、盈米基金、天鹅到家、彩云天气等以独立智能体身份入驻。作者实测天鹅到家、顺丰、哈啰租车等智能体,账号绑定授权后可调出历史订单与实时库存完成下单,多约束的租车需求也能被逐条回应。平台支持伙伴低门槛迁移已有 Agent,并保留自定义 UI 和品牌身份,首批选品集中在高频刚需场景。
科锐国际 CTO 刘之在 AGI Playground 2026 对谈中指出,AI 让执行变便宜,全球招聘需求下滑但 AI 招聘工具使用持续上升,关键人才薪酬从几十万美元升至几百万美元甚至更高。