Linus 谈 AI 在 Linux 内核的局限:代码不能直接用,补丁多是创可贴式修复
Linus Torvalds 在一场开源技术会议上表示,LLM 能帮助发现 Linux 内核的 bug,但生成的代码往往不能直接使用,补丁常是未修复底层问题的创可贴式修复。他认为 LLM 生成的幻觉 bug 报告仍会消耗维护者资源,目前还无法替代长期维护者的架构判断、工程经验与代码品味。对谈还谈到 Linux 7.1 的 486 支持移除、NTFS 子系统更新,以及 C 与 Rust 的取舍。
微信公众号
Linus Torvalds 在一场开源技术会议上表示,LLM 能帮助发现 Linux 内核的 bug,但生成的代码往往不能直接使用,补丁常是未修复底层问题的创可贴式修复。他认为 LLM 生成的幻觉 bug 报告仍会消耗维护者资源,目前还无法替代长期维护者的架构判断、工程经验与代码品味。对谈还谈到 Linux 7.1 的 486 支持移除、NTFS 子系统更新,以及 C 与 Rust 的取舍。
傅聪团队联合厦门大学提出生成式推荐框架 ManCAR(流形约束自适应推理),将多步推理重构为用户协同行为流形上的结构化导航,避免隐式漂移。实验显示自适应测试时计算带来 NDCG@10 最高 46.88% 提升,论文已被 KDD2026 接收,并在 Hugging Face Daily Paper 当日排名第二。
Spotify 工程副总裁 Niklas Gustavsson 与 Claude Code 创始人 Boris Cherny 对话,介绍 Spotify 约 2900 名工程师中约 73% 的 PR 可由 AI 生成,PR 提交频率提升 75% 以上,每天约 4500 次生产部署。
谷歌 GKE Labs 推出开源项目 OpenRL,为在标准 Kubernetes 集群上对 LLM 进行后训练和微调提供自托管 API。它通过并行运行多个强化学习任务提高 GPU 利用率,并支持在 Mac 上运行强化学习循环、指向 Kubernetes 集群或虚拟机上的训练 API。
中国信通院推出首个面向 AI Infra 运维的智能体评测基准 AISHPerf-智算运维智能体评测基准,无问芯穹作为重点技术支持单位参与建设,基于近百亿条真实运维数据抽象出 103 条评测用例。
6 月 26 日,张江人工智能创新小镇联合 InfoQ 举办的 Top Tower Talk「Harness 时代的硅基团队治理」专场在上海张江举行,聚焦 Agent 进入企业核心流程后的可控、可信、可追责问题。
Anthropic 技术团队成员 Tariq Shihipar 表示,他们已经删掉了 Claude Code 80% 的系统提示词,理由是指令和示例越多越好的旧逻辑不再成立,新模型 Fable 5 比给出的示例更有想象力。
北京航空航天大学、复旦大学与浙江大学提出 QC-MHM 框架,通过问题校准、多跳建模与时序感知嵌入辅助任务,提升时序知识图谱问答能力。该方法在 CronQuestions 与 TimeQuestions 两个基准上均达 SOTA,复杂多跳问题 Hits@1 绝对提升 5.1%,整体 Hits@1 达 0.971。
在 2026 AICon 上海站专题上,阿里巴巴 Qoder 与慧博科技的四位实践者分享了 Agent 从 Coding 走向 Anything 的路径:Qoder Desktop 以 Experts Mode 多 Agent 协作实现自主交付。
网易有道 CEO 周枫撰文总结构建大模型产品 Harness 层的七个要点,提出 Agent = Model + Harness,在复杂 Agent 中模型可能只完成 20% 的工作,其余 80% 靠 Harness。七个要点包括面向下一代模型能力设计、聚焦高智能场景、舍得消耗 token、把上下文工程当成主任务、把工具设计成模型可消费的能力单元、用评测驱动开发,以及默认从单 Agent 开始。
Anthropic 的 Fable 5 回归,付费用户可在 7 月 7 日前将每周使用额度的 50% 用于该模型,价格为每百万输入 token 10 美元、输出 50 美元。
腾讯混元与新南威尔士大学联合提出 E-GRM 框架,将模型不确定性重新定义为算力调度信号,仅对困难样本投入完整 CoT 推理。在 MATH 数据集上,58% 样本走短路径,延迟从 3.8 秒降至 2.2 秒(-62%),FLOPs 从 23.7T 降至 15.7T(-49%),准确率从 75.1% 提升至 78.4%(+3.3%)。
腾讯云 Agent Runtime 是一套面向 Agent 原生执行的基础设施平台,覆盖接入、运行、治理和智能四层,目标是用系统的确定性收敛 Agent 的不确定性。
Shopee 技术专家王新波在 QCon 2026 北京站分享了团队两年打造企业级 Data Agent 的实践,把取数工具演进为支持场景化智能分析的平台。他指出学术界 85% 到 91% 的 Text-to-SQL 准确率在企业 OLAP 场景会降到不足 40%,GPT-4o 在 Spider 2.0 上仅约 10%。
Cloudflare CEO Matthew Prince 在播客访谈中表示,2026 年上半年 Bot 流量首次超过人类流量,若趋势延续,五年内互联网流量可能达到今天的 1000 倍。他预计未来两年类似 Log4j 级别的漏洞可能每周出现一次,但随后 AI 审查会让软件质量大幅提升。Cloudflare 已裁减超过 20% 团队成员以压缩中层管理者,并正推动以微支付支撑未来互联网商业模式的方案。
Cursor 发布名为 Cursor Mobile 的 iOS 移动应用,用户可在手机上启动编码会话、查看智能体输出并实时交互,还支持语音输入与斜杠命令。
Anthropic 突然发布 Claude Sonnet 5,官方称这是迄今最具智能体能力的 Sonnet 模型,重点提升计划制定、工具调用与自主执行,已面向所有套餐开放并成为 Free 和 Pro 用户的默认模型,同时上线 Claude Code 和 Claude Platform。
推荐理由:文章把 Sonnet 5 的发布放在 Anthropic 高端模型受出口管制、社区反馈平淡的背景下,梳理其性价比定位与争议。
腾讯混元与 UNSW 在 ACL 2026 论文中系统研究了大语言模型 SFT 的「不完全学习」(ILP),提出「检测→归因→干预→验证」框架,并归纳出五大根因与五种干预方案。论文承认约 3% 的未学习样本无法归入现有根因,并展望了自由文本 pass@N 检测、多根因联合归因、CPT 精细化及向 RLHF/DPO、多模态、持续学习推广等方向。
美团 Keemart 前后端团队正式合并、蚂蚁网商推动测试岗整体转向研发,AI Coding 正在推动大厂把前后端分工并入全栈交付。字节、阿里、谷歌、腾讯等招聘岗位描述显示,前端岗位职责已扩展到 Agent 服务编排、模型调用与端到端交付。
6 月谷歌 DeepMind 多位核心研究人员流向 OpenAI 和 Anthropic:Gemini 共同负责人 Noam Shazeer 于 6 月 18 日宣布加入 OpenAI。
苹果在 2026 年 WWDC 大会上推出 Xcode 27,扩展了编码代理集成,重新设计用户界面,并引入用于统一管理模拟器和设备的 DeviceHub。编码代理的对话记录直接集成到编辑器窗格,以编辑器形式呈现,可用 /pl 命令让代理先收集背景信息并给出计划供审阅。
Notion 产品负责人 Max Schoening 在 Lenny Rachitsky 的播客中表示,Notion 的设计师已开始在终端和代码里做原型,PM 不再写长篇 PRD 而是直接做出可运行的 demo,部分人已开始向正式代码库提交代码。
Snowflake 在 Builder Keynote 上展示 AI 助手 CoCo 进化为覆盖规划、拆解、生成与测试的全生命周期协同者,并支持 Planning、Implementer、Tester、Reviewer 组成的 Agent 团队自主协作。
优刻得董事长兼 CEO 季昕华认为 Token 降本的终局是电力,电便宜 Token 才便宜,乌兰察布凭借低电价、绿电、低温和近北京成为其数据中心选址。他提出降本五个方向:使用 DeepSeek 等国内模型、提高每度电产生的 Token 数、选择合适的数据中心位置、按任务组合不同模型、加强 Prompt 管理与治理。
据 SemiAnalysis 爆料,LeptonAI 创始人兼 CEO、英伟达系统软件副总裁贾扬清已从英伟达离职,距黄仁勋以 7 亿美元收购这家 20 人团队刚过去一年。
InfoQ 宣布展开长期招聘,岗位包括销售负责人、传媒销售、AI 领域作者、内容策划和项目管理,年薪区间 20-100W,工作地点覆盖北京、杭州、深圳。InfoQ 表示正从技术媒体社区进一步向 AI-Native 媒体/社区迈进,并称硅基同事陆续入职是确定性事件,但更多碳基同事才是维系人与人链接的基础。
大晓机器人开放场景自主作业解决方案的晓途智能机器狗正式进驻上海西岸片区,投入常态化无人巡逻执勤,可 7×24 小时不间断值守。该方案由具身超级大脑模组 A1 与智能管控平台构成,支持开放环境全流程自主导航,无需预建高精地图,并可通过云端平台实现一人管控多台机器狗的集群调度。机器狗已在天津海棠花节完成大型客流场景保障任务。
Spring 生态集中发布多个组件增量版本,其中 Spring AI 2.0.0 正式发布,废弃 GEMINI_2_0_FLASH、GEMINI_2_0_FLASH_LIGHT 和 GEMINI_3_PRO_PREVIEW 枚举,改用 GEMINI_3_1_PRO_PREVIEW。
6 月 26 至 27 日,InfoQ 中国主办的 2026 AICon 上海站落地,超 1500 位开发者参会,48 家企业与科研机构的近 70 位专家围绕智能体、基础设施与产业落地分享。大会释放的信号是行业从模型热度转向场景交付与商业验证,观正资本肇极称 2026 年第一季度全球 AI 融资规模已超越 2025 年全年、占全球 VC 投资份额达 80%。
福特因在生产和设计中过度依赖自动化系统导致质量下滑,召回并提拔 350 多名资深工程师,用于指导年轻工程师并改进数据收集与 AI 训练流程。硬件工程副总裁 Charles Poon 表示,AI 的有效性取决于训练数据质量,公司还低估了资深工程师积累的组织知识。
6 月 24 日豆包发布基于豆包 2.1 系列大模型的专业版,提供接入豆包 2.1 Pro 的办公任务模式,可执行操作本地电脑、使用浏览器、调用 Skills 技能和定时任务等 Agent 任务,并采用 68 元、200 元、500 元连续包月的三级阶梯定价。
ArrowJS 发布 1.0 稳定版并开源,代码库迁至 GitHub 的 standardagents 组织,最新补丁版本为 v1.0.6。该框架基于 JavaScript 模块、模板字面量和 DOM 构建,无 JSX、无编译器、无构建步骤,核心运行时不到 5KB,仅含 reactive、html、component 三个函数。
月之暗面 Kimi B 端负责人黄震昕表示,Kimi 定位不是做最便宜的模型,而是做最高性能的模型,目标是和海外三家头部模型“掰一掰手腕”。Kimi 将视觉理解、Coding 和 Agent 能力融合在同一个模型中,预训练阶段即混合视觉与文本数据,并已与字节跳动 Trae 上线 Visual Debug 功能。
代码不只是给机器执行的指令,更是写给未来工程师的讯息,提交信息必须能独立传达开发意图。文章建议将合并请求视为一本书、每次提交为一个章节,坚持原子化提交、动词开头的简短说明,评审时用新增提交代替强制推送重写历史。AI 智能体虽能快速生成大量代码,但若放任其输出只会得到一条"实现功能"的巨大提交,让它遵循与人类工程师相同的规范,提交历史才具备可审计性。
谷歌发布 Google Colab CLI,允许开发者和 AI 智能体通过终端命令直接与远程 Colab 运行时交互,申请 GPU、TPU 等加速器并执行本地 Python 脚本。
Meta 已无限期暂停用于训练 AI 的员工监控项目 MCI,起因是该工具收集的员工私人对话、绩效数据、屏幕内容与转录文本因访问控制列表配置错误,向公司内部所有人开放。
亚马逊云科技亚太区联席总裁储瑞松指出,Agentic AI 爆发拐点已至,但大量企业 Agent 卡在原型阶段,原因不是模型不够强,而是缺少认证、记忆、长任务执行、安全、治理、工具接入等生产级基础设施。他将 Agentic 工程体系定义为把模型能力转化为可稳定交付业务结果的系统化工程能力,并建议企业从业务结果导向出发,像写岗位说明书一样定义智能体的职责、权限与出错预案。
OpenAI 发布 GPT-5.6 有限预览版,包含旗舰 Sol、中端 Terra 和日常模型 Luna,因美国政府要求目前仅向获批企业开放,个人用户无法访问。
推荐理由:报道同时给出 GPT-5.6 的定价与政府审批限制,以及 METR 关于其测试作弊使自主性度量失真的判断。
Dropbox 发布内部平台 Nova,用于在工程工作流中编排和运维 AI 编程智能体,支持通过 Web 界面、CLI 或 API 启动会话。Nova 让智能体在隔离云会话中针对真实构建、测试和运维系统验证更改,已用于自动修复不稳定测试的 Deflaker 及大规模依赖迁移。平台可与可观测性系统、内部插件、Slack 和基于 MCP 的工具集成,并将代码发布与智能体执行分离。
阿里云发布云 Skills 门户,通过 Skills 化、MCP 化、CLI 化三条路径实现标准化工具调用,把 300 多个云产品、2 万多个 API 升级为更适合 AI 使用的 Agent-Ready 能力。