虚拟座谈会:机器时代的安全——专家解读 AI 威胁的演变
多位安全专家在虚拟座谈会上指出,提示词注入、越狱和间接提示注入是当前最常见且危害最大的 AI 攻击方式,攻击者无需攻破模型,只需将恶意指令植入模型摄入的不可信内容即可劫持代理行为。AI 增强的大规模社会工程学攻击同样破坏力巨大,生成式 AI 使攻击高度个性化且可规模化,深度伪造语音已能诱导高管批准付款或重置账户。专家强调,AI 安全工程师需从代码安全扩展到数据、模型和代理安全,并掌握对抗性思维。
按公众号阅读文章与观点
多位安全专家在虚拟座谈会上指出,提示词注入、越狱和间接提示注入是当前最常见且危害最大的 AI 攻击方式,攻击者无需攻破模型,只需将恶意指令植入模型摄入的不可信内容即可劫持代理行为。AI 增强的大规模社会工程学攻击同样破坏力巨大,生成式 AI 使攻击高度个性化且可规模化,深度伪造语音已能诱导高管批准付款或重置账户。专家强调,AI 安全工程师需从代码安全扩展到数据、模型和代理安全,并掌握对抗性思维。
OpenAI 正式推出 GPT-5.6 系列,包含旗舰版 GPT-5.6 Sol、均衡版 GPT-5.6 Terra 和轻量版 GPT-5.6 Luna 三款模型,现已通过 ChatGPT、Codex 和 OpenAI API 上线,三档定价分别为每百万输入 Token 5、2.5、1 美元。
推荐理由:原文给出三档模型的定价与 Token 效率数据,并说明 ChatGPT Work 从问答转向自主执行任务的定位变化。
一项推理成本模型测算显示,自建 GPU 部署大模型的临界利用率约为 52%,低于该值自建反而比 API 更贵,而多数 AI 创业公司利用率仅 30%-50%。以 4×H100 部署 70B 模型为例,利用率从 80% 降至 30% 时每千 Token 成本从 $0.011 涨至 $0.045,涨了 4 倍。蒙特卡洛模拟显示 95% 置信度下临界点落在 48%-56% 之间。
OpenAI 正式发布 GPT-5.6,ChatGPT、Codex 及 API 均已上线,并同步推出由 Codex 和 GPT-5.6 驱动的 ChatGPT Work。
推荐理由:原文列出 GPT-5.6 三档模型与 ultra 多智能体模式,读者可据此判断旗舰模型的能力与定价走向。
清华大学智能产业研究院(AIR)刘洋教授团队的数学智能体系统AIM,深度参与了AIR-求真书院联培学生王彦桥与刘锦鹏助理教授完成的前沿量子算法研究,提出符号嵌入量子算法(Sign Embedding Quantum Algorithms),形成一篇84页论文。该研究从"有理逼近能否成为量子算法设计原则"的模糊直觉出发,AIM参与定理组织、证明草稿生成和复杂度分析,人类研究者负责方向筛选与最终审计。
MiniMax 于 6 月 1 日发布原生多模态、1M 上下文的 M3,同步把订阅制 Coding Plan 改为按 token 计费的 Token Plan,因缺少提前沟通导致部分用户额度消耗超预期而表达不满,公司当晚致歉,当天股价收跌 15.71%。作者获准进入 MiniMax 内部,全程围观了模型发布前后的争吵、和解与实名提问的全员复盘,以及团队对定价设计与用户 context 缺失的反思。
Meta 发布最先进 AI 模型 Muse Spark 1.1,首次向开发者推出付费 API,定价约为 OpenAI 和 Anthropic 同类顶级模型的四分之一,扎克伯格称其 Agent 与编程能力显著提升。OpenAI CEO 奥尔特曼称 GPT-5.6 Sol 在代理式编程任务中 Token 使用效率提升 54%。此外,前美联储主席伯南克加入 Anthropic 长期利益信托机构。
OpenAI 在直播中正式上线 GPT-5.6,一次推出 Sol、Terra、Luna 三个模型,并把 Codex 应用与 ChatGPT 合并成同一产品。作者实测 GPT-5.6 Sol 在编码和 Agent 执行上幻觉率低,在 Agents' Last Exam 中以 53.6 分比 Claude Fable 5 高 13.1 分。
推荐理由:作者以数天高强度实测记录了 GPT-5.6 Sol 在编码、Agent 和安全防护任务上的表现,可与 Claude Fable 5 对照参考。
OpenAI 发布 GPT-5.6,包含 Sol、Terra、Luna 三款模型,并推出对标 Claude Work 的 ChatGPT Work。旗舰款 Sol 在 Agents' Last Exam 测试的 55 个行业长程工作流上得分 53.6,比 Claude Fable 5 高 13.1 分。
推荐理由:原文梳理了 GPT-5.6 三款模型的分档与命名规则,读者可以据此了解这次发布的产品结构与能力分层。
北京人形机器人创新中心联合中国人民大学高瓴人工智能学院,在慧思开物平台开源了 Robo-ValueRL。该框架在 VLA 中引入价值估计器,可筛选高价值轨迹数据,并采用冻结预训练主干加轻量残差适配器的方式缓解在线迭代中的灾难性遗忘。仅训练 6 天的真机验证显示,其双任务表现优于 Dagger 等算法,毫米级芯片插入一次完成,作业效率达人类操作员的 1.5 倍。
ICML 2026 共接收 6352 篇论文,其中 Spotlight 536 篇、Oral 168 篇,现场精选 8 篇代表作覆盖优化理论、智能体评测、强化学习与多模态理解等方向。其中 LoRA 梯度下降首次在无假设条件下被证明以 O(1/log T) 速率非渐近收敛;VLM 研究则发现模型检测视觉变化时准确率下降高达 60%,存在「说而不看」问题。
中兴通讯高级副总裁倪飞确认,旗下努比亚将推出一款量产旗舰级AI智能体手机,并将在2026世界人工智能大会(WAIC)上首次公开展示。努比亚在国内将全面承接豆包手机业务,与红魔一起主攻线上渠道,中兴母品牌则回归运营商定制机。此前搭载豆包手机助手技术预览版的努比亚M153已小规模亮相,核心卖点是跨应用自动化能力,但面临互联网平台不愿开放数据和入口的生态障碍。
多位职场人因过度信任AI生成内容而翻车:公关经理被AI编造的三家不存在的竞品品牌和虚假行业数据坑掉千万级竞标项目,律师险些栽在AI虚构的地方性法条上,程序员因AI擅自改动线上代码导致项目延期两周、自费七千多元Token。这些案例表明,AI越能给出完整答案,使用者越需要保留判断、核验和兜底的能力。
7月9日科技板块反弹,科创50指数收涨8.41%,兆易创新、长电科技、浪潮信息等涨停,沐曦股份涨16.88%、摩尔线程涨13.96%。浪潮信息预计2026年上半年归母净利润26亿至31亿元,同比增长226%至288%,二季度单季创历史新高。华为何庭波7月3日发布韬定律V2,给出量产工艺参数,带动先进封测、EDA、半导体设备需求重估。
Momenta 于 7 月 8 日登陆港交所,以 295.6 港元开盘,市值站上 700 亿港元。暗涌Waves 访谈七位投资人,复盘这家智驾公司从 L2 量产装车切入、靠主机厂战略投资熬过 L4 声量最大时期融资真空期的十年。
蚂蚁集团灵波团队(Robbyant)开源了面向机器人的视频生成模型 LingBot-Video,并放出技术报告。该模型 30B 总参数、3B 激活,采用 MoE 架构,可模拟流体、刚体、材质和镜头运动,训练数据包含超过 7 万小时具身数据。团队还用强化学习从感知、物理、执行三方面优化输出,称其在具身相关基准上超过 Cosmos 3 等五个开源模型。
2026 年 5 月,Bun 项目用 Claude Code 在 11 天内将约 53.5 万行 Zig 代码重写为 Rust,涉及超过 100 万行代码变更、6778 次提交,API 成本约 16.5 万美元。
推荐理由:百万行代码迁移用 11 天完成,文中披露了实现者与审查者分离的 50 个工作流和 16.5 万美元的成本账。
智能家居端侧芯片工程师展菲借助AI Agent和阿里云,同时切入AI眼镜、具身机器人解决方案和活动管理小程序"展菲汇"三个领域。他用两条指令完成项目从开发环境到云服务部署的全过程,Agent还接管了报名审核和内容审核流程。展菲汇从去年8月规划、9月启动,Web端和小程序端基于阿里云ECS运行,图片存入OSS并通过ESA边缘加速访问。
原力灵机在北京 Action 2026 开发者大会上发布自研 4B 具身基础模型 DM0.5,并同步推出通用具身本体 2.0-Apex 与 DexDev 开发者平台。
上海人工智能实验室青年科学家李林阳创办的芯片设计公司 Novasilicon(芯星元)完成首轮融资,由五源资本独家投资数千万元。该公司不做 EDA,而是让多 AI Agent 承担设计、规划、调用 EDA 及迭代优化,先从模拟后端版图设计和数字后端布局布线切入,计划年内推出标准化后端设计产品。
一位在北京生活 20 年的家长在离开北京前,分享了为小学生选择海南创新学校的思考:AI Agent 时代教育应放弃"知识型"灌输,转而呵护好奇心、探索欲和解决问题的信心。他为孩子搭建了基于飞书的 Hermes Agent,用于 AI 绘画与 AI 编程探索,并配置了专属域名上线项目。他认为审美品位是 AI+Robot 覆盖一二产业后最关键的能力,品味即注意力即价值。
西门子推出面向自动化工程的 Eigen Engineering Agent(Eigen 工程智能体),可自主完成 PLC 编程、HMI 可视化开发和设备配置,并已在 19 个国家逾百家企业试点,整体解决方案质量提升 80%、工程效率最高提升 50%、执行速度为人工流程的 2 到 5 倍。
印度 Nifty IT 指数自 2024 年 12 月历史高位已回撤 43%,2026 年上半年下跌约 30%,是印度市场表现最差的板块。其下跌节奏几乎对应每场美国 AI 公司的发布,2 月 Anthropic 发布编程工具、5 月 OpenAI 投入超 40 亿美元组建前置部署工程师团队后,孟买 IT 板块均出现抛售。
尊界S800上市13个月累计交付19000辆,连续9个月稳居百万级豪车销量冠军,成为国产百万级豪车首次用销量证明实力的车型。其搭载华为途灵龙行平台,实现6合1智能协同控制,最小决策链路时延低至1毫秒;尊界超级工厂配备超2200台智能机器人,首发CV质检大模型“迈思特”,缺陷检出率达99.99%。
量子位将于 7 月 17 日 19:30 在上海浦东举办 WAIC 首夜线下活动,主题聚焦 AI 从"会回答"到"能完成"的现实考题。活动设两场分享:Evomap 创始人兼 CEO 张昊然与记忆张量 CTO 李志宇谈 Agent 从聊天框到正式上岗,VAST CTO 梁鼎与脸谱心智创始人陆弘远谈模型从 GitHub 到与世界交互。
原力灵机在开发者大会上发布新一代具身基础模型DM0.5,参数规模4B,较上一代DM0翻倍,数据量增加400%。该模型Zero-Shot导航成功率提升31%,Few-shot成功率提升45%,微调后任务成功率提升20%,推理效率提升25%,在H100上延迟低至50ms、4090上为90ms。同步推出DexDev开发者平台(含DFOL2.0、MaaS、DexOS)与多智能体混合作业系统Ferrata。
星连资本将在 WAIC 开幕之夜举办 Stellaris Night·星河之夜闭门聚会,时间为 7 月 17 日 19:30-23:00,地点在上海 WAIC 场馆外。活动不设固定 Topic,围绕 AI、太空、具身智能、脑科学等前沿领域自由交流,团队将在 48 小时内完成审核并向通过筛选者发送专属邀请函。
AGI Playground 2026 议程正式公布,景鲲、刘靖康、AMI Labs、MiniMax 等嘉宾与机构确认参与。目前公开信息以嘉宾阵容为主,具体议题、场次安排及参会方式尚未在正文中披露。
Bun 项目于 2026 年 5 月借助 Claude Code,用 11 天完成从 Zig 到 Rust 的代码迁移,涉及超 100 万行代码变更、6778 次提交和约 50 个动态工作流。
推荐理由:Bun 借助 Claude Code 在 11 天内把 53 万行 Zig 重写为 Rust,文中给出多工作流协作方式与 16.5 万美元成本账,可供评估 AI 大规模重构的现实边界。
零一万物发布企业决策中枢平台"万策"及老板AI、销冠AI、投资官AI等产品,主打赋能企业一号位。李开复回应"没了李开复零一万物还有什么"时称,自己主要负责敲第一次门和维护关系,团队自主拿单比例持续上升,并透露已接触全球约两三千家目标客户中的五六百家。
复旦大学、阿卜杜拉国王科技大学、上海交通大学和华东师范大学团队提出 Afford-VLA,将可供性(affordance)内化进 VLA 系统内部,让模型自行生成任务相关的交互区域并直接送入动作生成模块。
OpenAI 正为 Applied AI 团队招聘投资银行领域专家(Subject Matter Expert, Investment Banking),坐标旧金山,年薪 18.5 万至 20.5 万美元另加股权,采用每周 3 天到岗的混合办公。
HeroUI(前身 NextUI)发布 v3,针对 React 和 React Native 从头重写,基于 Tailwind CSS v4 构建,包含超 75 个 Web 组件(21 个新增)和 37 个组件的全新 React Native 库。
InfoQ 极客传媒与 GMI Cloud 等联合出品的《中国 AI 产业核心要素出海发展白皮书》将于 7 月 10 日晚 19:30-21:00 直播预热,InfoQ 总编王一鹏对话 GMI Cloud 蒋剑彪、火山引擎周文、商汤马林。直播聚焦 Agentic Workflows 爆发下 Token 消耗百倍千倍增长带来的算力稀缺,以及 AI 应用出海高 ARPU 市场的生存路径。
蚂蚁灵波开源面向具身智能的视频生成基座模型 LingBot-Video,采用 MoE 架构,总参数 30B、单次生成激活约 3B,定位为机器人大脑的物理引擎。在北京大学联合字节跳动发布的 RBench 上,其总分 0.620,超过 Wan2.6、Seedance 1.5 Pro 和 Cosmos3 Super。团队称其为业界首款面向具身智能的大规模 MoE 视频基础模型,并开源供研究社区使用。
记忆张量 MemTensor 创始人熊飞宇在 QCon 2026 北京站分享了 MemOS 记忆系统的工程化实践,该系统通过分层架构统一管理明文记忆、激活记忆与参数记忆。MemOS 2.0 于 25 年 12 月发布,面向长程任务新增运行状态管理与记忆版本化能力,其开源框架在 GitHub 获 9.7k star,日调用量超 100 万次。
哈佛大学教授 Sham Kakade 在 ICML 2026 演讲中论证,一个简单二次模型即可精准预测 LLM 动态预训练中的大部分优化效果。他通过对真实大规模神经网络不同 checkpoint 做泰勒展开构建二次模型,发现关键窗口内损失轨迹与真实网络近乎完全重合,高阶项几乎无贡献。该框架可推导任意时间学习最优策略、临界批量大小与动态最优学习率,并揭示动量的作用边界。
ICML 2026 于 7 月 7 日在首尔 COEX 开幕,共接收 6352 篇论文,其中 Spotlight 论文 536 篇、Oral 论文 168 篇。
SpaceXAI 发布大模型 Grok 4.5,定位 Opus 级,面向 Coding、Agentic 任务和知识工作,支持 500k 上下文,基于 1.5 万亿参数 V9 底座。
蚂蚁灵波团队开源了 LingBot-Video,一个面向具身智能的视频生成模型,30B 总参数、3B 激活、MoE 架构。模型用互联网视频混合超过 7 万小时具身数据分五个阶段训练,在与 Cosmos 3、Wan 2.2、混元 1.5、LongCat-Video、LTX-2.3 五个开源模型的对比中,画质未全部领先,具身任务拿到第一。