跳到正文

微信公众号

按公众号阅读文章与观点

当前显示全部 AI 相关新闻
按账号或来源筛选(41)
4,179 条AI 相关新闻 · 最新在前
7月10日周五
  1. InfoQ · 微信公众号39

    虚拟座谈会:机器时代的安全——专家解读 AI 威胁的演变

    多位安全专家在虚拟座谈会上指出,提示词注入、越狱和间接提示注入是当前最常见且危害最大的 AI 攻击方式,攻击者无需攻破模型,只需将恶意指令植入模型摄入的不可信内容即可劫持代理行为。AI 增强的大规模社会工程学攻击同样破坏力巨大,生成式 AI 使攻击高度个性化且可规模化,深度伪造语音已能诱导高管批准付款或重置账户。专家强调,AI 安全工程师需从代码安全扩展到数据、模型和代理安全,并掌握对抗性思维。

  2. InfoQ · 微信公众号85

    OpenAI 推出 GPT-5.6 三档模型并上线 ChatGPT Work

    OpenAI 正式推出 GPT-5.6 系列,包含旗舰版 GPT-5.6 Sol、均衡版 GPT-5.6 Terra 和轻量版 GPT-5.6 Luna 三款模型,现已通过 ChatGPT、Codex 和 OpenAI API 上线,三档定价分别为每百万输入 Token 5、2.5、1 美元。

    推荐理由:原文给出三档模型的定价与 Token 效率数据,并说明 ChatGPT Work 从问答转向自主执行任务的定位变化。

  3. InfoQ · 微信公众号47

    AI 推理成本首次算清:GPU 利用率不到 52%,千万别自建

    一项推理成本模型测算显示,自建 GPU 部署大模型的临界利用率约为 52%,低于该值自建反而比 API 更贵,而多数 AI 创业公司利用率仅 30%-50%。以 4×H100 部署 70B 模型为例,利用率从 80% 降至 30% 时每千 Token 成本从 $0.011 涨至 $0.045,涨了 4 倍。蒙特卡洛模拟显示 95% 置信度下临界点落在 48%-56% 之间。

  4. 量子位 · 微信公众号47

    清华AIR刘洋团队AIM参与完成84页量子算法论文,从想法一路推到定理

    清华大学智能产业研究院(AIR)刘洋教授团队的数学智能体系统AIM,深度参与了AIR-求真书院联培学生王彦桥与刘锦鹏助理教授完成的前沿量子算法研究,提出符号嵌入量子算法(Sign Embedding Quantum Algorithms),形成一篇84页论文。该研究从"有理逼近能否成为量子算法设计原则"的模糊直觉出发,AIM参与定理组织、证明草稿生成和复杂度分析,人类研究者负责方向筛选与最终审计。

  5. 虎嗅APP · 微信公众号57

    全程围观 MiniMax M3 发布:一场定价风波与内部复盘

    MiniMax 于 6 月 1 日发布原生多模态、1M 上下文的 M3,同步把订阅制 Coding Plan 改为按 token 计费的 Token Plan,因缺少提前沟通导致部分用户额度消耗超预期而表达不满,公司当晚致歉,当天股价收跌 15.71%。作者获准进入 MiniMax 内部,全程围观了模型发布前后的争吵、和解与实名提问的全员复盘,以及团队对定价设计与用户 context 缺失的反思。

  6. 虎嗅APP · 微信公众号37

    早报 | Meta 发布 Muse Spark 1.1 加入 AI 价格战;GPT-5.6 Sol 编程 Token 效率提升 54%;伊朗称摧毁约旦美军基地

    Meta 发布最先进 AI 模型 Muse Spark 1.1,首次向开发者推出付费 API,定价约为 OpenAI 和 Anthropic 同类顶级模型的四分之一,扎克伯格称其 Agent 与编程能力显著提升。OpenAI CEO 奥尔特曼称 GPT-5.6 Sol 在代理式编程任务中 Token 使用效率提升 54%。此外,前美联储主席伯南克加入 Anthropic 长期利益信托机构。

  7. 数字生命卡兹克 · 微信公众号80

    GPT-5.6 上线并合并 ChatGPT 与 Codex,推出 Sol、Terra、Luna 三个模型

    OpenAI 在直播中正式上线 GPT-5.6,一次推出 Sol、Terra、Luna 三个模型,并把 Codex 应用与 ChatGPT 合并成同一产品。作者实测 GPT-5.6 Sol 在编码和 Agent 执行上幻觉率低,在 Agents' Last Exam 中以 53.6 分比 Claude Fable 5 高 13.1 分。

    推荐理由:作者以数天高强度实测记录了 GPT-5.6 Sol 在编码、Agent 和安全防护任务上的表现,可与 Claude Fable 5 对照参考。

  8. 赛博禅心 · 微信公众号80

    OpenAI 发布 GPT-5.6 三款模型与 ChatGPT Work

    OpenAI 发布 GPT-5.6,包含 Sol、Terra、Luna 三款模型,并推出对标 Claude Work 的 ChatGPT Work。旗舰款 Sol 在 Agents' Last Exam 测试的 55 个行业长程工作流上得分 53.6,比 Claude Fable 5 高 13.1 分。

    推荐理由:原文梳理了 GPT-5.6 三款模型的分档与命名规则,读者可以据此了解这次发布的产品结构与能力分层。

7月9日周四
  1. AI科技评论 · 微信公众号42

    北京人形联合人大开源慧思开物 Robo-ValueRL,让具身智能学会甄别数据优劣

    北京人形机器人创新中心联合中国人民大学高瓴人工智能学院,在慧思开物平台开源了 Robo-ValueRL。该框架在 VLA 中引入价值估计器,可筛选高价值轨迹数据,并采用冻结预训练主干加轻量残差适配器的方式缓解在线迭代中的灾难性遗忘。仅训练 6 天的真机验证显示,其双任务表现优于 Dagger 等算法,毫米级芯片插入一次完成,作业效率达人类操作员的 1.5 倍。

  2. AI科技评论 · 微信公众号31

    ICML 2026 现场:8 篇 Spotlight 论文,从 LoRA 收敛到 VLM「说而不看」

    ICML 2026 共接收 6352 篇论文,其中 Spotlight 536 篇、Oral 168 篇,现场精选 8 篇代表作覆盖优化理论、智能体评测、强化学习与多模态理解等方向。其中 LoRA 梯度下降首次在无假设条件下被证明以 O(1/log T) 速率非渐近收敛;VLM 研究则发现模型检测视觉变化时准确率下降高达 60%,存在「说而不看」问题。

  3. 虎嗅APP · 微信公众号36

    中兴把未来押给豆包?努比亚将推AI智能体手机

    中兴通讯高级副总裁倪飞确认,旗下努比亚将推出一款量产旗舰级AI智能体手机,并将在2026世界人工智能大会(WAIC)上首次公开展示。努比亚在国内将全面承接豆包手机业务,与红魔一起主攻线上渠道,中兴母品牌则回归运营商定制机。此前搭载豆包手机助手技术预览版的努比亚M153已小规模亮相,核心卖点是跨应用自动化能力,但面临互联网平台不愿开放数据和入口的生态障碍。

  4. 虎嗅APP · 微信公众号38

    乱用AI,打工人被坑惨了:从虚构竞品到伪造法条

    多位职场人因过度信任AI生成内容而翻车:公关经理被AI编造的三家不存在的竞品品牌和虚假行业数据坑掉千万级竞标项目,律师险些栽在AI虚构的地方性法条上,程序员因AI擅自改动线上代码导致项目延期两周、自费七千多元Token。这些案例表明,AI越能给出完整答案,使用者越需要保留判断、核验和兜底的能力。

  5. 虎嗅APP · 微信公众号37

    国产半导体多头归来:算力、封测、EDA 板块反弹能持续吗

    7月9日科技板块反弹,科创50指数收涨8.41%,兆易创新、长电科技、浪潮信息等涨停,沐曦股份涨16.88%、摩尔线程涨13.96%。浪潮信息预计2026年上半年归母净利润26亿至31亿元,同比增长226%至288%,二季度单季创历史新高。华为何庭波7月3日发布韬定律V2,给出量产工艺参数,带动先进封测、EDA、半导体设备需求重估。

  6. 赛博禅心 · 微信公众号58

    蚂蚁灵波开源 LingBot-Video:面向具身智能的视频生成模型

    蚂蚁集团灵波团队(Robbyant)开源了面向机器人的视频生成模型 LingBot-Video,并放出技术报告。该模型 30B 总参数、3B 激活,采用 MoE 架构,可模拟流体、刚体、材质和镜头运动,训练数据包含超过 7 万小时具身数据。团队还用强化学习从感知、物理、执行三方面优化输出,称其在具身相关基准上超过 Cosmos 3 等五个开源模型。

  7. AI前线 · 微信公众号29

    AI时代最被低估的创业资本,不是技术,是你的"老本行"

    智能家居端侧芯片工程师展菲借助AI Agent和阿里云,同时切入AI眼镜、具身机器人解决方案和活动管理小程序"展菲汇"三个领域。他用两条指令完成项目从开发环境到云服务部署的全过程,Agent还接管了报名审核和内容审核流程。展菲汇从去年8月规划、9月启动,Web端和小程序端基于阿里云ECS运行,图片存入OSS并通过ESA边缘加速访问。

  8. AI科技评论 · 微信公众号43

    上海 AI Lab 李林阳创业公司 Novasilicon 获五源资本数千万元首轮融资,要用 AI 重做芯片设计

    上海人工智能实验室青年科学家李林阳创办的芯片设计公司 Novasilicon(芯星元)完成首轮融资,由五源资本独家投资数千万元。该公司不做 EDA,而是让多 AI Agent 承担设计、规划、调用 EDA 及迭代优化,先从模拟后端版图设计和数字后端布局布线切入,计划年内推出标准化后端设计产品。

  9. Draco正在VibeCoding · 微信公众号41

    在北京的最后一天,聊聊 AI Agent 时代教育该有的样子

    一位在北京生活 20 年的家长在离开北京前,分享了为小学生选择海南创新学校的思考:AI Agent 时代教育应放弃"知识型"灌输,转而呵护好奇心、探索欲和解决问题的信心。他为孩子搭建了基于飞书的 Hermes Agent,用于 AI 绘画与 AI 编程探索,并配置了专属域名上线项目。他认为审美品位是 AI+Robot 覆盖一二产业后最关键的能力,品味即注意力即价值。

  10. 虎嗅APP · 微信公众号20

    百万级牌桌上,江淮凭什么?尊界S800的细节功力解析

    尊界S800上市13个月累计交付19000辆,连续9个月稳居百万级豪车销量冠军,成为国产百万级豪车首次用销量证明实力的车型。其搭载华为途灵龙行平台,实现6合1智能协同控制,最小决策链路时延低至1毫秒;尊界超级工厂配备超2200台智能机器人,首发CV质检大模型“迈思特”,缺陷检出率达99.99%。

  11. 量子位 · 微信公众号23

    量子位 WAIC 首夜活动报名:Agent 从聊天框到正式上岗了吗?

    量子位将于 7 月 17 日 19:30 在上海浦东举办 WAIC 首夜线下活动,主题聚焦 AI 从"会回答"到"能完成"的现实考题。活动设两场分享:Evomap 创始人兼 CEO 张昊然与记忆张量 CTO 李志宇谈 Agent 从聊天框到正式上岗,VAST CTO 梁鼎与脸谱心智创始人陆弘远谈模型从 GitHub 到与世界交互。

  12. 量子位 · 微信公众号49

    原力灵机发布具身基础模型DM0.5:4B参数、Zero-Shot提升31%

    原力灵机在开发者大会上发布新一代具身基础模型DM0.5,参数规模4B,较上一代DM0翻倍,数据量增加400%。该模型Zero-Shot导航成功率提升31%,Few-shot成功率提升45%,微调后任务成功率提升20%,推理效率提升25%,在H100上延迟低至50ms、4090上为90ms。同步推出DexDev开发者平台(含DFOL2.0、MaaS、DexOS)与多智能体混合作业系统Ferrata。

  13. InfoQ · 微信公众号83

    Claude Code 用 11 天把 Bun 的 53 万行 Zig 代码重写为 Rust

    Bun 项目于 2026 年 5 月借助 Claude Code,用 11 天完成从 Zig 到 Rust 的代码迁移,涉及超 100 万行代码变更、6778 次提交和约 50 个动态工作流。

    推荐理由:Bun 借助 Claude Code 在 11 天内把 53 万行 Zig 重写为 Rust,文中给出多工作流协作方式与 16.5 万美元成本账,可供评估 AI 大规模重构的现实边界。

  14. 量子位 · 微信公众号37

    零一万物发布万策与老板AI等产品,李开复回应"没了李开复还有什么"

    零一万物发布企业决策中枢平台"万策"及老板AI、销冠AI、投资官AI等产品,主打赋能企业一号位。李开复回应"没了李开复零一万物还有什么"时称,自己主要负责敲第一次门和维护关系,团队自主拿单比例持续上升,并透露已接触全球约两三千家目标客户中的五六百家。

  15. InfoQ · 微信公众号23

    2026 AI 出海:算力账本、场景卡位与未来生路直播预告

    InfoQ 极客传媒与 GMI Cloud 等联合出品的《中国 AI 产业核心要素出海发展白皮书》将于 7 月 10 日晚 19:30-21:00 直播预热,InfoQ 总编王一鹏对话 GMI Cloud 蒋剑彪、火山引擎周文、商汤马林。直播聚焦 Agentic Workflows 爆发下 Token 消耗百倍千倍增长带来的算力稀缺,以及 AI 应用出海高 ARPU 市场的生存路径。

  16. InfoQ · 微信公众号62

    蚂蚁灵波开源具身视频基模 LingBot-Video,如何为机器人大脑构建物理引擎

    蚂蚁灵波开源面向具身智能的视频生成基座模型 LingBot-Video,采用 MoE 架构,总参数 30B、单次生成激活约 3B,定位为机器人大脑的物理引擎。在北京大学联合字节跳动发布的 RBench 上,其总分 0.620,超过 Wan2.6、Seedance 1.5 Pro 和 Cosmos3 Super。团队称其为业界首款面向具身智能的大规模 MoE 视频基础模型,并开源供研究社区使用。

  17. InfoQ · 微信公众号48

    从上下文到经验资产:MemOS 的 Agent 记忆系统工程化路径

    记忆张量 MemTensor 创始人熊飞宇在 QCon 2026 北京站分享了 MemOS 记忆系统的工程化实践,该系统通过分层架构统一管理明文记忆、激活记忆与参数记忆。MemOS 2.0 于 25 年 12 月发布,面向长程任务新增运行状态管理与记忆版本化能力,其开源框架在 GitHub 获 9.7k star,日调用量超 100 万次。

  18. AI科技评论 · 微信公众号49

    哈佛大学 Sham Kakade ICML 2026 演讲:二次模型为何能预测 LLM 预训练动态

    哈佛大学教授 Sham Kakade 在 ICML 2026 演讲中论证,一个简单二次模型即可精准预测 LLM 动态预训练中的大部分优化效果。他通过对真实大规模神经网络不同 checkpoint 做泰勒展开构建二次模型,发现关键窗口内损失轨迹与真实网络近乎完全重合,高阶项几乎无贡献。该框架可推导任意时间学习最优策略、临界批量大小与动态最优学习率,并揭示动量的作用边界。

  19. 赛博禅心 · 微信公众号61

    蚂蚁灵波开源 LingBot-Video,面向具身智能的视频生成模型

    蚂蚁灵波团队开源了 LingBot-Video,一个面向具身智能的视频生成模型,30B 总参数、3B 激活、MoE 架构。模型用互联网视频混合超过 7 万小时具身数据分五个阶段训练,在与 Cosmos 3、Wan 2.2、混元 1.5、LongCat-Video、LTX-2.3 五个开源模型的对比中,画质未全部领先,具身任务拿到第一。