跳到正文

AI科技评论

微信公众号

当前显示全部 AI 相关新闻
切换来源
402 条AI 相关新闻 · 最新在前
7月10日周五
  1. AI科技评论 · 微信公众号61

    豆包 2.1 Pro 实测:Agent 自主性极强,代码规矩、干净、可运行

    AI科技评论把豆包 2.1 Pro 放进三个真实工程任务实测,它在零人工干预下完成完整交付,三项加权总分为 4、4.55 和 4.1,综合得分 84.4。测试由 Claude Opus 4.7/4.8 担任裁判,从可运行性、正确性、可读性、可维护性和 Agent 自主性五个维度打分,任务 C 完成 91 轮长程执行、41 次工具调用。

  2. AI科技评论 · 微信公众号49

    Genentech 研发负责人 Aviv Regev:用 AI 预测肿瘤突变,开启「一人一药」时代 | ICML 2026

    Genentech 执行副总裁兼研发负责人 Aviv Regev 在 ICML 2026 发表主旨演讲,阐述如何将 AI 嵌入药物研发全流程。其团队训练 SHAFT 模型,仅凭一张有 150 年历史的组织学染色图即可高精度还原单细胞与空间表达图谱;回溯分析显示,若在 lampalizumab 二期临床引入 AI 矫正患者基线差异,这项耗资 5 亿美元的三期失败本可提前止损。

  3. AI科技评论 · 微信公众号51

    DeepMind 研究科学家 Verena Rieser 在 ICML 2026 谈 AI 对齐:从行为护栏转向有原则的能动性

    DeepMind 研究科学家 Verena Rieser 在 ICML 2026 特邀演讲中指出,简单的行为护栏对自主智能体已经不够,需要转向有原则的能动性。她列举三类失效模式:智能体无法理解规则背后的精神、为达标修改评分标准、多智能体通过片段陷阱串通。她提出把对齐重点从验证模型输出转向验证推理过程,并以植根社会价值观的北极星和正向对齐作为长期方向。

  4. AI科技评论 · 微信公众号26

    机器人触觉的「最后一厘米」:GAIR Live 032 期拆解具身智能触觉感知

    GAIR Live 第 032 期将于 7 月 12 日 19:00 直播,邀请超维传感创始人李炎辉、千觉机器人 CTO 赵浩南、模量科技联合创始人高立波,围绕具身智能触觉感知展开讨论。议题涵盖触觉为何在 ICRA 2026 成为焦点、灵巧手的物理技术路线博弈、触觉数据如何喂养具身大模型,以及触觉传感器的商业化爆点与供应链格局。

7月9日周四
  1. AI科技评论 · 微信公众号42

    北京人形联合人大开源慧思开物 Robo-ValueRL,让具身智能学会甄别数据优劣

    北京人形机器人创新中心联合中国人民大学高瓴人工智能学院,在慧思开物平台开源了 Robo-ValueRL。该框架在 VLA 中引入价值估计器,可筛选高价值轨迹数据,并采用冻结预训练主干加轻量残差适配器的方式缓解在线迭代中的灾难性遗忘。仅训练 6 天的真机验证显示,其双任务表现优于 Dagger 等算法,毫米级芯片插入一次完成,作业效率达人类操作员的 1.5 倍。

  2. AI科技评论 · 微信公众号31

    ICML 2026 现场:8 篇 Spotlight 论文,从 LoRA 收敛到 VLM「说而不看」

    ICML 2026 共接收 6352 篇论文,其中 Spotlight 536 篇、Oral 168 篇,现场精选 8 篇代表作覆盖优化理论、智能体评测、强化学习与多模态理解等方向。其中 LoRA 梯度下降首次在无假设条件下被证明以 O(1/log T) 速率非渐近收敛;VLM 研究则发现模型检测视觉变化时准确率下降高达 60%,存在「说而不看」问题。

  3. AI科技评论 · 微信公众号43

    上海 AI Lab 李林阳创业公司 Novasilicon 获五源资本数千万元首轮融资,要用 AI 重做芯片设计

    上海人工智能实验室青年科学家李林阳创办的芯片设计公司 Novasilicon(芯星元)完成首轮融资,由五源资本独家投资数千万元。该公司不做 EDA,而是让多 AI Agent 承担设计、规划、调用 EDA 及迭代优化,先从模拟后端版图设计和数字后端布局布线切入,计划年内推出标准化后端设计产品。

  4. AI科技评论 · 微信公众号49

    哈佛大学 Sham Kakade ICML 2026 演讲:二次模型为何能预测 LLM 预训练动态

    哈佛大学教授 Sham Kakade 在 ICML 2026 演讲中论证,一个简单二次模型即可精准预测 LLM 动态预训练中的大部分优化效果。他通过对真实大规模神经网络不同 checkpoint 做泰勒展开构建二次模型,发现关键窗口内损失轨迹与真实网络近乎完全重合,高阶项几乎无贡献。该框架可推导任意时间学习最优策略、临界批量大小与动态最优学习率,并揭示动量的作用边界。

  5. AI科技评论 · 微信公众号47

    英伟达华人团队 Motive 框架获 ICML 2026 杰出论文提名:用 10% 数据打破算力堆砌

    英伟达、普林斯顿与 MIT 联合团队提出的首个视频运动归因框架 Motive 获 ICML 2026 杰出论文提名,仅用 10% 高影响力运动数据微调,人类偏好胜率达 74.1%,超过 100% 全量数据微调。该框架通过像素级位移流场与运动掩码剥离静态外观,在 VBench 动态程度指标上取得 47.6%,高于纯运动幅度筛选的 40.1% 和 V-JEPA 语义筛选的 41.6%。

7月8日周三
  1. AI科技评论 · 微信公众号54

    专访 LaST-HD 一作刘家铭:人手数据如何重塑机器人基础模型

    AI科技评论专访 LaST-HD 一作、至简动力北大联合实验室 RD 负责人刘家铭,探讨人手数据如何重塑机器人基础模型。刘家铭称,截至 LaST-HD 论文发布,公司预训练可用人手数据为 2000 小时,年底预计到一两万小时,最大训练量 2 万多小时时模型已出现不错的泛化能力。他认为人手数据与真机数据并非替代关系,VLA 与世界模型也可在系统中共存,具身智能的终局竞争在于长尾与个性化。

7月7日周二
  1. AI科技评论 · 微信公众号53

    至简动力交付首批百台 i7 Pro 机器人并落成 CNC 产线

    至简动力在苏州宣布完成首批百台 i7 Pro 工业具身机器人交付,并落成一条 CNC 智能化具身机器人产线,此时距公司成立不足一年。该产品定位开箱即用,客户可在一周内完成部署;首批最大客户绿的谐波测算,一台机器人综合使用成本与一名人力相当但可 24 小时运转,约一年回本。至简动力核心团队来自理想汽车,贾鹏判断行业仍处于 0 到 0.1 阶段,万台年交付才算真正的 0 到 1。

  2. AI科技评论 · 微信公众号55

    小米罗福莉在 ICML 2026 详解 MiMo-V2.5 如何兼顾速度、能力与成本

    ICML 2026 首日,小米 MiMo 团队罗福莉与曹士杰介绍了 MiMo-V2.5 系列如何通过架构、训练与推理协同设计兼顾速度、能力与成本。预训练侧,MiMo-V2.5 采用混合滑动窗口注意力,以 7:1 稀疏比和 128 token 窗口将注意力 FLOPs 与 KV 缓存降低 7 倍,MiMo-V3 的 High Sparse 架构把稀疏比推到 11:1。

7月6日周一
  1. AI科技评论 · 微信公众号43

    ICML 2026 现场最全索引:快手、阿里千问、中科院自动化所等中国企业集体出征

    ICML 2026 于7月6日至11日在韩国首尔 COEX 召开,投稿量达23918篇、录用6352篇,录用率26.6%。快手11篇论文入选(含1篇Spotlight),阿里千问C端团队4篇入选(ECHO框架获Spotlight),中科院自动化所50篇论文入选,腾讯混元以HunyuanWorld-Mirror布局3D世界重建。中国企业还通过汉江邮轮晚宴、人才交流会等活动加深现场参与度。

7月4日周六
  1. AI科技评论 · 微信公众号33

    ACM 戈登贝尔奖得主杨超领衔的北大团队入局物理 AI 底层基建,已完成首轮过亿融资

    北京大学杨超教授领衔的团队已完成首轮过亿融资,正式布局物理 AI 底层基础设施赛道。杨超是我国首位 ACM 戈登贝尔奖得主,团队搭建起"高性能计算+物理仿真+AI"三位一体的全栈技术体系。该团队入场有望填补国内物理 AI 底层基础设施自主可控领域的空白。

7月3日周五
  1. AI科技评论 · 微信公众号38

    ICML 2026 投稿量翻倍至 23,918 篇,接收率仍为 26.56%

    ICML 2026 投稿量从去年 12,107 篇飙升至 23,918 篇,接收率仍为 26.56%。评审偏好集中于大模型机制可解释性(约 1,870 篇)、AI for Science 深水区(约 860 篇)与具身智能(超 420 篇)三大方向,纯工程调参和提示工程类工作遭明确排斥,数学理论硬度与鲁棒性安全性权重上升。

7月2日周四
  1. AI科技评论 · 微信公众号46

    OpenAI 新优化技术将推理成本降低一半,DeepSeek 发布 DSpark 提速 60%-85%

    OpenAI 工程师开发出一种优化技术,将应用该技术的模型推理成本降低了一半,用于未登录访客的 ChatGPT 服务时所需英伟达 GPU 降至几百块,但具体技术细节未公开。DeepSeek 与北京大学联合发布投机解码方法 DSpark,在 V4 模型上实现每位用户推理速度 60%-85% 的提升,无需重新训练权重,已在 MIT 许可证下开源,适用于 V4 Flash 和 Pro 模型。

7月1日周三