美图影像研究院 11 篇顶会论文背后的 AI 影像能力落地
美图影像研究院(MT Lab)2026 年以来有 11 篇论文被 ICLR、CVPR、ICML、ECCV、ACM MM 等顶会接收,覆盖视频编辑、人像编辑、智能交互与视觉理解等方向。
微信公众号
美图影像研究院(MT Lab)2026 年以来有 11 篇论文被 ICLR、CVPR、ICML、ECCV、ACM MM 等顶会接收,覆盖视频编辑、人像编辑、智能交互与视觉理解等方向。
OpenAI 官方宣布适用于 Linux 的 ChatGPT 桌面应用进入预览阶段,用户可在受支持的 Linux 系统上直接使用 ChatGPT、ChatGPT Work 和 Codex,处理项目与浏览器工作流程。
香港中文大学与香港恒生大学团队提出 Libra,一个面向 Agentic RL 后训练的资源管理系统,将训练与 rollout 作为耦合系统统一优化。
机器之心与张江人工智能创新小镇、黄大年茶思屋科技网站联合发起2026「云程奖」,面向全球人工智能及交叉领域表现卓越的华人本硕博在校生,毕业时间须在2027年1月及以后。评选设年度新星及三个特别奖项,特别奖获奖总人数不超过5人,且不可与年度新星兼得,报名通道已开启。
字节 Seed 团队发现,文生图训练中真正随文本条件扩展的是 Caption 里与图像绑定的信息量,而不是 token 数量。
西湖机器人近日完成A轮融资,6个月内累计4轮融资、总规模5亿元,资金将重点投向人形机器人全身统一大模型研发。该公司走「通用大脑+人形全身小脑+自研人形本体」全栈自研路线,已推出人形整机西湖 o1,并拿下近亿元订单,覆盖科研教学、数据采集、电力巡检等场景。
原阿里千问技术负责人林俊旸官宣在上海创办 AI 公司 Pragmatik Labs(语用科技),研究方向为横跨数字世界和物理世界的下一代 Agent,分为 Digital Agents 与 Physical Agents 两部分。
来自伯克利、普林斯顿、清华等多家机构的研究者提出 MLS-Bench,用覆盖 12 个机器学习方向的 140 个真实研究任务单独测量模型的方法发现能力。对初版五个前沿模型的评测显示,它们更擅长优化和组合已有组件,整体表现均未超过 Human SOTA。消融实验发现,移除参数规模检查后所有模型都会靠扩大容量提高成绩,重新施加容量约束后这类收益随即消失。
BosonAI(李沐的创业公司)发布面向语音智能体的实时数字人模型 Higgs Avatar v1,只需一张静态照片即可生成会说话、倾听和回应的动态面孔,声音、口型、头部动作和表情均为逐帧实时渲染。官方称生成一帧仅需 16 毫秒,单张 H100 可支持 8 路实时对话并发。模型已进入内测阶段,将搭载于即将推出的语音聊天产品 Boson Presence,官网已开放 Waitlist。