跳到正文

InfoQ

微信公众号

当前显示全部 AI 相关新闻
切换来源
458 条AI 相关新闻 · 最新在前
6月26日周五
6月25日周四
  1. InfoQ · 微信公众号38

    优步通过实时信号与 Listwise 排序改进 Uber Eats 餐厅推荐

    优步在 Uber Eats 推荐系统中引入实时用户信号与 Listwise 排序,将首页排序从手工统计特征演进到基于 Transformer 的序列建模,特征新鲜度从 24 小时缩短到秒级。新架构以实时信号处理层替换批处理特征流水线,持续摄取点击、搜索和下单历史,并让模型在一次推理中联合评估多个餐厅候选者以优化相对顺序。该能力已部署于 Uber Eats 首页信息流和发现类入口。

  2. InfoQ · 微信公众号26

    AICon 深圳 2026 启动:Agent 时代哪些方向正成为行业关键变量

    AICon 人工智能开发与应用大会·深圳站正式启动,将于 8 月 21 日—22 日举办,专题已陆续上线并同步开启议题征集。大会围绕 AI Infra、推理工程与异构计算、Harness Engineering、Agent 安全、Coding Agent、多模态大模型与 Agent 落地、机器人 AGI、超级 App AI 原生化等方向设置专题。限时早鸟票享 8 折优惠,报名立减 1160。

  3. InfoQ · 微信公众号77

    OpenAI 与博通展示首款定制 AI 芯片 Jalapeño

    OpenAI 与博通联合打造的首款定制 AI 芯片 Jalapeño 正式展示,博通 CEO Hock Tan 称其性能可媲美英伟达 Blackwell 或谷歌 TPU,OpenAI 计划今年年底前部署,从初始设计到流片仅用九个月。

    推荐理由:呈现 OpenAI 与博通定制推理芯片的落地细节,以及训练与推理基础设施走向分化的路线差异。

6月24日周三
  1. InfoQ · 微信公众号65

    黄东旭、徐昊、滕昱谈 AI 写代码:什么都能写,方向仍靠人判断

    InfoQ 访谈 PingCAP 联合创始人黄东旭、徐昊、滕昱等人,讨论 AI 写代码与重写软件的边界。黄东旭的 db9 项目三个月产出超 100 万行 Rust 代码,0 行由人类手写或 review,峰值一天消耗约 10 亿 token,上线后服务超 10000 个数据库实例。多位受访者认为 AI 已能写任何东西,但技术选型、架构拆分和方向判断仍需资深工程师掌舵。

  2. InfoQ · 微信公众号43

    极客时间企业版直播:AI 大模型热潮第三年的 4 个组织转型判断

    极客时间企业版一场直播中,快手王东旭、造物者咨询袁野、极客邦赵钰莹、前蚂蚁金服右军四位嘉宾围绕 AI 组织转型给出判断。王东旭提出"AI 洗牌洗掉的是协调税",袁野强调"个人提效不等于组织提效",赵钰莹首次解读覆盖 2660 份样本的《2026 中国智能体工程化人才与组织发展报告》,右军则指出个人效率飙升反而导致组织进度滞后。

  3. InfoQ · 微信公众号36

    对话蚂蚁吴伟:训推一体池化调度如何把 GPU 用到极限

    蚂蚁集团容器调度团队负责人吴伟提出,把训练与推理两个资源池打通做训推一体池化调度,让任务在波峰波谷间流动,以提升 GPU 利用率。他指出提升利用率存在硬件和业务 SLO 两层天花板,软件优化接近硬件极限后仍需靠扩容,而国产卡的主要差距不在单卡算力,而在 CUDA 全链路生态。

6月23日周二
  1. InfoQ · 微信公众号45

    亚马逊云科技中国峰会:全员 Builder 时代,企业如何分层治理 Agent?

    亚马逊云科技中国峰会上提出三层 Agent 治理逻辑:先用 Amazon Quick 统一构建入口实现"企业看得见",再通过 AgentCore 的行为可追溯、Policy 硬拦截和身份识别做到"流程看得清",最后用 Kiro、Release Management、Amazon Continuum 和 Amazon Transform 为关键 Agent 提供可靠性保障。

6月22日周一
  1. InfoQ · 微信公众号26

    阿里云刘少伟出席 AICon 上海站,分享企业 Agent 自动化行动架构 WinNexO

    阿里云智能集团高级技术专家刘少伟已确认出席 6 月 26 日-27 日在上海举办的 AICon 全球人工智能开发与应用大会,在"AI 原生数据工程"专题分享《数据不止于洞察,构建企业 Agent 的自动化行动架构》。他提出以数据为中心的业务对象智能体平台 WinNexO,通过多模态数据集成、统一语义模型与 Agent Runtime,打通企业智能化从数据到行动的断层。

  2. InfoQ · 微信公众号74

    谷歌 Gemma 4 12B 发布,以无编码器架构实现端侧多模态

    谷歌发布 Gemma 4 12B,一款 120 亿参数的端侧多模态模型,采用统一的无编码器架构,将多模态数据直接输入 LLM,省去独立的视觉与音频编码器。其视觉嵌入器仅 3500 万参数,取代了其他中型 Gemma 4 模型使用的 27 层视觉 Transformer,音频则直接将 16 kHz 波形切分为 40 毫秒帧后线性投影进 LLM 输入空间。

6月21日周日
  1. InfoQ · 微信公众号38

    谷歌痛失双AI大牛、英伟达员工考公、Manus 135亿原价赎回|Q资讯

    谷歌接连流失两位 AI 核心人物,诺奖科学家与 Gemini 负责人相继出走。英伟达一名在职员工考取合肥公务员引发热议,其 2027 财年第一财季营收 816.15 亿美元、同比增长 85%。红杉中国、真格基金联合腾讯计划以 Meta 当初收购原价 20 亿美元全额回购 Manus 全部股权,Benchmark 放弃回购退出。

  2. InfoQ · 微信公众号62

    同属 Oracle,OpenJDK 与 GraalVM 对 AI 代码贡献态度相反

    OpenJDK 与 GraalVM 这两个由 Oracle 支持的项目,对生成式 AI 代码贡献发布了相反政策。OpenJDK 管理委员会批准一项临时政策,禁止包含大语言模型、扩散模型等生成内容的贡献,理由包括评审负担、安全性与知识产权归属不明。GraalVM 则允许贡献者使用 AI 编码助手准备贡献,但要求人类贡献者对整份贡献负责,并通过与以往相同的评审。

6月20日周六
6月19日周五
  1. InfoQ · 微信公众号37

    清程极智赤兔推理引擎与 AI Ping:如何破解大模型 Token 算力成本难题

    清华系 AI Infra 公司清程极智推出赤兔推理引擎、八卦炉和 AI Ping 三款产品,分别覆盖训练、推理部署与 Token 服务智能路由。赤兔通过软件层映射 FP4、FP8 低位宽计算,让不原生支持这些格式的国产芯片高效运行大模型,部署 DeepSeek-V3 满血版从 4 台 8 卡服务器压缩至 1 台。

  2. InfoQ · 微信公众号30

    前 OpenAI 高管 Zack Kass 清华演讲:AI 时代比失业更可怕的是身份重构

    前 OpenAI Go-to-Market 负责人 Zack Kass 在清华大学演讲提出,AI 的决定性变化是推理成本快速下降,智能将像电力、互联网一样成为低成本基础设施。他认为 AI 带来认知外包、数字成瘾等新风险,对工作的冲击不只是岗位替代,更是当"我是谁"不再由工作定义时的身份重构。AI 能否成为真正进步,取决于能否降低住房、医疗、教育等核心生活成本。

  3. InfoQ · 微信公众号44

    智谱创始人唐杰隔空回应马斯克:赶超 Claude Fable 5 不用等到 2027 年

    智谱创始人兼首席科学家唐杰在 X 上回应马斯克关于中美模型差距的判断,称赶超 Claude Fable 5 级别"不会那么久",暗示有望今年内实现。此前马斯克认为中国达到该水平可能在 2027 年 Q1。智谱随即推出 GLM-5.2,以 51 分登顶所有开源权重模型,领先 MiniMax-M3、DeepSeek V4 Pro 和 Kimi K2.6,并采用 MIT 协议全量开源。

6月18日周四
6月17日周三
  1. InfoQ · 微信公众号29

    AI 企业 Day 0 出海如何少走技术弯路?GMI Cloud 发布 Agentbox 等全栈产品线

    GMI Cloud 完成品牌升级,推出覆盖全球算力、模型调用与 Agent 商业化的三层产品线,核心新品 Agentbox 承接 Agent 从发布到商业化的后半程。其 Prime Inference 已接入 200 多个开源与闭源模型,支持统一账户和 API 调用,算力节点覆盖台湾、日本、东南亚、北美和欧洲。