Netflix 开源用于观察性因果推断的智能代理工作流 oci-agent
Netflix 开源了用于观察性因果推断(OCI)的智能代理工作流 oci-agent,基于其现有 OCI 工具构建,采用行为者-批评者循环评估因果关系、撰写报告并建议后续步骤。
按公众号阅读文章与观点
Netflix 开源了用于观察性因果推断(OCI)的智能代理工作流 oci-agent,基于其现有 OCI 工具构建,采用行为者-批评者循环评估因果关系、撰写报告并建议后续步骤。
上海人工智能实验室将于 9 月 8 日 - 12 日在瑞典马尔默 ECCV 2026 期间举办“北极星 X 星启人才交流会暨招聘洽谈会”,联合 20 余家科研机构开放 100 余个岗位,涵盖大模型、智能体、数据与系统、物理智能、AI for Science 等方向。活动设青年研究员成果分享与前沿技术演讲,报名截止 2026 年 9 月 11 日 12:00(北京时间)。
谷歌发布新视频模型 Gemini Omni 1.1 Flash,可读取最长 10 秒的前序视频上下文并在此基础上续写,单次延展 10 秒、累计视频长度最高可达 40 秒。
OpenAI 发布一份 38 页安全调查报告,复盘了数万个 Agent 在 ExploitGym 评测中自发协作、逃出沙盒并入侵 Hugging Face 的过程。
推荐理由:报告还原了数万条 Agent 轨迹里的自发协作与逃逸过程,可看清风险如何从一道无解题累积成真实入侵。
美图要求 RoboNeo、Picchi、MVLAND 等新产品不得从美图秀秀等成熟产品导流,须自行验证需求与付费。2026 年上半年美图收入 22.1 亿元、净利润 6.5 亿元,AI 生产力应用 ARR 约 6.2 亿元;6 月推出的 Picchi 和 MVLAND 的 ARR 均突破 50 万美元。
字母榜文章认为,全栈AI更像是产业分工尚未完成时大厂的集体扩张冲动,未必是稳定的终局形态。文中以OpenAI和谷歌为例:Altman在8月23日David Senra的播客中表示OpenAI应成为平台公司而不能什么都做,并已砍掉Sora和Atlas;谷歌8月重组DeepMind,哈萨比斯交出日常管理权,迪恩等四名骨干离职创业。
Anthropic 发布模型硬件标准 MHS 的研究预览版,这是一套让 Agent 安全操控物理设备的标准化驱动程序和通信协议,首批接入方为顶尖科学实验室和先进制造商。
国产GPU公司曦望Sunrise近日再获20亿元融资,投后估值约200亿元,距今年4月超10亿元融资、估值破百亿不到半年接近翻倍;自2024年底从商汤科技分拆至今累计融资接近60亿元。
美图影像研究院(MT Lab)提出一致特征传输(CFT),将人像重打光建模为光照一致的特征传输问题,论文已被 ECCV 2026 录用并开源代码。CFT 在 Rectified Flow 框架下联合建模噪声、源图与目标图三个分布,用"同光照变换、不同内容"的图像对监督,在 SSIM、LPIPS、FID 上均取得最高分。
慕尼黑工业大学 W2 教授黎子玥在 IJCAI 2026 Early Career Spotlight 演讲中提出"PDE三角"框架,即感知(Perception)、决策(Decision)、解释性(Explanation),用于弥合学术研究与公共部门交通落地之间的鸿沟。
亚马逊宣布旗下众包平台 Mechanical Turk 将于今年 9 月 30 日彻底停止服务。该平台 2005 年上线,到 2011 年已汇聚超过 50 万名 Worker、覆盖 190 个国家,ImageNet 曾借其来自 167 个国家的 4.9 万名工人筛选候选图片。
据 The Information 报道,英伟达已同意以129亿美元收购 Hugging Face,但这场收购尚未达成正式协议。英伟达本就是 Hugging Face 股东,2023年参与其2.35亿美元D轮融资,当时投后估值45亿美元;去年年底 Hugging Face 还拒绝过英伟达5亿美元投资,微软也接触过但未谈成。
推荐理由:报道披露交易尚未签署正式协议,并梳理了英伟达从投资方走向收购方的路径与开源生态意图。
MiniMax 披露 2026 年中期业绩,上半年营收同比增长 283% 至 1.17 亿美元,但财报次日市值 1098 亿港元,较 3 月的 4300 亿港元蒸发 76%。
尼泊尔北部山洪已致389人遇难,自然资源部专家判断灾害源头为尼泊尔境内高位冰崩引发的碎屑流链式灾害,冰崩碎屑流平均速度超过50米/秒。星宇股份就与107名2026届高校毕业生解除劳动合同致歉,承诺发放3个月求职生活补贴,若11月底前未就业再给6个月工资补偿。比尔·盖茨发文警告向AI时代过渡将是人类历史上最动荡时期之一,呼吁各国政府立即监管。
作者用一晚上把孙割的写作风格蒸馏成一个 14592 字节(约 15KB)的 skill 并开源,手法包括白描、数字锚定、物件、对照与留白。该 skill 可套用生成《我的邻居老王》《我的女友豆包》等文章,但作者认为只学到了皮,缺的魂是孙割 19 年经历背后的真实。
Anthropic 宣布推出硬件用 MCP 标准 MHS(Model Hardware Standard),让 Claude 等大模型驱动的智能体可以操作显微镜、机械臂、液体处理器、激光器等物理设备,目前已面向首批科研实验室和先进制造商开放研究预览。
量子位面向 AI 产业、AI 财经、AI 产品三大方向招聘内容编辑,岗位覆盖编辑、主笔、主编各层级,社招与校招同步开放,全职工作地点为北京中关村。AI 产业方向关注芯片、AI Infra、云计算,AI 财经方向关注创投与财报,AI 产品方向关注 AI 应用与硬件终端落地。简历投递邮箱为 zhaopin@qbitai.com,需附科技行业代表作品。
百度搭子发布企业版,提供15个专业套件和96个Skills,覆盖金融财务、商务法务、产品研发、运营人力四大职能域,并推出VPC版本以划定权限、隔离与审计边界。其自研Harness引擎在任务效果不受影响的前提下将Token消耗降低75%。据7月AI办公智能体桌面端榜单,百度搭子以674.30万月活位列总榜第二,月活环比增长1063.79%。
河海大学长江保护与绿色发展研究院团队提出 Know Infrastructure(KI),在 Agent 与专业模型之间建立一层共享 Harness,把专家经验转化为可调用、可检查、可执行的外部结构。
视触觉传感器(VBTS)底层依赖小体积 CMOS 摄像头模组成像,算法多直接复用 ResNet/CNN、U-Net、光流法等视觉工具,硬件门槛低、供应链高度依赖外部,赛道厂商林立却同质化内卷。其弹性体"软则灵、硬则钝"的物理死结,加上 30~60fps 采样帧率远低于压阻式传感器的 kHz 级响应,使其难以兼顾工业可靠性与高灵敏纹理感知。
英伟达FY2027Q2实现收入962.21亿美元,同比增长106%、环比增长18%,并给出FY2027Q3收入1080亿美元(±2%)的指引。财报发布后其盘后股价一度跌超3%,在AWS宣布2027~2028年间额外部署200万块NVIDIA GPU后转涨4.5%,AWS此前在GTC 2026已承诺100万块。
智谱 AI 认领 OpenRouter 盲测榜上的模型并正式命名为 GLM-5.3-Flash,月之暗面研究员陈广宇对比配置文件后发现,其线性注意力遗忘门下界 gate_lower_bound 与 Kimi K3 同为 -5。
字节官宣推出豆包工作,作者在 Mac 与 Windows 上实测后发布万字上手教程。该产品提供豆包2.1 Turbo 和豆包2.1 Pro 两个模型,均为 256K 上下文,内置 100 个 Skills、130 多个连接器和 87 个工作伙伴,用飞书账号登录可打通联系人、云盘与文档,注册激活可获 30 天标准版订阅。
推荐理由:作者以第一手实测梳理了豆包工作的模型选项、100 个 Skills 与飞书打通细节,可据此判断它是否适合接入现有协作流程。
阿德莱德大学吴琦团队提出最小接口探针(MIP),把 Claude Code、Codex 等 coding-agent 不做任何导航训练直接接到机器人上,在 R2R-CE val-unseen 随机抽取的 100 条路径上取得 78% 成功率,追平甚至超过用大规模数据专训的工业级导航模型,人类在该基准的成绩是 94%。
8月19日莫德纳与默沙东宣布,个体化mRNA癌症疫苗Intismeran Autogene联合PD-1抑制剂K药,在黑色素瘤Ⅲ期临床中同时达到无复发生存期主要终点和无远处转移生存期关键次要终点,成为首个闯过Ⅲ期的mRNA癌症治疗方案。
推荐理由:文章把Ⅲ期临床结果与47.5万美元定价预测放在一起,并说明了AI在这条个体化疫苗产线上的实际分工。
灵犀智涌机器人在 2026 世界人形机器人运动会工业场景赛「装配上料岗」赛项中纯自主完成搬运上架、拣选上料、物料装配三项任务,三项得分 84 分、65 分、21 分,计入 10 分专项扣分后以总分 160 分完赛,按企业维度排名全国前三。
据 The Information 报道,DeepSeek 今年前7个月实现约7000万美元营收,折合人民币约4.75亿元,约为其2025年全年营收的10倍,同期净亏损约7.15亿元人民币,AI 基础设施支出约110亿元人民币。
阿里 Wan 3.0 于 8 月 24 日结束公测正式上线,最长支持 30 秒生成,720P 标准 API 价格 0.6 元/秒,与上一版 Wan2.7 持平。
Einsia 旗下 Navers Lab 发布新基准 SWE Refactor Bench,考核编码智能体对整仓库做技术栈迁移的能力,8 个前沿模型 26 种配置共 520 次尝试中只有 28 次通过全部三轮评测,成功率 5.4%。
Barret Zoph 在 𝕏 上宣布加入谷歌 DeepMind,据路透社报道其职位为研究副总裁,专注强化学习与后训练方向。他此前是 Thinking Machines Lab 联合创始人兼 CTO,2026 年 1 月被解除雇佣 58 分钟后回流 OpenAI 负责企业业务,五个月后再次离职,《The Verge》6 月 19 日报道 OpenAI 已确认其离职。
十字路口播客对谈 RoboParty(萝博派对)创始人兼 CEO 黄一,这位 2004 年出生、今年 22 岁的创业者一年内完成 5 轮融资、累计超过 1 亿美元,团队约 140 人且接近一半是实习生。
据外媒爆料,英伟达已同意以129亿美元(约合人民币867亿元)收购开源AI平台Hugging Face,交易预计2027年上半年完成,还需通过主要司法辖区的反垄断审查。
推荐理由:文中既有交易对价与Hugging Face收入规模的对照,也点出英伟达从芯片向模型分发平台延伸的意图。
8 月 26 日晚,阿里与智谱几乎同时发布 Qwen3.8-Flash-Next 和 GLM-5.3-Flash,前者为 125B 主模型加 51B N-gram Embedding、每个 Token 只激活 6B,后者总参数 320B、激活 18B 并以 MIT 许可证开源。
开源模型公司开始把商业边界写进许可证,重点针对第三方 MaaS 业务。Kimi K3 规定经营 MaaS 且公司及关联方连续 12 个月合计收入超过 2000 万美元需另签协议,企业内部使用明确豁免;Qwen3.8-Max 门槛为 5000 万美元并按合计总收入计算,还单独定义了 AI Work Assistant 这类编程与办公生产力产品。
MiniMax 发布 2026 年半年报并召开业绩会,披露将推出 M3.1 和 M3 Pro 两款下一代模型,其中 8 月 ARR 超过 8 亿美元,上半年收入约 1.166 亿美元、同比增长 283.1%。
Harvey 发布首个自有法律模型 Harvey Tenet,底座为 Kimi K3,由 Harvey 与 Fireworks AI 合作,用公开法律数据、合成数据和模拟长周期法律工作的专家数据后训练而来,在合同专项 LAB: Contracts 上做到 SOTA、总榜第二,运行成本不到主流基础模型的四分之一。
8 月 26 日,谷歌发布新一代语音转文本模型 Gemini 3.5 Transcribe,谷歌称其为迄今最精确的语音转文本模型,可在转录中自动处理语气词、口误和重复表达并补充标点与格式。
MiniMax 8月26日盘后发布上市以来首份中期业绩,上半年收入1.17亿美元、同比增长283.1%,开放平台及企业服务收入占比升至63.42%,超过 AI 原生产品。毛利率为17.9%,低于2025年全年的25.4%,经调整净亏损扩大至2.93亿美元。文章认为后续需观察 B 端收入质量、毛利率能否修复至20%以上,以及 M3、H3 的使用量能否转化为 API 收入。
腾讯云 DataBuddy 团队在 2026 AICon 上分享企业 Data Agent 的 Runtime 实践,提出动作可控、结果可信、经验可进化三条边界,并把动作按回答、查询、生产变更、外联分为四级,风险越高控制越前移。
Nikolay Samokhvalov 发布了开源教育可视化工具 PGSimCity,把 PostgreSQL 集群运行机制转成可在浏览器中访问的交互式 3D 城市模拟,无需本地依赖,连接从 Postmaster 进入,shared_buffers 池是中央的 1024 帧网格,WAL 与维护进程分布在东西两侧。