Proaction 借助 Codex 提升销售 60% 并节省 75+ 小时
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理服务,实现销售额提升 60%、节省 75+ 小时。
媒体报道、公司博客与研究文章
Proaction 使用 Codex、GPT-Live-1 和 GPT-6 Astra 构建、运营并销售现代车队管理服务,实现销售额提升 60%、节省 75+ 小时。
GitHub Copilot app 提供 canvas 功能,运行 /create-canvas 技能并用自然语言描述工作流、界面操作和 agent 职责三要素,即可生成看板、清单等自定义界面并保存为可共享的 extension。
推荐理由:官方教程给出从描述到生成可复用 canvas 界面的具体步骤和三个提问框架,读者可以直接照做迁移到自己的工作流。
Simon Willison 引述 John Gruber 对 Meta Muse 的评论:每个用户在 Meta 云端获得一个完整的持久 Linux 虚拟机,被称为首个面向消费者的 agentic AI 系统。Gruber 认为其打包易于安装使用,但消费者可能并未意识到它有多强大、多危险,尤其是运行在自己的 Mac 上时。
Claude Opus 5.5 已在 Google Cloud 上线,面向日常复杂任务,强化智能体编码、研究与分析能力,并降低每 token 成本。GKE Agentic Migration 进入 Public Preview,以确定性护栏辅助 AWS EKS 到 GKE 的迁移,本地运行、零实时集群改动。
ByteByteGo Live 推出「用 AI 重建 YouTube」课程,由前 YouTube 工程师授课,9 月 26 日(周六)开课,报名 24 小时后截止。
Reactor 与 Amazon Neuron Science 团队合作,针对 Rolling Forcing 自回归扩散模型在 Trainium 上的部署进行内核级优化,以实现实时交互式视频生成。该模型能以 16 帧/秒生成 30 秒高质量视频,但序列极长、内存消耗大,实时运行需生成速度始终领先播放时间线。
美国国防部预算申请拟在未来五年投入 3030 万美元,由国防反谍报与安全局运营 Polygraph+ 项目,研发基于 AI 和机器学习的测谎评分算法及无需接触受测者的远距传感技术,用于雇员审查和内部威胁检测。
Today AI 今年 9 月在国内面向用户开放,定位「Personal AI 助理」,已支持 macOS、Windows、Linux、iOS 四个平台。它以 Memory 积累用户偏好,通过简报卡片和 Proactive 交互主动推进工作,可查询本地 Obsidian 文章库、整理 Gmail 邮件、生成 HTML 交付物并写入 Google Calendar。
Latent Space 计划下周推出 AINews v3,将已运营 3 年、订阅超 20 万的 AINews 与 Latent Space Discord 合并,并探索迁移至 Beehiiv 和新首页。
Latent Space 采访 Runway CTO Kamil Sindi 与研究科学家 Robin Kahlow,解读 GWM Worlds 2 新功能 WorldPrompt。
Wayfair 借助 OpenAI 模型改进电商客服与商品目录准确率,实现工单自动分类,并大规模优化数百万条商品属性。
Simon Willison 在 2026 年 9 月 24 日的笔记中表示,与编程智能体打交道越多,他越确信这些工具反而让软件工程变得更难。他认为智能体能带来惊人的成果,但释放其全部潜力需要极高的纪律性和知识储备。
Runway Dev 的 Model Router 可按成本、质量或延迟偏好为每次请求自动选模型,其评测显示质量优化路由在 250 条图生视频提示上把单条成本从 Seedance 2.5 基线的 $1.80 降至 $1.28(-29%),可用率 77% 对 78%。
Simon Willison 发布 commit-rewriter 0.2。该工具与 git 相关,具体功能与更新细节原文未作说明。
GitHub Copilot 博客作者提出聊天(chat)很多时候是错误的 AI 交互界面,介绍 GitHub Copilot app 中的 canvas,它是在应用内运行、无浏览器外壳的全栈小应用,可与 Copilot agent 双向通信。
推荐理由:作者作为 Copilot 团队成员提出用 canvas 自定义界面替代聊天框,并结合工作流自动化等实例说明何时值得让智能体先造工具。
Google Research 发布 AI video co-director 研究,基于 Gemini 和 Veo 构建统一多智能体框架,包含 Co-Director(COLM 2026)、CANVAS(EMNLP 2026)、A²RD 和 VQQA 四个框架,将长视频生成转化为全局优化与世界状态跟踪问题,自动完成多模型提示、镜头衔接和闭环视觉精修。
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。该版本还把 Datasette 所有模态对话框重构为单一 Web Component,并已提供文档供其他插件使用。
GitHub Security Lab 的 Antonio Morales 基于自家的 Taskflow Agent 框架构建了 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线。
推荐理由:原文给出完整的架构设计、覆盖反馈循环和分层判断方法,读者可以据此把 LLM 智能体接到自己的模糊测试流程里。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为对话模型加入近实时视频生成与视觉形象,今日起在 Gemini Enterprise 提供。该功能支持精确唇形同步、异步工具调用不中断对话、跨 97 种语言的语音到语音同步,并可用参考图定制头像(需企业允许名单),所有输出带 SynthID 水印。
SGLang 的 /v1/score 接口让调用方通过 label_token_ids 显式声明所需标签分数,避免依赖生成响应 top-k logprobs 中是否出现该标签。
LangChain 发布教程,讲解如何将 TypeSafe 新发布的决策模型 Jev 与 LangGraph 结合构建 AI 驱动软件。
推荐理由:LangChain 官方展示了如何用决策模型 Jev 搭配 LangGraph 构建生产系统,含诉讼文档审阅等实测对比,可迁移到自身智能体架构。
物理学家 Matt von Hippel 发文复盘,Anthropic 的 Liam Fitzpatrick 和 Siddharth Mishra-Sharma 用 Fable 5.1 驱动的 Claude Science 完成他提出的挑战。
推荐理由:物理学家亲历 Claude 用千元级预算独立完成九圈振幅计算,给出对 AI 科研能力和低垂果实的第一手判断。
LangSmith 宣布多项更新:Engine v2 增加 Red Teaming、更多问题类型检测和自动测试修复并一键开 PR 的能力,Engine 上线以来已分析超过 60M traces。
Anthropic 开放 Claude 插件目录提交,开发者可通过新的提交门户上传插件并在审核通过后上架。插件可打包 MCP 连接器、Agent Skills 或两者,在 Claude Code 中还可包含 LSP、命令、钩子和 agents;门户支持自动校验、安全扫描、审核状态跟踪,上线后提供按产品面和版本划分的安装分析。
推荐理由:官方说明了插件提交、审核与使用分析的完整流程,开发者可以据此决定如何把现有 MCP 连接器或技能打包上架。
Endura Therapeutics CEO Adrian Sanborn 提出 AI 变革科学研究的两种路径:Foundries 用新技术把实验数据生成速度提高一个数量级,Navigators 用语言模型消化思考盈余、改进运营决策。
Sakana AI 在「日本スタートアップ大賞2026」中获总务大臣奖(信息通信领域),表彰其受自然界进化与集合知启发的高效 AI 开发手法,以及在有限计算资源下实现高性能推理的架构。Sakana AI 表示其采用多个小型高效模型组合的路线,不依赖巨型基础设施,并已在指挥统制(C2)系统中应用 AI 技术。
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下加速推理。解码最高提速 3.13x(M5 Max 设备端)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x。
NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作,通过 AlphaFold Database 公开超过 2,800 种病毒的蛋白复合物预测 3D 结构,数据由 AlphaFold2 结合 NVIDIA BioNeMo Inference Runtime 优化推理生成,其中约 30% 的蛋白相互作用此前未被 Protein Data Bank 记录。
Gary Marcus 引用 Jensen Huang 与 Ezra Klein 访谈中“若无法控制软件就应关停实验室”的说法,指出按此逻辑应至少暂时关停 OpenAI。
Meta 在 Connect 2026 上以 Muse 个人智能体为中心,推出语音、实时视频、Mac 电脑操作、Muse Mail、1500+ 应用连接器,以及 $1,299 的 Meta VR 眼镜和 12 月发售的 Muse Charm 钥匙扣。
千问正提前布局「Personal Agent」大版本,让模型在用户授权下接入健康、运动等个人数据,并支持部分用户连接持仓,从聊天框延伸到真实生活场景。官方数据显示,千问上的复杂任务增长了5倍,用户沟通轮次来到5-8轮。千问把从夸克继承的网盘、题库、扫描、高考志愿等工具做成 Skill 交给 Agent 调用,入口还可延伸至耳机、智能座舱。
十字路口与 Table for Six 合作发起「六人一桌」AI 从业者深度交流活动,10 月 17 日在上海、北京、深圳、杭州、成都五城同时举办。报名者填写问卷后,主办方将为其匹配五位桌友并生成专属话题卡,围绕 AI 产品体验、常用模型与工作流变化展开交流。
AI for Materials 公司索格智算已完成数千万元天使轮融资,由复星创富领投,云启资本、中赢创投等跟投。其原创随机分批算法将多体模拟计算复杂度从平方级降至线性,万核并行效率从 20%-30% 提升至 95% 以上,计算速度提升数十至百倍。
元宝节前更新上线旅游计划 Agent,可在 APP 对话中触发,也能把微信聊天记录多选转发给它整理需求。它会实时搜索门票预约规则等信息,输出可交互行程卡,并调用混元 Hy Image3.5 preview 生成攻略图,还能推荐徒步装备并跳转京东小程序加购。
Google 团队在 MaxText/JAX 和 Google Cloud TPU 上从零复现了 Ai2 的 Olmo 3 7B,覆盖 stage-1 预训练(约5.93T token)和 stage-2 中期训练 anneal,held-out C4 loss 与 8 项下游任务均与 Ai2 参考持平。
Apple 研究团队提出潜空间蒸馏方法压缩流式神经音频编码器(tokenizer),以教师模型量化前的逐帧潜表示为监督目标,仅训练学生编码器做回归,并用单层仿射层吸收师生宽度差异。在 2.8 倍压缩下,六组师生配对中有五组无需微调即保持在教师 1.9% 相对 WER 以内,并比同容量独立训练编码器相对提升 3.9%。该方法同时适用于独立预训练和与语言模型联合训练的 tokenizer。
Google Cloud API Gateway 进入 Public Preview,可充当远程 MCP 服务器,无需单独搭建 MCP 服务器即可把现有 REST 操作变成智能体可调用的 MCP 工具。
推荐理由:官方宣布 API Gateway 可直接充当远程 MCP 服务器,复用既有鉴权与配额,无需另建 MCP 服务器,适合评估 Agent 接入现有 API 的路径。
Meta 宣布把 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,让 AI 在云端 CVM 内处理个人上下文,连 Meta 自己也无法访问数据。系统基于 TEE 硬件隔离,采用匿名凭证加第三方 OHTTP 中继实现不可定向路由,通过 RA-TLS 远程证明核对公开透明账本,持久记忆以用户密钥加密存储在 TEE 内,并扩展 Bug Bounty 供外部研究者审计。
Apple 研究团队提出半监督联邦 ASR 训练方案,通过在线伪标签教师与服务端标注数据锚定更新两条耦合设计轴,解决伪标签误差跨序列、跨轮次累积导致的训练发散问题。该方案在 11 组对比中 9 组优于此前最强方法,域内平均提升 20.8%、跨域提升 10.0%,缩小了与全监督联邦学习的差距。
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。