Datasette 1.0a41 发布,新增 OpenTelemetry 支持
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。该版本还把 Datasette 所有模态对话框重构为单一 Web Component,并已提供文档供其他插件使用。
媒体报道、公司博客与研究文章
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。该版本还把 Datasette 所有模态对话框重构为单一 Web Component,并已提供文档供其他插件使用。
GitHub Security Lab 的 Antonio Morales 基于自家的 Taskflow Agent 框架构建了 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线。
推荐理由:原文给出完整的架构设计、覆盖反馈循环和分层判断方法,读者可以据此把 LLM 智能体接到自己的模糊测试流程里。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为对话模型加入近实时视频生成与视觉形象,今日起在 Gemini Enterprise 提供。该功能支持精确唇形同步、异步工具调用不中断对话、跨 97 种语言的语音到语音同步,并可用参考图定制头像(需企业允许名单),所有输出带 SynthID 水印。
Epoch AI 报告估计 2026 年华为总 AI 算力产量约为 Nvidia 的 1/25,Ascend 950 单芯片性能约为 B300 的 1/7、2022 年 H100 的一半。
推荐理由:报告用量化拆解说明华为与Nvidia在芯片性能和算力产量上的差距及至2030年的演变,给出可核验的数字与路径分析。
SGLang 的 /v1/score 接口让调用方通过 label_token_ids 显式声明所需标签分数,避免依赖生成响应 top-k logprobs 中是否出现该标签。
LangChain 发布教程,讲解如何将 TypeSafe 新发布的决策模型 Jev 与 LangGraph 结合构建 AI 驱动软件。
推荐理由:LangChain 官方展示了如何用决策模型 Jev 搭配 LangGraph 构建生产系统,含诉讼文档审阅等实测对比,可迁移到自身智能体架构。
物理学家 Matt von Hippel 发文复盘,Anthropic 的 Liam Fitzpatrick 和 Siddharth Mishra-Sharma 用 Fable 5.1 驱动的 Claude Science 完成他提出的挑战。
推荐理由:物理学家亲历 Claude 用千元级预算独立完成九圈振幅计算,给出对 AI 科研能力和低垂果实的第一手判断。
Cohere 的检索平台 Compass 以托管服务 Compass Cloud 形式进入私有测试版,由 Cohere 管理完整流水线和模型推理,开发者可通过 API、MCP server 或 Python SDK 接入。
LangSmith 宣布多项更新:Engine v2 增加 Red Teaming、更多问题类型检测和自动测试修复并一键开 PR 的能力,Engine 上线以来已分析超过 60M traces。
Anthropic 开放 Claude 插件目录提交,开发者可通过新的提交门户上传插件并在审核通过后上架。插件可打包 MCP 连接器、Agent Skills 或两者,在 Claude Code 中还可包含 LSP、命令、钩子和 agents;门户支持自动校验、安全扫描、审核状态跟踪,上线后提供按产品面和版本划分的安装分析。
推荐理由:官方说明了插件提交、审核与使用分析的完整流程,开发者可以据此决定如何把现有 MCP 连接器或技能打包上架。
Endura Therapeutics CEO Adrian Sanborn 提出 AI 变革科学研究的两种路径:Foundries 用新技术把实验数据生成速度提高一个数量级,Navigators 用语言模型消化思考盈余、改进运营决策。
Sakana AI 在「日本スタートアップ大賞2026」中获总务大臣奖(信息通信领域),表彰其受自然界进化与集合知启发的高效 AI 开发手法,以及在有限计算资源下实现高性能推理的架构。Sakana AI 表示其采用多个小型高效模型组合的路线,不依赖巨型基础设施,并已在指挥统制(C2)系统中应用 AI 技术。
Liquid AI 为视觉语言模型 LFM2.5-VL-3B 发布实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下加速推理。解码最高提速 3.13x(M5 Max 设备端)和 2.66x(H100),端到端最高提升 2.62x 和 2.27x。
NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作,通过 AlphaFold Database 公开超过 2,800 种病毒的蛋白复合物预测 3D 结构,数据由 AlphaFold2 结合 NVIDIA BioNeMo Inference Runtime 优化推理生成,其中约 30% 的蛋白相互作用此前未被 Protein Data Bank 记录。
Gary Marcus 引用 Jensen Huang 与 Ezra Klein 访谈中“若无法控制软件就应关停实验室”的说法,指出按此逻辑应至少暂时关停 OpenAI。
Meta 在 Connect 2026 上以 Muse 个人智能体为中心,推出语音、实时视频、Mac 电脑操作、Muse Mail、1500+ 应用连接器,以及 $1,299 的 Meta VR 眼镜和 12 月发售的 Muse Charm 钥匙扣。
千问正提前布局「Personal Agent」大版本,让模型在用户授权下接入健康、运动等个人数据,并支持部分用户连接持仓,从聊天框延伸到真实生活场景。官方数据显示,千问上的复杂任务增长了5倍,用户沟通轮次来到5-8轮。千问把从夸克继承的网盘、题库、扫描、高考志愿等工具做成 Skill 交给 Agent 调用,入口还可延伸至耳机、智能座舱。
十字路口与 Table for Six 合作发起「六人一桌」AI 从业者深度交流活动,10 月 17 日在上海、北京、深圳、杭州、成都五城同时举办。报名者填写问卷后,主办方将为其匹配五位桌友并生成专属话题卡,围绕 AI 产品体验、常用模型与工作流变化展开交流。
AI for Materials 公司索格智算已完成数千万元天使轮融资,由复星创富领投,云启资本、中赢创投等跟投。其原创随机分批算法将多体模拟计算复杂度从平方级降至线性,万核并行效率从 20%-30% 提升至 95% 以上,计算速度提升数十至百倍。
元宝节前更新上线旅游计划 Agent,可在 APP 对话中触发,也能把微信聊天记录多选转发给它整理需求。它会实时搜索门票预约规则等信息,输出可交互行程卡,并调用混元 Hy Image3.5 preview 生成攻略图,还能推荐徒步装备并跳转京东小程序加购。
Google 团队在 MaxText/JAX 和 Google Cloud TPU 上从零复现了 Ai2 的 Olmo 3 7B,覆盖 stage-1 预训练(约5.93T token)和 stage-2 中期训练 anneal,held-out C4 loss 与 8 项下游任务均与 Ai2 参考持平。
Apple 研究团队提出潜空间蒸馏方法压缩流式神经音频编码器(tokenizer),以教师模型量化前的逐帧潜表示为监督目标,仅训练学生编码器做回归,并用单层仿射层吸收师生宽度差异。在 2.8 倍压缩下,六组师生配对中有五组无需微调即保持在教师 1.9% 相对 WER 以内,并比同容量独立训练编码器相对提升 3.9%。该方法同时适用于独立预训练和与语言模型联合训练的 tokenizer。
Liquid AI 发布面向 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,解码吞吐在 GPU 上最高提升 2.66 倍、边缘设备上最高提升 3.13 倍,端到端最高分别提升 2.27 倍和 2.62 倍。
Google Cloud API Gateway 进入 Public Preview,可充当远程 MCP 服务器,无需单独搭建 MCP 服务器即可把现有 REST 操作变成智能体可调用的 MCP 工具。
推荐理由:官方宣布 API Gateway 可直接充当远程 MCP 服务器,复用既有鉴权与配额,无需另建 MCP 服务器,适合评估 Agent 接入现有 API 的路径。
Factory 的 Legacy-Bench 于 9 月 24 日加入 Fireworks 的 Specialized Intelligence Index,用于评测前沿模型在 COBOL、Java 7、BASIC、C89、Fortran 和 Assembly 上的调试、实现与迁移能力。
Meta 宣布把 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,让 AI 在云端 CVM 内处理个人上下文,连 Meta 自己也无法访问数据。系统基于 TEE 硬件隔离,采用匿名凭证加第三方 OHTTP 中继实现不可定向路由,通过 RA-TLS 远程证明核对公开透明账本,持久记忆以用户密钥加密存储在 TEE 内,并扩展 Bug Bounty 供外部研究者审计。
Apple 研究团队提出半监督联邦 ASR 训练方案,通过在线伪标签教师与服务端标注数据锚定更新两条耦合设计轴,解决伪标签误差跨序列、跨轮次累积导致的训练发散问题。该方案在 11 组对比中 9 组优于此前最强方法,域内平均提升 20.8%、跨域提升 10.0%,缩小了与全监督联邦学习的差距。
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。
Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangie 在联合国安理会就 AI 发言,Gary Marcus 转述并全文转载了经本人许可的 Bengio 发言。
SemiAnalysis 发布 ClusterMAX 3.0 GPU 云评级,覆盖 77 家 neocloud,市场视图扩至 323 家,全球仅 19 家获得奖牌评级。
GitHub Copilot app 重建了 Pull Request 视图,可流畅打开含 2,200 个文件、超过一百万行变更和 400 多条内联评论的超大 PR。核心做法是把高度拆成确定性的代码几何与动态评论块两套独立体系,配合基于身份锚定的滚动校正、先流式返回结构的 pipeline,以及用生产探针和自动巡航跑 change → measure → improve 循环来定位 bug。
Black Forest Labs 发布 7B 单步 World Action Model FLUX 3 Action(F3A)并公开权重与技术报告。在 RoboLab 上 F3A 成功率 38.3%±0.38,超过 Cosmos 3 Nano 的 36.8%,guidance 蒸馏版将纪录提高到 42.2%±0.36,比 Pi0.5 BF16 快 1.34x 到 2.28x。
推荐理由:官方报告同时放出权重和完整微调配方,还给出与 Pi0.5、Cosmos 3 的速度与成本对比,读者可评估机器人部署选型。
Redwood Research 的 Lukas Finnveden 发文指出,CoT 是目前理解模型推理的最有价值的监督工具,而 COCONUT、full-bandwidth transformers、looped transformers 等潜在推理架构会让模型在潜在状态中进行更多推理,削弱 CoT 的必要性并使监督更困难。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam。
Google 发布两个新 TTS 模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,提供超过 2,000 个声音,可用 30 秒音频样本创建自定义声音。
a16z 推出 Ops Engineering Fellowship,这是一个为期六周的 cohort,面向用 AI 重新定义组织运营方式的创新者,2026 年 10 月启动,时间投入灵活。
一篇用可交互示例讲解 shadow roots 的教程,演示样式封装、继承、slots、parts 以及 JavaScript 访问方式,展示 shadow root 如何创建带私有样式表和元素的隔离 DOM 树,并以受控方式与页面 DOM 交互。该示例由 Fable 5.1 Medium 根据提示词生成。
Microsoft Research 宣布在 Physical AI Toolchain 中新增推理卸载能力,可将机器人 AI 工作负载容器化并通过 Kubernetes 编排到机器人、边缘与云端 GPU。
Google Private AI Compute 团队宣布为 Private AI Compute 平台引入私密的服务端持久记忆,让 AI 助手能跨设备长期保留上下文。
LangChain 在 LangSmith 中推出 Custom Apps,可在 LangSmith 数据之上构建、发布并直接运行自定义 UI,免去托管、认证和权限维护。