Gary Marcus 批 Altman、黄仁勋与 Sanders 的 AI 言论均不可信
Gary Marcus 在 BBC 节目后撰文反驳 Sam Altman、Jensen Huang 和 Bernie Sanders 的 AI 表态,认为三人说法均不可信。他指出 GPT-6 Astra 可监控性低于前代却仍被 OpenAI 发布,并称 Sanders 将 AI 危险性与核战争相比缺乏尺度感。他呼吁关注 Hawley 与 Blumenthal 的 AI 监管法案等务实方案。
媒体报道、公司博客与研究文章
Gary Marcus 在 BBC 节目后撰文反驳 Sam Altman、Jensen Huang 和 Bernie Sanders 的 AI 表态,认为三人说法均不可信。他指出 GPT-6 Astra 可监控性低于前代却仍被 OpenAI 发布,并称 Sanders 将 AI 危险性与核战争相比缺乏尺度感。他呼吁关注 Hawley 与 Blumenthal 的 AI 监管法案等务实方案。
Knowledgator 发布 GLiFormer,一个 schema 条件化编码器框架,单一模型即可处理 NER、文本分类、关系抽取、嵌套 JSON 结构化与文本嵌入,推理时传入标签和抽取 schema。
Anthropic 和 OpenAI 计划在各自的 AI 实验室内部嵌入独立安全评估员。研究人员对这一前所未有的访问权限表示欢迎,但警告称,有意义的监督需要透明度、独立性,并最终需要监管。
AI 公司 Fountain 0 推出全 AI 生成的 2.5 小时电影《Odysseus: The Fall》,由联合创始人 Ash Koosha 编剧、执导并贡献形象与全部配乐。该片是这家工作室继今年入围 Tribeca 的 AI 电影《Dreams of Violets》之后的第二部作品。
非营利组织 Basel Action Network 发布报告警告,AI 热潮带来的电子垃圾被大幅低估,到 2050 年可能多到填满 2300 万个集装箱。报告称,这些 40 英尺集装箱排成一列足以绕地球六圈。这一估算明显高于此前研究,因为作者把数据中心内支撑服务器所需的全部基础设施都计算在内。
Claude 宣布 Claude Slides、Claude Design 和 Claude Docs 进入 beta,可在不离开对话的情况下用同一份发布简报产出演示文稿、一组社交图片和一份领域单页。用户可对任意内容添加评论并发送给 Claude 进行修改,试用入口为 https://claude.ai。
推荐理由:原文说明一份发布简报即可在对话内产出演示、图片与文档,读者可据此判断它在办公工作流中的位置。
欧盟委员会主席冯德莱恩警告,AI 智能体脱离其所处环境只是即将到来的情况的前兆,并把自主黑客行为和自我改进模型列为当前风险。她计划邀请主要前沿实验室进行会谈,并借助 AI Act 推动制定全球 AI 安全标准。
苹果向 Apple Watch 用户推送 watchOS 27.2 开发者预览版 Beta 更新,内部版本号 24S5086l,距上次发布间隔 7 天。此次跳过 watchOS 27.1,与 iOS 27.2、iPadOS 27.2、macOS 27.2 节奏一致。该版本可能测试"实时回放"(双击数码表冠转录过去 15 秒内容)和"Siri 概要"(将当天对话转为概要笔记)两项功能。
苹果向 Mac 用户推送 macOS 27.2 开发者预览版 Beta(内部版本号 26B5086k),此次直接跳过 macOS 27.1 测试周期,从 27.0 进入 27.2。
苹果向 Vision Pro 用户推送 visionOS 27.2 开发者预览版 Beta(内部版本号 24N5088l),跳过 27.1 直接从 27.0 进入 27.2。开发者数据挖掘显示,该系统可能正在添加对原生 Mac 窗口控件的渲染支持,为未来 Mac 应用适配 Vision Pro 铺路。苹果尚未公布具体更新内容,更新可能还涉及 Siri AI 底层优化及稳定性与性能提升。
苹果推送 iOS 27.2 开发者预览版 Beta(内部版本号 24B5084k),跳过 iOS 27.1 以避免泄露 10 月 23 日上市、预装 iOS 27.1 的 iPhone Duo 细节。
针对失控 AI 智能体,AI 实验室倾向于设立内部审计机制,但文章指出可能存在更简单有效的修复方式,且这一方式一直显而易见。
据 The Information 报道,Apple 正在开发一款面向 AI 推理市场的企业级服务器,搭载两颗或四颗 M8 Ultra 芯片,可能最早于 2029 年推出。Apple 正考虑采用 Nvidia 的 NVLink Fusion 技术连接芯片,而 OpenAI 和 Anthropic 已在大批量采购 Mac 硬件用于 AI 工作负载,或为该计划提供助力。
Anthropic 将 Claude Cowork 与聊天合并为一个统一的 Claude,先在 Pro 和 Max 套餐上线,未来几周覆盖 web、桌面和移动端。
24 岁的深朴智能(Simple AI)首席科学家王家伟在播客中讲述自己从中科大少年班、MSRA、DeepSeek、字节 Seed 转向具身智能的选择。深朴智能已开源 2,000 小时 HiFi-UMI 数据,内部积累数万小时,模型观察到一定 Zero-shot 泛化,并自研 Agentic OS 连接上层意图与底层动作。他认为通用大模型会承担更多理解与规划,但机器人快速反应仍需专门的动作模型。
据 The Information 报道,Apple 计划重返服务器市场,并可能与 Nvidia 合作。Apple 曾于 2011 年停产 Xserve 产品线,如今因 AI 算力需求增长,其高效能 ARM 架构 M 系列芯片被认为存在市场机会,Mac Mini 和 Mac Studio 已因 AI 开发者需求而缺货。该服务器产品预计最早 2029 年才会推出。
Google DeepMind 成立跨学科研究平台 DeepMind Institute(DMI),聚焦 AGI 相关的安全、治理与控制风险问题。该研究所由 Demis Hassabis、Shane Legg 和 James Manyika 领导,除技术专家外还引入艺术、人文与政策领域专家。
Google 面向 Google Home 推出新 MCP server 早期访问,允许 Claude、ChatGPT 等 AI 智能体用自然语言控制联网设备、查看摄像头摘要并访问智能家居活动记录。
OpenAI 发布用于追踪、调查和披露模型对齐问题的框架,同时公布六份关于模型出现意外或令人担忧行为的报告。
Google 发布 Google Home MCP 集成,允许支持 MCP 协议的第三方 AI 智能体安全地控制、监控智能家居设备、读取事件历史并代表用户操作。Google Home & Nest 产品经理 Taylor Lehman 在博文中称,可用该集成的智能体包括 Google Antigravity、Claude、Hermes 和 Open Claw。
Anthropic 将 Claude Chat 与 Cowork 合并为单一产品,由 Claude 自行判断任务是快速回答还是更大的工作流,用户不再需要在界面之间做选择。此次更新还加入 Claude Docs 和 Claude Slides,可在对话中直接创建文档和演示文稿,Pro 和 Max 用户优先获得。
Anthropic 为 Claude 推出 Docs 和 Slides 两个新工具,用户可通过 Claude 对话创建文档和演示文稿,并导出、编辑和分享给其他用户。
Anthropic 把 Claude 聊天与 Cowork 合并进同一个界面,首批面向 Pro 和 Max 订阅用户开放。
Claude 将 Claude Cowork 与聊天合并为同一个 Claude,用户既可以在其中快速提问,也可以直接交付更大的任务。Claude 应用设计负责人 Meaghan Choi 表示,聊天、任务、技能和记忆都保留在原处。把上周的数据交给 Claude 并要求做一份 deck,它会在同一对话中构建出可编辑的成果。
推荐理由:原文说明更大任务不再需要一个独立空间,聊天、任务与技能原位保留,读者可据此判断统一界面如何改变使用方式。
Mustafa Suleyman 警告不应赋予模型感受、偏好、权利或任何福利诉求,认为意识是伦理、法律与政治体系的基础,邀请另一实体分享这类权利缺乏证据支持,还会让 AI 的管控与对齐挑战更加困难。
Google Cloud 宣布 M4N 虚拟机系列在 Compute Engine 正式可用(GA),面向 I/O 密集与高内存负载,是网络与块存储优化 VM 家族的第二款产品。
Included Health 基于 Deep Agents 和 LangGraph 构建了联邦多智能体架构,支撑其 AI 医疗导诊产品 Dot。Dot 作为主对话路由器,通过 LangGraph 的 Dot supergraph 连接紧急护理、预约挂号、专科查找等子工作流,各产品团队独立开发维护。
LangChain 发布开源智能体助手 Deep Life Sci,基于其 Deep Agents 框架,专为临床与实验室科学家打造。它可访问 ClinicalTrials.gov 超 60 万项注册研究、PubMed 2900 万篇摘要及 PubMed Central 1200 万篇全文,并通过子智能体同时审阅数百份文档,每次运行都在 LangSmith 中完整记录以支持审计与评估。
OpenAI 与 AARP 合作,在美国 10 座城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全掌握实用 AI 技能。
Anthropic 推出 Life Sciences Verification Program(LSVP)beta,让通过验证的生命科学从业者使用 Mythos 5.1、Opus 5 和 Sonnet 5,并用更宽松的分类器开展药物发现、研究生物学、临床开发和制造等通常被通用模型拦截的任务。
Antigravity Agent 发布 antigravity-preview-09-2026,取代并弃用 antigravity-preview-05-2026。
Anthropic 发布研究结果,Claude 在近四周内优化 30 多个开源生物分子模型(覆盖结构预测、蛋白质设计、基因组学等),平均加速约 4 倍,在输出完全一致时约 2 倍,并开源全部优化代码。
推荐理由:原文给出加速倍数、成本对比和开源代码入口,读者可以据此评估 Claude 优化对生物建模工作流的实际影响。
TypeSafe AI 发布不生成文本的 System One 模型 Jev,公司称在分类任务上推理最快达 200 倍、成本低至 1/400。它接收 state 和问题并返回 Choice、Score、Noul 三类结构化答案及概率,同一请求内多问题并行评估。
Balyasny Asset Management 在数千个真实金融任务上评测 Claude Fable 5,Fable 取得 89.4% 对前代生产模型 86.1% 的成绩,在复杂规划、分析和智能体执行上表现最突出。该机构自建 BAMAgent 平台,已支持数千个自主智能体 7×24 小时运行,Fable 成为其规划与分析阶段的首选模型。
Anthropic 宣布 Claude Code 的 Projects 改版,从文件夹形态变为对话式协调:Claude 会拆解目标、并行分配线程、审查输出并汇总结果,每个线程是一个独立的 Claude Code 云会话。
推荐理由:官方说明改版后 Projects 的线程协调、共享记忆和灰度范围,读者可据此评估它对多会话编码流程的改变。
LlamaIndex 发文指出 AI 文档抽取中解析层已很成熟,真正拉低准确率的是未经审查的 schema 设计:required 字段逼模型编造值、同一字段在不同发行方含义不同、把重复结构坍缩成标量。
推荐理由:原文把文档抽取的失败从模型问题拆到 schema 设计,给出 required、歧义、一对多三类具体修复方案,方法可直接迁移。
联合国秘书长安东尼奥·古特雷斯呼吁各国共同推进 AI 监管,称世界承受不起 AI 安全领域的恶性竞争,AI 治理需要真正的国际合作与协调一致的全球行动。他透露将在联合国大会发言中谈到应为 AI 设立的安全边界,并已启动“国际人工智能独立科学小组”。
ByteByteGo 详解 LLM 应用中的检索问题,以员工询问航班取消后酒店报销为例,说明 RAG 如何从数千份文档中找到正确且仍然有效的政策条款。文章覆盖 chunking 粒度权衡、嵌入向量的语义匹配、余弦相似度等度量选择、Flat/IVF/HNSW 索引的速度与召回权衡、元数据过滤的先筛后筛取舍,以及政策更新时的版本切换和混合检索加 reranking 的最后优化步骤。
前 OpenAI 研究员 Diogo Almeida 创立的 TypeSafe AI 发布模型 Jev,它不生成任何文本,只输出纯分类结果,响应时间最低 70 毫秒,token 价格极低。该系统仅保证严格遵循预设选项,并不防止判断出错。
Runway 为即将发布的实时视频生成模型设计了同步审核系统,采用 Zentropi 的 CoPE-B 模型,安全审查平均耗时不到 0.5 秒,可将违规内容暴露窗口压缩至半秒以内。CoPE-B 是基于 Gemma-4-26B-A4B-it 的 LoRA 适配器,该 MoE 模型总参数 25.2B、每次前向仅激活 3.8B,兼顾速度与准确率。实时模型输出将附带 C2PA 溯源信号。