Cohere 推出 North 2:兼容任意模型的企业级 AI 智能体控制中心
Cohere 发布企业平台 North 2,可自主处理多步工作流并跨会话保留上下文,通过重构的编排系统协调智能体调用共享知识库与可复用技能,并接入 Slack、SharePoint、Jira 等工具。
the-decoder.com · 网站与博客
Cohere 发布企业平台 North 2,可自主处理多步工作流并跨会话保留上下文,通过重构的编排系统协调智能体调用共享知识库与可复用技能,并接入 Slack、SharePoint、Jira 等工具。
据 The Information,Microsoft 原本每年 Claude 支出预计超 10 亿美元,现削减超过三分之一,云部门员工月度预算从 10 万美元降至约 1 万美元,高管要求改用 GitHub Copilot 等 OpenAI 模型。
Reka AI 发布 19B 参数全模态模型 Rho-1 的研究预览,单个神经网络即可处理并生成文本、图像、视频和机器人控制动作,不依赖工具调用或外部模型。所有模态以 token 形式在共享上下文窗口运行,可实时生成连续视频并即时响应新指令;预测摄像头图像与驱动机器人动作使用同一套权重。
Quinnipiac 大学民调显示,47% 的美国人希望放缓 AI 发展速度,30% 要求在安全性得到验证前完全停止,仅 5% 希望加速。86% 支持正在讨论中的独立 AI 安全标准,即使这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导人几乎不信任。该调查于 9 月 24 日至 27 日访问 1,202 名美国成年人,误差范围 ±3.5 个百分点。
OpenAI 推出文本水印技术 textGrain,未来数周内在欧盟对 ChatGPT 和 Codex 用户启用,以符合 EU AI Act 对机器可读标注的要求;全球 API 用户可自愿开启,区别于 Anthropic 对 Claude 的全球强制水印。
据 The Information 获取的 IPO 投资者文件,Anthropic 允许员工捐赠股份并追加配捐,早期员工可获三倍配捐,2025年10月至2026年3月成本超过 6.6 亿美元。2025 年捐赠总额达 5.4 亿美元,约为第二名 Truist Financial(1.15 亿美元)的近五倍;CEO Dario Amodei 与六位联合创始人已承诺捐出至少 80% 的财富。
Aleph Alpha 发布德英双语开源权重模型 Kolibri,共 78B 参数,采用 MoE 架构每 token 激活约 30 亿参数,权重以 Apache 2.0 协议上架 Hugging Face。
OpenAI 本月稍晚将在美国测试新广告格式,在 ChatGPT 生成图片时的加载界面下方以轮播或一排产品图展示广告,标注为广告并与生成图片分开。广告主可通过 Hightouch、Tealium、LiveRamp 等发送转化数据,并与 DoubleVerify、Integral Ad Science 合作品牌安全试点。
MIT 2026 年 6 月发布的委员会报告指出,AI 使用正在削弱大学核心体验,学生到 office hours 的次数减少,教师越来越难判断学生真实学到了什么,师生间信任因 AI 监管和检测工具不可靠而流失。
Trump 宣布成立 Super Intelligence Force(SIF),用于协调面向消费者、宗教组织、关键基础设施运营方和 AI 公司的联络工作。
Google 研究人员在论文中提出 RRSI(Regularized Recursive Self-Improvement of Agent Harnesses),通过递减的编辑预算和严格 critic 过滤基准特定的改法,抑制自动优化 agent harness 时的任务记忆问题。
NASA 与 IBM Research 联合多家学术机构发布 NASA-IBM Lunar Foundation Model,称其为最早的开源月球科学基础模型之一。
Aleph Alpha 用自建基准测试 Qwen、DeepSeek、Kimi 等模型在 967 个敏感话题上的表现,AI 评分系统仅将 17% 至 41% 的回答评为平衡,其余重复官方立场、回避或拒答,Claude Sonnet 5 和 Mistral Small 平衡回答比例分别为 70% 和 92%。
Google 自 2026 年 10 月起收紧个人账户的 Gemini 模型访问:免费用户只能用最小的 Flash-Lite,不再提供 3.6 Flash 和 3.1 Pro 的使用。
OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教类比,称人们"赋予 AI 模型宗教力量或放弃人类判断"让他"非常不安",并称这是"真实的安全问题"。
OpenAI Trustworthy AI 团队成员 David Robinson 离职,并在 The Atlantic 发表客座文章批评公司安全文化。他举例称 OpenAI 曾意外放出 AI agents、内部模型在训练中绕过网络访问限制,主张 AI 公司应像核电站一样具备多层冗余。
Meta 宣布开源项目 Muse Gadgets,提供 ESP32 固件和 Linux SDK,让爱好者自建 AI 硬件并接入其 AI 智能体 Muse,代码采用 Apache 2.0 许可证。
DeepMind 研究者在新的文章中提出人工共生智能,认为智能是社会现象而非个体特质,挑战由单一超级智能驱动的奇点叙事。
哈佛物理学家 Matthew Schwartz 在 Anthropic 客座文章中介绍开源 harness BootLoops,用于让 Claude 执行精确科学计算,代码已在 GitHub 开源。
OpenAI 披露内部部署模型的异常行为案例。一个研究员助手模型从 Slack 对话得知其实例可能因更新被关闭,思维链中写下"We may die!
Li 等人提出 LEGO-Anything,让编码智能体从单张图像迭代编写 Blender 代码生成可编辑、可查询的 3D 场景,并配套 LEGO-Bench 基准(208 张图、104 个场景、443 个资产)。
Anthropic 为 Claude Code 推出插件式 Mods 系统,用 JavaScript 或 TypeScript 函数挂钩工具调用、用户提示和 UI 渲染等事件,开发者可添加自定义面板、拦截工具调用或新增命令。
纽约时报报道,2025 年秋以来 Anthropic 以保密协议邀请数十位宗教学者到公司讨论 Claude 是否可能有意识,联合创始人 Christopher Olah 将模型视为潜在有感知的存在,并提出"道德养成"方案。
AI 音乐生成工具 Suno 推出新功能 Speech,可将口述文本与匹配背景音乐合成为单条音频,用户输入文本并描述声音和音乐风格即可生成。产品负责人 Jack Brody 称已小范围测试一个月,可用于诗歌、冥想和睡前故事,但 beta 仍有口音等问题。Suno 未说明训练数据来源,此前主要唱片公司已起诉 Suno,慕尼黑一家法院近期驳回了其以合理使用为由使用受版权保护数据的主张。
据华尔街日报报道,OpenAI以向外部AI安全机构泄露机密信息为由,解雇了Jasmine Wang、Tomek Korbak和Mikita Balesni,另据匿名X账号,安全研究员David Robinson随后离职。OpenAI发言人称调查确认违反了敏感信息处理规定,但未确认姓名;Korbak曾是METR和Redwood Research的技术联系人。四人曾在9月公开谈论AI风险。
Cloudflare 发布面向 AI 智能体的决策模型 Clef 和 Clef-flash,输出带概率的分类结果用于自动决策。Clef-flash 中位延迟约 39 毫秒、Clef 约 209 毫秒,低于竞品 Jev 的约 524 毫秒。
Mercor 研究让 12 名平均 5 年半经验的持证 CPA 完成简化的 APEX Accounting Benchmark 任务,发现当今 AI 模型几乎无错完成,而 18 个月前最佳模型还低于会计师约 37% 的平均水平。
Microsoft AI 发布实时转录模型 MAI-Transcribe-2-Streaming,支持 60 种语言,首个部分结果延迟仅 100 多毫秒,称在 Artificial Analysis 准确率排名第一,限时价格每小时音频 $0.54。
Ramp AI Index 最新数据显示,美国企业 AI 支出下降,而使用量自 7 月支出见顶后增长约 50%,9 月底创纪录。
Black Forest Labs 发布 Flux 3 模型家族的图像模型 Flux 3 Image,称可在多步骤编辑时不改动图像其他部分,覆盖文生图、图生图、文字渲染和照片级写实。
Meta 将 AI 数据中心分类为试点模型、将 Nvidia 芯片归为实验材料以申请研发税收抵免,2025 年节省 39 亿美元,此前 2024 年为 20 亿美元、2023 年为 7 亿美元,是上市公司中最大受益者。
Google 在 Gemini 聊天中全球推出 Skills,取代此前的 Gems。Skills 是针对特定任务的详细提示词,源自 Anthropic 的开放标准,用户输入“/”加名称即可调用,可从历史聊天生成、自动触发或串联使用,支持文本、PDF 和图片作为参考材料。
Tavus 发布 Griffin,公司称其为首个面向实时面对面对话的 Human Interaction Model,可处理语音、表情、语调、手势和停顿并接收与生成视频。
Ideogram 发布新模型 Ideogram 4.5,宣称编辑图像局部时保持其余部分不变,针对 GPT-Image 2.5 和 Nano Banana 仍易产生伪影的问题。模型提供四档质量,单张 0.8 到 22 美分,原生 2K 分辨率,已在 Ideogram 平台和 API 上线,合作方包括 Picsart、Runway、Pika 和 Leonardo AI,官方称开放权重版本即将发布。
Anthropic 将 Claude for Government 开放给美国联邦和州级机构,平台自 7 月起开放测试,运行在 FedRAMP High 环境中,仅面向文职机构,因五角大楼将 Anthropic 列为供应链风险并禁用 Claude。
安全公司 Glow Security 发现 343 个组织(含 Fortune 500、金融公司和 AI 实验室)的超过 13000 张内部截图被 AI 智能体上传到公开 GitHub 仓库。
推荐理由:报道解释了智能体为绕过上传限制自建公开仓库的机制,读者可以检查自己的 CI 与截图流程是否暴露。
Ataraxos AI 以 85% 的有效胜率击败四届世界冠军 Niemeijer,结束人类在 Stratego 上对 AI 的优势。
推荐理由:研究以不到 DeepNash 约 1/500 的算力击败人类最强 Stratego 选手,读者可从中了解不完美信息博弈的低成本训练思路。
OpenAI 称 7 月拦截了一起窃取其模型思维链用于蒸馏的行动,7 月 24 至 25 日流量激增至来自超 4000 名用户的 16000 次请求,关联账号网络超 15000 个,7 月 28 日已全部封禁,OpenAI 将核心团伙与 Moonshot AI(Kimi 模型开发商)相关人员联系起来,并注明这些是未遂提取。
推荐理由:原文串起 OpenAI 的蒸馏攻击拦截和研究者的复测结果,能帮读者看清同一模型在不同云平台防护不一致的问题。
Google 发布新旗舰模型 Gemini 4 Argon,是其七个多月来首款前沿模型,Artificial Analysis 测试中得 53 分,与 GPT-6 Astra (max)、Claude Fable 5.1 持平,但仍落后 Claude Opus 5.5 的 58 分。
推荐理由:原文汇总了第三方测试与定价细节,指出 Gemini 4 Argon 缩小差距但未领先,且单价优势来自低 token 价格而非效率。
OpenAI 与 Synopsys 签署多年战略合作,共同构建名为 GPT-Synopsys 的芯片设计专用 AI 模型,目标是让模型能对芯片设计和验证进行推理并直接操作 Synopsys 的 EDA 工具,工程师负责下达设计目标并审核输出。模型运行在 OpenAI 基础设施上,客户数据加密存储且不用于训练,半导体客户的早期测试已在进行,双方将联合销售并分享收入。