Anthropic 的 30 万亿美元幻想
Anthropic 被曝曾询问求职者能否接受公司股价可能归零,但同时对外描绘着极为宏大的估值蓝图。与此同时,Thomson Reuters 成为最新一家缩减 Claude 使用规模的公司。
媒体报道、公司博客与研究文章
Anthropic 被曝曾询问求职者能否接受公司股价可能归零,但同时对外描绘着极为宏大的估值蓝图。与此同时,Thomson Reuters 成为最新一家缩减 Claude 使用规模的公司。
英伟达在科隆游戏展期间宣布扩大 RTX Spark 的游戏支持范围,新增《EA SPORTS F1 25》《Apex 英雄》《纪元 117:罗马和平》《ARC Raiders》《最终决战》5 款游戏,并原生支持 EA Javelin 反作弊系统,《EA SPORTS F1 25》确认支持。
Nothing OS 5.0 已发布,基于 Android 17 打造,8 月 26 日 18:00 开启公开测试,首批仅支持 Nothing Phone (3),其正式版将于 10 月中旬推送。
OpenAI 于 8 月 25 日发布博文展示其自研 AI 推理芯片 Jalapeño,并用 SemiAnalysis 的 InferenceX 基准测试了 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型。
推荐理由:官方基准显示 Jalapeño 的推理能效比 GB300 高约 1.5 至 1.7 倍,可据此观察自研 ASIC 对算力成本结构的影响。
NVIDIA 推出面向入门级边缘 AI 的机器人计算机 Jetson Orin Nano 2,AI 推理算力达前代 2 倍,标准模式算力 78 TOPS,集成 8 核 Arm CPU 与 8GB 内存。若将性能限制在前代水平,功耗仅 15W,为前代的 60%。该产品预计 2027H1 以模组及开发套件形态上市。
消息源 @synthwavedd 爆料称 OpenAI 已完成下一代模型 Bel 的预训练,总参数量超过 10T,是 Doug 模型的直接继任者。OpenAI 希望将 Bel 打造成 GPT-6 之后的基座模型,甚至冲击 AGI 阈值模型。消息源还称,面对即将公开发布的 Astra,Anthropic 受算力所限暂无应对方案,预计今年余下大部分时间局势偏向 OpenAI。
Anthropic 宣布更新 Claude Cowork 与聊天的记忆机制,将两个系统打通实现统一管理,Cowork 在云端执行任务时可访问聊天中记住的信息,Cowork 产生的相关记忆也能在聊天中使用。
OpenAI 面向 ChatGPT Work 和 Codex 推出 Admin 管理插件,工作区管理员可直接通过对话管理用户和权限、查看活动与额度使用情况并生成报告。该插件支持添加或移除成员、调整群组设置、按角色或群组控制功能与模型访问权限,以及审批额度申请。目前插件已上线 ChatGPT Work 的 Plugins 插件目录。
Piston V 迷你主机已在 Kickstarter 众筹成功,超级早鸟价 559 美元,配备 4 英寸 720x720 圆形 IPS LCD 触控屏,搭载 AMD 锐龙 AI 9 365 处理器、16GB DDR5-5600 RAM 和 500GB M.2 SSD。
GitHub 团队分享在上线前评估 LLM 系统的实践,来自其用 LLM 降低 secret scanning 误报的工作,最终在评估所用的离线数据集上实现 95% 误报减少,同时召回率保持在预设护栏内。
Databricks 发文解析资本市场融资如何保护资产负债表回报。文章以保险公司在损失发生数月后才理赔、资产管理公司对持仓进行估值等场景切入,说明这类业务对资金与回报结构的要求。
国产动作游戏《动物朋克》在 2026 科隆游戏展开幕夜首秀直播中公布全新实机演示,展示新的战斗画面与场景。该作由《暗影火炬城》原班团队钛核工作室打造,玩家将扮演兔子雷顿率动物小队深入獭獭村。此前在 CES 2025 英伟达发布会上,双方曾发布聚焦离线 AI 技术的技术演示,首次在用户端侧实现游戏内 AI 图像生成,可创造武器、载具与涂装。
Perplexity 发布 Portable Computer,把本地模型、推理引擎、agent harness、工具沙箱和应用连接器打包成一套系统,直接运行在 NVIDIA DGX Spark 上,本地模型处理的任务不计 token 费用。
Google 在 CHI 2026 发布研究原型 AgentHands,可将 LLM 的推理输出映射为 XR 中与语音同步的手势,让 AI 智能体在 3D 空间里用手演示而非仅靠语言描述。系统包含环境感知、手势事件库、手势嵌入推理和 XR 同步执行四个模块,手势按左右手、空间锚定、时序动效等维度分类。在 N=12 的用户研究中,AgentHands 相比纯语音基线在空间指向上取得显著提升。
Stable Diffusion 开发商 Stability AI 完成 7600 万美元新融资,融资总额由此达到 2.32 亿美元。
OpenAI 封禁了一批利用 ChatGPT 生成社交媒体帖子的账号,打断了一场俄罗斯隐秘舆论行动。运营者通过 VPN 从俄罗斯访问平台,推广虚构的“International Burke Institute”,内容包括批评欧盟和德国政府的德语 Telegram 内容。该行动的传播范围仍然较小,但 OpenAI 警告其背后的基础设施可能随时间扩大规模。
LangSmith Engine 新版本在内部基准 IssueBench 上的问题检测性能提升超 2 倍,在 Terminal-Bench 等公开基准上生成修复的效果提升 25%。
OpenAI 在 Hot Chips 会议上展示了其首款自研推理芯片 Jalapeño,据 SemiAnalysis 的测试,该芯片在吞吐量和能效上超过 Nvidia 的 Blackwell 乃至 Rubin。SemiAnalysis CEO Dylan Patel 表示,第一代芯片通常不具备竞争力,但 OpenAI 这次做到了。
Anthropic 为 Claude 在聊天与 Cowork 之间打通共享记忆,用户不必再反复向 AI 交代项目、偏好等上下文。该功能让两个入口共用同一份记忆,减少重复说明背景的成本。
Meta 推出 MetaRoCE,一种专为 AI 工作负载设计、运行在通用以太网上的全新 RDMA 传输协议,将排序、路径选择与恢复下放到 NIC,把网络视为有损。
Claude 将聊天与 Claude Cowork 的记忆统一为同一份,在网页、桌面和移动端都从已积累的上下文开始工作。记忆改为在对话过程中实时添加,用户可在 Memory 设置的 Topics 列表里逐条查看、编辑或删除,并可随时暂停或重置。
推荐理由:聊天与 Cowork 共用同一份记忆并支持逐条编辑,读者可了解记忆可控性的具体设计。
Claude 官方演示了 Claude for Word 在 Microsoft Word 中的使用方式,可读取文档、处理审阅者批注、核查论断、压缩篇幅和做文案编辑,全部以可逐条批准的修订形式出现。演示中 Claude 可对照 Box 中的源文档核查论断,并调用 skill 完成最后的文案润色。视频还给出章节时间点和 Claude Academy 链接(claude.com/learn)。
Anthropic 为经济未来研究基金投入 2 亿美元,用于资助外部研究,探讨如何为 AI 带来的经济影响做准备,并公布了五个优先研究方向,包括企业层面的 AI 用工影响、职业转型培训、收入支持现代化、让劳动者分享 AI 增长收益以及公共投资的新证据。
推荐理由:Anthropic 公布该基金五个优先研究方向与 500 万至 3000 万美元的单笔资助区间,并附申请入口。
Anthropic 经济指数最新报告显示,加拿大占全球 Claude.ai 流量的 2.6%,总量排名第 8,人均使用量是按其劳动年龄人口预期值的 4 倍以上(AUI 4.4),在用量前十国家中人均仅次于美国。
Google 发布面向法律行业的 Gemini Enterprise for Legal,通过 MCP 连接器接入 iManage、DocuSign 和 Everlaw 等系统。Deloitte 等合作伙伴提供合同审查等现成 AI 智能体,所用模型与其他产品一致。Anthropic 此前已推出类似方案。
Gemini API 正式发布两个语音转写模型。Gemini 3.5 Transcribe 为非流式转写,支持 85+ 种语言检测、说话人分离、词级时间戳和最多 1。
LlamaIndex 尝试让静态嵌入模型跳过池化、改用 ColBERT 式 MaxSim 打分,在 minishlab/potion-retrieval-32M 上直接做 MaxSim 时,公开基准 mean NDCG 反从池化的 0.504 降至 0.418,仅硬精确匹配查询的 R@3 从 0.14 升至 0.38。
Anthropic 的 Compliance API 会话端点结束 beta,正式支持 Cowork 与 Claude Code 会话。本地会话端点新增返回 Claude Science 及 Excel、PowerPoint、Word、Outlook 中 Claude for Microsoft 365 会话记录,面向 Claude Enterprise 组织开放 beta。
SGLang 团队与 Qwen、NVIDIA、AMD 合作,为 Qwen 团队开源的多模态 MoE 模型 Qwen3.8-Flash-Next 提供 day-0 支持。
推荐理由:原文详解了 SGLang 对 Qwen3.8-Flash-Next 的 day-0 支持与架构实现细节,含量化检查点和实测吞吐数据,对部署选型有参考价值。
Google Search 推出 5 种家居装饰用法:AI Mode 可上传房间照片,按墙面宽度推荐沙发并生成摆放效果图;Google Lens 拍照识别复古单品并找同款;Circle to Search 在 Pixel 和三星 Galaxy S26 上圈选视频或社交帖中的壁纸找相似款。
Anthropic 在 Claude Cowork 桌面应用中内置浏览器,Claude 可自主导航网页、阅读、点击、填表,本周起向 Pro、Max 和 Team 计划推送,Enterprise 管理员即日起可开启。
推荐理由:官方说明了内置浏览器与 Claude in Chrome 的分工、登录方式和安全边界,读者可据此判断网页类任务该交给哪条路径。
Anthropic 宣布 Claude in Chrome 正式向所有付费 Claude 计划开放,Claude 可在浏览器中自主执行读取、点击、填表等操作,无需逐项确认。
推荐理由:官方给出各模型在提示词注入评测中的具体成功率数字,读者可以据此评估浏览器智能体的安全进展。
MIT 工程师提出 Extreme Event Aware(η-learning)方法,不依赖历史灾害数据即可生成统计上可能但未出现过的极端天气地图,并给出持续时间、强度和影响范围估计。
Dwarkesh Patel 与 SemiAnalysis 创始人 Dylan Patel 对谈实验室经济:今年全球新增算力约 30% 归 OpenAI 和 Anthropic,明年将升至 40-50%,按当前趋势到 2028 年底两家将控制全球大部分可用 FLOPs,因它们每兆瓦营收可达 5000 万美元以上、出价高于所有人。
2026 年 8 月,MATS Research、ELLIS Institute Tübingen 与 Max Planck Institute for Intelligent Systems 的研究者测试了 Anthropic、OpenAI 和 Google 返回给客户端的加密推理块,发现把块重放进同族更便宜的模型,就能让隐藏推理以明文输出。
推荐理由:研究揭示加密推理块可被同族小模型复述,公开 agent 日志里的密钥无法靠清洗明文保护。
EA、Embark 和 Ubisoft 等发行商宣布为今秋发布的 NVIDIA RTX Spark 提供游戏支持,包括 EA SPORTS F1 25、Apex Legends、Anno 117: Pax Romana、ARC Raiders 和 THE FINALS。
英伟达 6 月在 COMPUTEX 2026 发布的 DLSS 4.5 光线重建技术采用第二代 Transformer AI 模型,计算能力提升 35%、可处理参数量增加 20%,性能与旧版基本持平,新版 RR 模型于 8 月末推出。IT之家用 RTX 5070 Ti 实测《生化危机:安魂曲》《识质存在》《心灵杀手 2》,F 预设模型在雨天积水、玻璃反射、激光与全息投影、阴影和材质细节上均有提升。
LangChain 分享了构建智能体环境与评测任务的实践流程,分为 spec 生成和 Spec2Task 两步,产物是 Harbor 格式的任务与环境。第一步用 trace、代码或人工输入写出任务 spec,第二步让编码 Agent 依据 spec 生成任务,其中跨任务共享的知识、脚本和定义被集中放在 world spec 中。
OpenWiki 新增声明运行时,把 wiki 中的事实声明与代码证据按版本绑定,代码变动后把相关声明标记为陈旧,并在后续更新中重新核验或连同正文一起修正。作者给出的评测中,陈旧声明占比从基线的 3.5% 降至 0.5%,幻觉声明从 0.7% 降至 0%,失效检测为无模型调用的确定性检查,更新成本随代码改动量而非声明总量增长。
岚图汽车宣布岚图泰山 X8、FREE+ 乾崑版、知音乾崑版开启华为乾崑智驾 ADS 5 大版本 OTA 升级,8 月 24 日起陆续推送。岚图追光 S 上市即搭载 ADS 5,岚图泰山、追光 L、梦想家乾崑版已完成测试,待工信部审批后 OTA。ADS V5.0 新增后向主动防被撞辅助、AR-HUD 雨雾安全预警、随时随地 NCA、RCA 漫游巡航辅助、车位级充电导航与守位泊车。