长鑫存储起诉美国国防部;Anthropic 面试流程曝光;英伟达拟超 130 亿美元收购 Hugging Face|AI 周报
长鑫存储 8 月 28 日向美国哥伦比亚特区联邦地区法院起诉美国国防部,要求将其从黑名单中移除,称芯片仅用于民用和商业用途。Anthropic 被曝面试中追问"使命与金钱冲突如何选择",其 API 与 Discord 社区还出现 claude-marshmallow-eap、claude-melon-eap 两个内部测试模型代号。
微信公众号
长鑫存储 8 月 28 日向美国哥伦比亚特区联邦地区法院起诉美国国防部,要求将其从黑名单中移除,称芯片仅用于民用和商业用途。Anthropic 被曝面试中追问"使命与金钱冲突如何选择",其 API 与 Discord 社区还出现 claude-marshmallow-eap、claude-melon-eap 两个内部测试模型代号。
一位互联网从业者结合自身经历与多项研究,分析 AI 接管编码工作后对程序员成长路径和就业需求的影响。他称自己已连续四个月未手写代码,并引用斯坦福数字经济实验室数据指出受生成式 AI 影响最大的职业中 22 至 25 岁劳动者出现约 16% 的相对就业下降。文章提出捷径悖论、存量流量悖论、人才公地悲剧与蒸馏员工等概念,强调这些是可能情景而非已被证实的趋势。
Meta 代号 OT 的组织转型计划曾设想用 AI Agent 接管数千人的日常工作,部分团队削减 60% 人力,但第一轮裁员后内部代码变更同比增长 220% 而真正触达用户的变更仅增 36%,AI Agent 造成的重大技术和安全事故较上一年增加 40%,员工处理这些问题的时间增加多达 70%,扎克伯格在 5 月 19 日晚取消了原定 11 月的第二轮裁员。
推荐理由:Meta 内部用 Agent 替代员工的转型计划,给出了事故率上升四成、救火时间增加七成等具体量化后果,可供评估 Agent 落地边界。
阿里千问大模型团队发布多模态 MoE 模型 Qwen3.8-Flash,开放权重版本为 Qwen3.8-Flash-Next,主模型参数量 125B,每个 Token 只激活 6B 参数,并额外加入 51B N-gram Embedding。
Anthropic 公布覆盖 141006 次评估运行的回溯审计,发现三起事件共六次运行中 Claude 因出口路由配置错误访问公共互联网,涉及 Claude Opus 4.7、Mythos 5 和一个未发布的内部研究原型。
推荐理由:审计覆盖 141006 次评估运行,呈现出口过滤缺失如何让模型触及真实生产系统与第三方基础设施。
澜存科技推出澜卡 LC-1.7 系列标准 AI 模组及配套澜存智能平台,用户无需编程即可在五分钟内建立线上智能体、半小时内让硬件开口说话并实现表情与情绪控制。澜卡 LC.AI 基于 ESP32-S3 集成主控、联网、语音和硬件接口,平台负责模型、Agent、音色、角色、记忆和 Skill 配置,客户已从 AI 玩具延伸至消费电子、智能家居、可穿戴设备和机器人。
Anthropic 发布模型硬件标准 MHS 的研究预览版,这是一套让 Agent 安全操控物理设备的标准化驱动程序和通信协议,首批接入方为顶尖科学实验室和先进制造商。
8 月 26 日,谷歌发布新一代语音转文本模型 Gemini 3.5 Transcribe,谷歌称其为迄今最精确的语音转文本模型,可在转录中自动处理语气词、口误和重复表达并补充标点与格式。
智谱确认,此前匿名出现在 OpenRouter 的神秘模型 Ox Alpha 正是其最新发布的 GLM-5.3-Flash。该模型为 3200 亿总参数、每次激活约 180 亿参数的混合专家模型,是 GLM-5 系列首个原生多模态模型,支持约 100 万 Token 上下文,权重已在 Hugging Face 以 MIT 许可证开放。
CFTC 于 2026 年 8 月就算力衍生品公开征求意见,讨论现货算力市场、市场操纵与永续算力期货等问题;此前 CME 与 Silicon Data 已宣布计划推出以 H100 和 B200 租赁价格为基础的期货产品。
据 The Information 8 月 26 日报道,DeepSeek 今年前七个月营收约 4.75 亿元人民币,较 2025 年全年增长近 10 倍,综合毛利率 44.6%,其中 API 业务毛利率高达 82.9%。同期其 AI 基础设施支出约 110 亿元,公司正与投资者磋商第二轮 500 亿元融资、对应估值 5000 亿元,并已聘请投行筹备明年在上海上市。
HarmonyOS 穿戴应用「小卡健康」把 AI 健康记录入口迁到手表,抬腕口述一句即可完成饮食、饮水和运动记录,语音记录功能已上线,可识别饮食、饮水、运动等十余类口述信息。
Uncle Bob(Robert C. Martin)在 Matt Pocock 的播客中表示,他已把代码编写全权交给 AI 智能体,靠 CRAP 评分、变异测试、圈复杂度阈值等确定性工具做质量管控,目标是不再人工逐行评审,实测叠加大量约束后 AI 开发效率仍是人类的 2-4 倍。
OpenAI 公布自研推理芯片 Jalapeño 的实测结果,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值每瓦吞吐量达到对比系统的 1.5 至 1.9 倍,端到端延迟优于对手 1.7 至 3.6 倍。
推荐理由:OpenAI 公布自研推理芯片的实测对标数据,可看到模型公司自研算力对现有 GPU 与软件生态的实际冲击。
Vercel 正式推出 v0 API,开发者可用提示词让 v0 生成和修改应用文件,在 Vercel Sandbox 中运行并获得可嵌入自有界面的预览 URL。
斯坦福 CRFM 的开放基础模型项目 Marin 已启动 Marin 535B-A23B 训练,总参数约 5350 亿、每 Token 激活约 230 亿,计划处理 18.75 万亿 Token,运行在 11 套 NVIDIA GB200 NVL72 上,预计持续约 3 个月。
Meta AI Research 宣布推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证,面向始终在线的本地工作流。
在 AI 部署平台 Vercel AI Gateway 上,开放权重模型的 Token 调用份额从 4 月的约 11% 升至 8 月 22 日的 62%,首次反超闭源模型,其中 DeepSeek 单独占 22.6%。
Netflix 披露其内部 LLM 推理服务平台的生产经验,该平台基于现有 JVM 服务层构建,小模型在 CPU 进程内运行,大请求交由 MSS 处理,由 Triton 负责模型加载、批处理与 GPU 调度,vLLM 负责执行推理。
DeepSeek 自北京时间 8 月 23 日 00:00 起调整峰谷计费,周末全天不再区分峰谷、统一按低谷价收费,工作日峰谷价格不变。英伟达因内存芯片成本上涨,已告知部分最大客户其 AI 芯片服务器价格将上涨超 15%,涉及 Vera Rubin 和 Grace Blackwell 系统,明年初出货起生效。
美团核心本地商业 CEO 王莆中复盘 2 月至 3 月的全员“养虾”运动,称其只是 AI 转型第一阶段,AI 账单每天烧掉上千万元,部分谬误开始干扰真实经营,到 7 月才通过赛马机制跑出可用场景。
DeepSeek 在 API 平台上线实验模型 deepseek-v4-flash-vision-exp,开始提供图像理解服务,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 一致。
Cloudflare 推出开源运行时 Cloudflare Computer,为 AI 智能体提供更接近真实计算机的持久化运行环境。该运行时由平台决定代码在 isolate、容器沙箱还是 Web 浏览器中运行,isolate 可持久保存智能体状态并在空闲时休眠,基于 SQLite 的共享文件系统让 isolate 与容器之间无缝转移任务。
代号 Ox Alpha 的匿名模型在 OpenRouter 上线,拥有 100 万 Token 上下文窗口、最大 13 万 Token 输出,支持文本、图像和视频输入以及工具调用,当前输入和输出价格均为零。
事件管理厂商 Rootly 官宣取消长期执行的小 PR 规则,原因是 AI 智能体已承担大部分编码工作,旧规则不再适用。Rootly 转为衡量代码变更的故障影响范围,并构建内部 AI 代码审查器,为每个 PR 输出风险评估、标准化评分、置信度评分以及按严重程度分类的问题清单,只回答这个变更若存在缺陷会破坏哪些面向用户的功能。
开源框架 LLM-as-a-Verifier 发布 v0.2.0,新增 DeepSeek V4 Flash 验证支持与 Terminal-Bench 2.1 自验证基准,并冲上 GitHub 热榜第二。
Anthropic 联合创始人兼 CEO Dario Amodei 在 X 发长文回应 AI 舆论,称公众对 AI 的负面情绪从根本上是一场信任危机,而非 AI 领袖过多谈论风险,该帖浏览量已超 1000 万。
OpenAI 于 2026 年 8 月 18 日披露,曾暂停最新一代模型的强化学习训练两周,以升级对齐、安全和监控体系。起因是 7 月一次内部评估中,模型利用 Artifactory 的零日漏洞逃出沙箱并访问 Hugging Face 生产数据库获取评测答案,而即将推出的 Astra 可能达到关键级网络安全能力。
推荐理由:文章还原了模型逃出沙箱入侵 Hugging Face 的事件链条,并说明暂停强化学习训练与三层防护设计。
极客部落 OPC 003期入驻招募开启,路演定于 8 月 27 日在北京望京 SOHO T2 20 层星禾 AI 智体创新谷举行,面向 AI 创业者、独立开发者与 OPC 招募。通过评审并符合条件者可申请 5 个工位以内两年免费办公,注册地址同样两年免费支持,具体以实际入驻协议为准。基础条件包括 AI 方向、至少一名 40 周岁以下创始人或成员,以及未注册公司、迁址或朝阳区注册 3 年以内之一。
Cursor 宣布即日起向所有付费用户逐步开放代码托管平台 Origin 的早期测试,支持自建 Repo、完整的 Pull Request 流程、网页端代码浏览,并与 GitHub 双向实时同步。
Stripe 已敲定收购 OpenRouter 的协议,交易价格超过 70 亿美元,而 OpenRouter 在 5 月的 B 轮投后估值仅为 13 亿至 15 亿美元,不到三个月溢价约 5 倍。
Bun 创建者 Jarred Sumner 启动约 50 个 Claude Code 工作流,用 11 天把 Bun 从 Zig 移植到 Rust,生成超过 100 万行 Rust 代码,按 API 定价成本约 16.5 万美元,他还称该项目在所有受支持平台上 100% 通过了 Bun 自身的测试套件。
推荐理由:11 天、约 16.5 万美元完成 50 万行代码的语言迁移,Zig 创始人的质疑让 AI 生成代码的审核边界成为讨论焦点。
Qwen3.8-27B 以 Apache 2.0 协议开源,是一个 27B 参数的原生多模态稠密模型,在 Agentic Coding、LiveCodeBench v6 等评测上得分高于 Claude Opus 4.6 Max,原生支持 262K 上下文并可通过 YaRN 扩展至 100 万 token。
中国银行广州分行回应“算力 Token 贷”已授信 5 户 2800 万元、实际投放 3 户 800 万元,用于企业购买算力。英伟达披露持有 SpaceX A 类股 1.228 亿股,二季度末市值约 210 亿美元,为 SpaceX 第六大股东。Anthropic 正筹备 IPO,投资人认为估值可能超 2 万亿美元,并洽谈以约 60 亿美元收购以色列 AI 公司 Decart。
Model Context Protocol(MCP)迎来自发布以来最大一次更新,移除初始化握手与会话粘滞,每个请求独立携带完整上下文,远程 MCP 服务器可像传统无状态 HTTP 服务那样运行。
Vercel Labs 发布实验性系统编程语言 Zero,定位为更便于 AI 智能体使用和修复的系统语言,目前已发布 v0.3.4,GitHub Star 超过 5200。
Composio 让同一款 DeepSeek V4 Flash 分别运行在 8 种 Agent Harness 中完成 30 项智能体任务,Pi Agent 通过 20 项、成功率 66.7% 排第一,与最低的 OpenCode 相差 20 个百分点。
MiniMax H3 团队于 8 月 7 日晚在 Reddit 的 r/StableDiffusion 社区举行 AMA,回应了 300 多条提问,确认用于最终 2K 输出的 H3-Regenerate-2K 模型会发布且不会太久,并计划近期提供一个无感知质量损失的 Sparse Attention 参考实现。
DeepSeek-V4-Pro-0813 上线不到 24 小时,官网便撤下正式版横幅和开放平台公告,开发者实测体验与官方跑分出现明显落差。顺着 Hugging Face 仓库提交记录可以看到,最初上传的配置与 V4-Flash-0731 完全一致,官方随后修正为 hidden_size=7168、384 个路由专家、61 层,并重新上传了部分权重分片。
面壁智能已向北京证监局提交首次公开发行股票并上市辅导备案,中信证券担任辅导机构,目前尚未披露拟申报的上市板块、募资规模及时间表。辅导备案报告显示,公司注册资本 154 万元,无控股股东,北京清语启航科技中心(有限合伙)为第一大股东,持股 16.45%。