Anthropic 发布 AI Native 全流程实践指南
Anthropic 应用 AI 团队发布 AI 原生 SDLC 实践指南,覆盖 Plan、Design、Build、Test、Deploy、Maintain 六个阶段,每个阶段都给出实施步骤、治理考量和度量指标。
按公众号阅读文章与观点
Anthropic 应用 AI 团队发布 AI 原生 SDLC 实践指南,覆盖 Plan、Design、Build、Test、Deploy、Maintain 六个阶段,每个阶段都给出实施步骤、治理考量和度量指标。
OpenAI 公布自研推理芯片 Jalapeño 的首批跑分,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值吞吐位置每瓦完成的 AI 工作提高约 1.5~1.9 倍,端到端延迟降低约 1.7~3.6 倍;芯片额定功耗为 700W,这批负载中的持续功耗没有超过 550W。
AI科技评论复盘上周Anthropic与Moderna先后公布的两项AI制药进展,追问AI制药的估值锚点应该设在哪里。
Anthropic 于 8 月 21 日发布博客《The AI-Native SDLC Playbook》(作者 Louis Claxton),本文是赛博禅心编译版本的转载。
穹彻智能发布具身智能预训练模型 Noe-0,其预训练与后训练全链路均采用无本体采集数据,不依赖传统遥操作数据即可完成真实机器人任务执行。数据来自超 50 个城市、数十万小时、数十万种任务类型的真实操作记录,配套采集设备 RoboPocket 与 AI-native Data Engine 支撑数据生产。
HarmonyOS 穿戴应用「小卡健康」把 AI 健康记录入口迁到手表,抬腕口述一句即可完成饮食、饮水和运动记录,语音记录功能已上线,可识别饮食、饮水、运动等十余类口述信息。
Uncle Bob(Robert C. Martin)在 Matt Pocock 的播客中表示,他已把代码编写全权交给 AI 智能体,靠 CRAP 评分、变异测试、圈复杂度阈值等确定性工具做质量管控,目标是不再人工逐行评审,实测叠加大量约束后 AI 开发效率仍是人类的 2-4 倍。
小米在8月24日玄戒技术沟通会上发布三款芯片:玄戒O3提供200 TOPS NPU算力,玄戒O100以1.22TB/s带宽突破端侧大模型"内存墙",玄戒D100为3nm智驾芯片、最高支持160GB内存和本地200B参数模型。O3将于9月随小米18 Fold上市,O100和D100计划2027年商用。小米证明了AI能跑得更快更省电,但未回答这些芯片能让手机变成什么,也未给出AI手机的产品定义。
虎嗅智库将于9月4日在深圳举办“Agent下车间”华南专场闭门会,邀请12位制造企业与工业技术一线负责人,讨论单点工具如何接入生产系统形成业务闭环、柔性排产如何应对插单与供应商数据断点,以及智能体增多后的成本、权限与责任管理。活动规模控制在15人以内,80%以上为制造业甲方负责人,已确认参会的包括周大福、万和新电气、安克创新、卡姿兰、华润三九、中用科技等企业的CIO及供应链、IT/AI业务负责人。
Cloudflare 推出 Cloudflare Agents 的首个组件 Agent Tracing,提供集中查看已部署 Agent 会话的统一 Dashboard,在 Workers Tracing 基础上新增 Agent 调用、模型调用、工具执行和审批等 Span,并把模型信息和 Token 使用量作为元数据附加其中。
亚马逊云科技为 DynamoDB 推出原生向量搜索,开发者可把嵌入向量与应用数据存放在同一张表,并直接运行近似最近邻查询,无需单独的向量数据库。该功能使用新的索引类型,支持自选嵌入模型、4096 个维度、欧几里得距离与余弦距离和点积距离函数以及内联过滤,并随数据增长横向扩展。费用在原有表费用之外按写入索引、搜索时处理与存储三类按 GB 计费,向量索引已在 DynamoDB 所有服务区域开放。
HarmonyOS 穿戴应用「小卡健康」由 3 名 00 后女生开发者打造,把健康记录入口迁到手表:抬腕口述一句即可完成饮食、饮水、运动记录,语音记录功能已上线。
斯坦福大学基础模型研究中心 CRFM 的开放基础模型项目 Marin 于上周启动 Marin 535B-A23B 训练,总参数 5350 亿、每 Token 激活约 230 亿,计划处理 18.75 万亿 Token,运行在 11 套 NVIDIA GB200 NVL72 上,预计持续约 3 个月。
云蝶科技在 WRC 世界机器人大会发布系统级具身大脑 RoboForge 与任务型本体 WING,其团队两篇论文 POLIA 与 Strat-Reasoner 同期发表于 ICML 2026。
AIVA总裁李博在2026世界机器人大会火山引擎具身智能论坛上提出,物理AI的竞争关键不在模型与硬件,而在能否与人建立真实信任,AI汽车比人形机器人更具落地优势。AIVA以“AI定义汽车,先有AI再有车”为理念,与火山引擎从产品定义阶段协同打造AI原生车型,其HMI团队用ArkClaw生成视频Demo、研发团队用Trae重构测试链路。首款车型AIVA ME7将于2026年年内亮相。
OpenAI 公布自研推理芯片 Jalapeño 的实测结果,在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 上,峰值每瓦吞吐量达到对比系统的 1.5 至 1.9 倍,端到端延迟优于对手 1.7 至 3.6 倍。
推荐理由:OpenAI 公布自研推理芯片的实测对标数据,可看到模型公司自研算力对现有 GPU 与软件生态的实际冲击。
臻效智能 CEO 孙鹏飞在虎嗅访谈中提出,具身智能当下的千台订单、亿元合同与联合实验室多由行业关系、产业资源和地方示范项目撑起,并不等于市场验证成立。他给出识别假 PMF 的四个追问,包括订单从哪里来、究竟谁在付钱、客户验收是否较真、一个试点能否扩成连续订单。他判断未来会形成通用“大脑”与行业落地两层结构,价值更多沉在后者,并提醒“设备越多数据越多模型越强”的数据飞轮在工业场景中可能是伪命题。
乐聚机器人推出面向工业场景的垂域具身智能模型 KUAVO VLA,以通用 VLA 基础模型为起点,用 600+ 小时 KUAVO 同构型真机数据进行中训练,沉淀本体适配、基础操作与 100 个工业共性能力。在 25 项任务评测中,该模型整体任务成功率 48.27%、过程分 74.51%,两项均列第一,较基模 Lingbot-VLA 2.0 分别提升 32% 和 32.45%,部分场景提效约一倍。
Loopit 创始人陈炜鹏在 Founder Park 的访谈中介绍,Loopit 上线半年累计创作近 1500 万个作品、游玩超 20 亿次,团队已发布首个互动世界模型 Zing-0.5。
2026世界人形机器人运动会8月22日晚在北京国家速滑馆开幕,来自16个国家的2056台机器人参赛,8月26日闭幕。百米最快成绩从去年首届的21.50秒提升到荣耀“闪电”测试中的9.32秒,天工Ultra以7.97米夺得跳远冠军,并跳出2.8843米的原地跳高。
Skild AI 发布机器人基础模型 S1,主打上下文学习,不需要后训练或微调、模型权重不变,只看一段人类示范视频就能完成煎饼、冲泡咖啡、给植物换盆和设备组装等长程任务,上下文学习任务时长最长 10 分钟。
至知创新研究院 UBio 团队发布 UBio-MolFM v1.5,这是一种以量子化学精度对生物大分子做分子动力学模拟的机器学习原子间势函数,模型权重、代码与技术报告均已开源。
明星 AI 实验室 Agnes 发布 Agnes Video 2.5 系列并上线 Pavo 创作平台,其中 Agnes Video 2.5 Flash 在无限画布中生成视频积分消耗为 0,即免费使用。
这份中文编译出自 Anthropic 官方博客《The AI-Native SDLC Playbook》,按规划、设计、构建、测试、部署、运维六个阶段给出可复用的 Play,并保留原文的代码示例与配置样板,包括 CLAUDE.md、.claude/skills 下的 skill、hooks、REVIEW.md 和 eval 流水线。
Anthropic 的 Claude Code 团队回应了长期拒绝原生支持 AGENTS.md 的争议,称正在提高可定制性,未来将允许开发者更方便地使用 AGENTS.md 或修改其他系统提示词。
华为诺亚方舟实验室发布论文提出 RoboHarness 系统,将 VLA、WAM、RL 策略、TAMP 等独立控制系统封装为可被统一调度的 agentic skills,由 Coding Agent 负责高层决策,不重训底层策略。
上海交通大学联合 Sema 研究团队推出 SemaPLC,将 AI Agent 与 PLC 编译、运行、变量读写、行为验证、过程仿真等工具链打通,并在浏览器 Web IDE 中完成需求到仿真的全流程。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均在北京中关村全职,校招应届生可实习并转正。产业方向关注芯片、AI Infra、云计算,财经方向关注创投与财报,产品方向关注 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附代表作品。
一段10分钟一镜到底的Demo显示,宇树G1与智元远征A3两款不同品牌、不同架构的机器人共用同一套神秘具身模型,在15m²出租屋内自主完成擦玻璃、收纳、协作递围巾等长时序家务。模型支持任务随时打断与断点续做,宇树G1够不到高处时自主搬箱、用脚踢箱垫高,据称仅用几十小时视频数据训练。
OpenAI 发布自研大语言模型推理 ASIC,每瓦吞吐量全面超过英伟达 Blackwell,甚至超过采用 HBM4 的 Rubin,实测 DeepSeek R1 超 700 token/s/用户、GPT OSS 超 1400 token/s/用户、Kimi 2.5 接近 700 token/s/用户。
苹果更新桌面 Mac 产品线,推出新款 Mac mini 与 Mac Studio,前者首发 2 纳米制程的 M6 芯片并提供 M5 Pro 版本,后者搭载 M5 Max 或 M5 Ultra。
AIVA 总裁李博在 2026 世界机器人大会火山引擎具身智能论坛上提出,Physical AI 的载体不止人形,汽车是落地更快的路径。AIVA 由赛豆科技推出,主张“AI定义汽车,先有AI,再有车”,已公开“22度”场景与“灵动光眸”互动屏幕设计,并与火山引擎在硬件选型、产品需求阶段深度共创。AIVA ME7 将在今年年内亮相。
Harvey 于 8 月 20 日发布首套自研法律模型 Tenet,底座采用月之暗面 7 月开放权重的 Kimi K3,目前处于研究预览阶段。训练投入约 150 张 NVIDIA B300 和约 1750 个法律智能体任务环境,历时约两个月,在 LAB 保留集上 all-pass 率从约 11% 提高到 19.7%。
第四届 GLOW 2026 于 2026 年 8 月在德国不来梅作为 IJCAI-ECAI 2026 专题 Workshop 举行,由北京航空航天大学、中关村实验室、香港中文大学等机构学者组织。会议围绕未标注数据学习、大模型极低比特量化、跨领域任务执行、大模型评测与 Agentic RL 等方向,讨论有限资源条件下人工智能如何跨越训练环境边界。
IJCAI 2026 收录的 AC²-VLA 提出用动作上下文而非视觉复杂度来调度 VLA 模型的计算,通过认知缓存复用、视觉 token 剪枝和层跳过三个机制统一由 router 调度。
OpenAI 在 Hot Chips 2026 大会上公开自研推理芯片小辣椒,SemiAnalysis 受邀到其实验室用 InferenceX 实测,结论是这颗第一代芯片在多个开源模型上击败了能测到的英伟达、AMD 和谷歌芯片。
推荐理由:文章给出 SemiAnalysis 现场实测的能效与时延数据,并交代了单 token 预测等对比口径的限制。
苹果发布首款2nm制程芯片M6及定位更强的M5 Ultra,并推出搭载这些芯片的新款Mac mini与Mac Studio,国行售价分别6999元起和19999元起。
加拿大宣布自9月8日起对价值200亿美元的约700种美国商品加征15%、25%或50%的反制关税,并推出75亿加元企业员工支持方案。豆包发布面向生产力场景的Agent产品与品牌“豆包工作”,支持文档、表格、PPT、图片、视频等生成编辑,并赠送30天免费订阅权益。道路交通安全法修订草案新增“自动驾驶汽车的特别规定”专章,首次在国家法律层面明确自动驾驶汽车法律地位与违法责任归属。
小菜园 CIO 高恒入职十个月,为全国 800 家门店装上 13~16 块岗位屏幕和 KDS 系统,并将技术团队从 30 多人砍到 9 人,全部技术体系通过 AI 完成。销售预估系统 7 月偏差率降至 9%,炒菜机器人已进入近 300 家门店,88VIP 付费会员达 151 万。2026 年半年报显示营收 29.03 亿、同比增长 7%,净利润 2.9 亿、同比下滑 24.3%。
OpenAI 公布首款自研推理芯片 Jalapeño 的测试结果,称在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三个模型上,其能效与延迟表现优于 NVIDIA GB200、GB300 系统。