卡兹克重新整理12个常用Prompt,覆盖提问、学习、决策等5类场景
作者卡兹克把自己过去几年散落在多篇文章里的Prompt重新整理成12个,按问清问题、学习、解决问题、决策、认识自己5个场景分类,全部可单独复制使用,也都不需要安装任何Skill。
按公众号阅读文章与观点
作者卡兹克把自己过去几年散落在多篇文章里的Prompt重新整理成12个,按问清问题、学习、解决问题、决策、认识自己5个场景分类,全部可单独复制使用,也都不需要安装任何Skill。
快手2026Q2总营收355.35亿元、同比微增1.4%,经调整净利润39.13亿元、同比下滑30.3%,可灵AI以8.5亿元单季收入和240%同比增速成为财报里为数不多的增量。
Anthropic 据传最快本月底前公开提交上市申请,并已秘密提交招股书、开始接触潜在投资者,同期初步营收 115 亿美元、环比增幅超 140%。OpenAI 首席财务官称计划 2027 年完成 IPO,若业务增长加速可能提前,其第二季度营收 67 亿美元、环比增长 18%。宇树科技王兴兴称具身智能泛化能力不足是通用机器人进家庭的最大瓶颈,快则两到三年、慢则五到十年或迎关键突破。
据彭博社报道,Anthropic 正加速公开上市进程,计划最早于今年8月底向 SEC 公开提交 S-1 招股说明书,目标估值1.5-2万亿美元,募资规模有望持平或超越 SpaceX 创下的750亿美元纪录,预计最快今年第四季度挂牌。
推荐理由:材料给出 Anthropic 的上市时间表、募资体量和营收运行率数据,读者可据此看清前沿模型实验室登陆公开市场的节奏与规模。
小红书 FireRed 团队发布语音生成与编辑模型 FireRedTTS3,用同一套 LLM-DiT 框架打通零样本音色克隆、自然语言声音设计和精准语音编辑,并开源代码与技术报告。
MiniMax Design 发布,是 MiniMax 围绕自研多模态模型 H3 构建的原厂 Harness。用户给出需求后由 Agent 拆解任务,调用 H3 的生成、编辑与参考控制能力执行,H3 可同时处理文本、图片、视频和音频。产品面向电商投放素材、教学视频、PV/MV 等商业内容,带 3D 导演台用于分镜试错,已有的 ComfyUI 工作流可直接接入并选择云端或本地运行。
Stripe 与 OpenRouter 同时官宣 Stripe 完成对 OpenRouter 的收购,金额据称为 70 亿美元。OpenRouter 的统计显示,过去三年 token 消耗量平均每 11 周翻倍,三年合计增长一万多倍。作者认为这一增长主要来自 AI 用户数增加,以及人均使用 AI 的宽度和深度加强。
字幕组正因版权收紧、网盘整治和AI字幕普及而加速停更、解散。文中一个两人小组用AI处理初稿,新剧播出约半小时就能成型、准确率七八成,再由人工精校;而坚持人工翻译的大型字幕组则因组员提交AI译稿,校对方的工作量翻倍。字幕组创始人小威估计,如今字幕网站上95%到98%的新字幕由AI生成,也有观众上传时直接写明“AI翻译,不喜勿看”。
Google 在 8 月 17 日的破产资产拍卖中以 1000 万美元买下 Spirit Airlines 的全部企业数据,包含约 1 亿封员工邮件和 5 亿条 Microsoft Teams 消息,竞标对手 Mercor 出价 750 万美元。
千寻智能在2026世界机器人大会上重映了WAIC的“整理客厅”Demo,Moz1将可乐放入冰箱的自主推理成功率从约80%提升至99%以上,碗放入洗碗机从约90%提升至99%以上,导航目标确认耗时降低近50%。这套长程复合任务的进步依托其数据管线、Spirit v1.6基座模型、Agent决策与导航协同等全栈能力,Moz1已进入宁德时代动力电池PACK产线,作业成功率稳定在99%以上。
Jeff Dean 在斯坦福 2026 Frontier&Pioneer Symposium 上完成离开谷歌后的首次公开访谈,复盘 Gemini 早期对 Coding 能力重视偏晚,以及 TensorFlow 未采用 Eager Execution、contrib 目录带来社区困惑等设计失误。
虎嗅 2026 Q2「向上向新 | AI 硬件趋势榜」选出 20 款上榜产品,价值约 5000 元的 Oura Ring 5 智能戒指在测评中因需下载 App、注册海外账户、绑定境外结算信用卡并每月支付 49 港币会员费,成为"最难用上"的候选产品。
微信正在灰度测试「AI 修图」,对任意图片(比如群聊中的图)底部都会出现 AI 处理标识,点击后提供美化图片、提取信息和修改图片三类功能。美化图片包含美化人脸、增加滤镜、更换背景、转换风格;提取信息包含提取文字、总结内容、翻译图片、生成文档;修改图片包含消除杂物、打马赛克、变高清。每类功能的「更多」会跳转小微。
星动纪元创始人陈建宇在 WRC 2026 提出,世界模型可能成为下一代具身智能核心范式,而非 VLA 的增强模块。他将具身大模型迭代归纳为语言模型加机器人控制、VLA、世界模型三个范式,并称团队 2024 年发表全球首个融合视频预测与动作预测的世界动作模型,比英伟达类似方案早约一年。其全直驱灵巧手每秒可点击 10 次鼠标,负载达 24 千克。
星海图联合创始人高继扬在 WRC 2026 提出,具身智能商业模式将走向以「物理世界 Token」销售为主体,整机毛利率从当前 40%-60% 降至方案订阅阶段约 20%,最终可能沦为负毛利载体。
自变量机器人(X Square Robot)在 WRC 用同一套端到端世界统一模型 WALL-B 同时驱动家庭服务与物流分拣:家庭场景可完成铲猫砂、叠衣服等数十个任务,物流产线公开直播实测分拣效率达 1816 件/小时,比 Figure AI 的 1248 件/小时快 45% 以上,部署成本约为其 30%,准确率 98%。
深圳鸿元智通以自研鸿蒙发行版 ZhihongmetaOS 和端侧智能体 ZhihongmetaAI 两大技术资产构建鸿蒙 AIOS,切入垂直行业鸿蒙 AI 赛道。公司已在警用、通信、港口三大领域落地警鸿智能网关、中移智鸿灵犀屏等终端并批量商用,同时联合公安部一所、中国移动、青岛港参与行业 OS 标准共建。其核心团队均有十余年华为多岗位经历,深圳国资已战略入股。
奕境X9开启预售24小时内小订突破21235台,成为行业首款全栈搭载华为乾崑智能汽车解决方案的第二代家庭旗舰,起售价29.98万元。该车首批搭载华为乾崑智驾ADS 5,通过WEWA 2.0架构引入安全风险场理论,将潜在碰撞风险降低50%,并全系标配896线双光路图像级激光雷达。华为乾崑智驾累计辅助驾驶里程已突破140亿公里,方案已在20多个品牌、50余款车型落地。
OpenAI 2026 年第二季度营收 67 亿美元,环比增速从一季度的 35.7% 降至 18%,营业亏损由 93 亿美元扩大到 123 亿美元。收入约六成来自 ChatGPT 消费端订阅,20 美元/月的 Plus 档长期未调价并锚定 ARPU,企业端收入虽在加速但仍处于销售体系重构阶段。
海外独角兽发文拆解 DeepSeek Harness(DSH)的三层结构,包括带本地 Web UI 的 coding agent、可替换 Agent Loop 的插件化 harness 构造框架,以及负责热重载与动态组合的 Cordis meta-framework。
陶哲轩与王虹就 AI 大量产出数学证明给出几乎相同的判断,数学界需要学习使用并理解消化这些成果。陶哲轩花数天整理一份由 AI 参与完成、经 Lean 验证的森多夫猜想证明,把 Lean 代码从约 9 万行压缩到 1.5 万行,并发现整理后的论证还能覆盖更强的 Phelps–Rodriguez 猜想。他同时公开了登记 Lean 验证结果的 Palomar,该库不宣布结果重要性,也不替代同行评审。
星海图在今年的 WRC 上用 500 平方米展台、10 组 Demo 展示 G0.5 VLA 模型驱动的机器人自主作业,覆盖前置仓、工业装配、折礼盒和双足机器人 Kengo 等场景。
OpenAI 首席财务官 Sarah Friar 在内部闭门会上确认公司将于 2027 年成为上市公司,并称 Anthropic 可能在未来几周公开招股书、最快于今年 9 月上市。
埃夫特机器人(688165.SH)与旗下启智 Openmind 共同研发智能机器人通用技术底座,由 HumanGPT 专用基础大模型、大衍数据平台、墨斗 IDE 和 Openmind OS 构成,串联真人采数据到本体执行的全链路。
openJiuwen(由华为 2012 实验室、华为云、终端、计算联合构建)上周将蜂群智能体升级为 WorkSwarm 蜂群办公智能体,同时推出跨平台、多等级的 Agent 安全沙箱 JiuwenBox。
亚利桑那州立大学助理教授魏华在 IJCAI 2026 演讲中提出,基础模型智能体的可靠性问题本质上是强化学习中的「仿真到现实」差距,跨语言场景即对应观察差距。其团队将机器人领域的域随机化技术引入大模型智能体,经提示词、动作与奖励空间扰动后,3B 参数模型在跨语言任务上表现击败 32B 模型。他还强调不确定性量化与人类在环,让机器知道何时该向人类求助。
纽约大学阿布扎比分校与阿布扎比克利夫兰诊所团队在 ACL 2026 Findings 发布首个多语言医疗错误检测、定位与纠正评测基准 MedErrBench,覆盖英语、中文、阿拉伯语和十类医疗错误。
据 TickerTrends 追踪估算,截至 8 月 10 日 Anthropic 旗下 Claude Code 的年化经常性收入(ARR)为 151.2 亿美元。
DeepSeek 发布 DeepSeek Harness 开发者预览版 v0.1,以 MIT 协议开放源代码,这是一套让 Agent 进入项目、调用工具、组合插件并完成工作流的开发框架,而非新模型。
火山引擎应用观测技术负责人钱世俊在 QCon 北京站分享了大规模 Agent 的可观测与质量保障实践,提出用统一观测底座解决业务应用、Agent 框架、大模型推理服务、云基础设施四层之间的链路断、语义断、因果断问题。团队自研采集器 OneAgent,在 200K QPS 下数据吞吐量约为 OTel Collector 的两倍,线上重载节点整体负载降低 50% 以上,部分极端场景性能提升近三倍。
模型和编码工具正让原型开发变得廉价,Codex、Claude Code 等能在一两个晚上做出可演示产品,单纯拥有功能已难构成长期优势。文章主张把顺序倒过来:先确认客户要的结果,再找最小切口嵌入其工作流,并以咖啡渠道商接入协作系统主动提醒订货为例说明。壁垒来自客户数据、行业流程与交付经验,而非易被复刻的通用功能。
招商局狮子山人工智能实验室在 WRC 2026 首次公开亮相,依托自研 LiOS 端云协同基础设施演示柔性衣物自主折叠。LiOS 采用云侧、端侧、端云协同三层架构,支持模型参数扩展至百亿规模,其图传方案实现约 30ms 单向端到端延迟,较通用中继方案加速 2.1~6.9 倍。该实验室此前以自研 VLA 模型在 ICRA 2026 LeHome Challenge 中斩获全球第一名。
量子位面向 AI 产业、AI 财经、AI 产品三个方向招聘编辑、主笔、主编,岗位均为全职,工作地点北京中关村,校招接受实习且可转正。AI 产业方向关注芯片、AI Infra、云计算,AI 财经方向关注创投与财报,AI 产品方向关注 AI 应用与硬件终端落地。简历投递至 zhaopin@qbitai.com,需附科技行业代表作品。
厦门大学、上海创智学院、上海交通大学团队提出TennisVAR,通过事件解析与战术图推理,让多模态大模型在网球视频中还原多拍战术逻辑并定位关键击球证据。团队同时发布TRACE基准,含11189个回合视频、41485次击球事件和三级战术体系。在T-F1@8上TennisVAR达73.04,GPT-5.5零样本仅37.03。
百度在 AI DAY 发布文心助手任务引擎2.0,把任务规划、智能路由与长上下文记忆串成完整链路,并称这套高阶 Agent 能力完全免费。与之配套的搜索结果页新增 GUI 交互式答案,已上线2326个交互组件,覆盖 K9 数理化高频考点。
在2026世界机器人大会上,宇树科技创始人王兴兴提出具身智能大爆发的量化临界点,即机器人能在80%左右陌生场景中通过语音指令完成80%左右的任务。他还介绍正在预研的物理AI机器人自进化路径,用前沿大模型串联论文检索、代码生成、仿真训练、真机测试与评价反馈形成闭环。演讲中他展示了语音驱动的AI动作生成、会议室整理等演示,并提到最新一代轮足复合四足机器人Unitree As2-W。
跨维智能创始人兼 CEO 贾奎在 WRC 2026「物理 AI 引领者论坛」发表《Physical Token 经济学》演讲,提出以「单位可靠物理智能」衡量机器人的智能生产成本,核心指标是获取新能力的边际成本。
新加坡南洋理工大学 AutoMan Lab 团队以 F1 级别自动驾驶方程式赛车为平台,构建了以世界模型为中心的具身智能体架构,同时预测对手交互、自车动力学与可行运动范围。
Ship it Sunday 第 11 场黑客松以「Agent,得有点品味」为主题,现场票选出 7 个获奖项目。Tasto 用视觉风格库让用户先选审美方向再生成,楚门的世界让观察者 Agent 从多个 NPC 互动中筛选值得拍的片段,AnyTaste 用两个 Agent 把情绪翻译成菜单,Tina 输入法从语音中提取记忆并回填上下文。
事件管理厂商 Rootly 官宣取消长期执行的小 PR 规则,原因是 AI 智能体已承担大部分编码工作,旧规则不再适用。Rootly 转为衡量代码变更的故障影响范围,并构建内部 AI 代码审查器,为每个 PR 输出风险评估、标准化评分、置信度评分以及按严重程度分类的问题清单,只回答这个变更若存在缺陷会破坏哪些面向用户的功能。