大模型应用开发实战营:覆盖 RAG、Agent、微调三大核心
某机构联合AI实战派专家陈旸推出「大模型应用开发实战营」,以2节直播课覆盖RAG、Agent、微调三大核心,并拆解支小助、知乎直答等案例。课程已开班58期、服务20000+学员,0元报名限100人,完课附赠面试题库、企业内推与直聘权益。
微信公众号
某机构联合AI实战派专家陈旸推出「大模型应用开发实战营」,以2节直播课覆盖RAG、Agent、微调三大核心,并拆解支小助、知乎直答等案例。课程已开班58期、服务20000+学员,0元报名限100人,完课附赠面试题库、企业内推与直聘权益。
微软CEO Satya Nadella 发长文提出「Token资本」概念,认为企业必须同时构建人力资本与 Token 资本,在模型之上打造能自我进化的学习闭环,并牢牢掌控自身知识产权。他强调企业应能随时替换底层通用大模型而不丢失沉淀的专业判断,并主张构建让价值广泛流向各行业的前沿生态系统,而非让少数 AI 模型通吃一切。
AI 短剧平台 AniShort 向全量用户开放零排队绿色通道,可直接调用官方直连的满血 Seedance 2.0,官方承诺假一罚十。实测 2 分钟短剧(不含剧本打磨)生成约需 15 分钟,图片与视频素材 100% 在平台内生成,并推出 3D 世界加 3D 导演台功能。平台同步进行 300 万现金等值积分补贴,Seedance 2.0 720P 低至 8 毛,积分最高送 62.5%。
谷歌DeepMind 发布《From AGI to ASI》报告,由 Shane Legg、Marcus Hutter 等撰写,将 ASI 定义为在几乎所有任务和领域上超越数万名专家协作十年的人类团队。报告提出扩大算力与数据、算法范式转变、递归自我改进、多智能体协调四条可能路径,并列出数据墙、抽象壁垒、具身瓶颈等摩擦因素。
Claude Code 团队成员 Thariq 用 Claude Code 调 Claude Fable 5,剪完了介绍 Fable 5 的发布视频,全程没有打开任何视频剪辑软件。
Loop 是让 AI 持续迭代直到目标达成的递归结构,由自动调度、工作树隔离、Skill、连接器与子 Agent 五个模块加一个记忆机制组成,Claude Code 和 Codex 都已具备。
SpaceX 公布第一代 AI 卫星 AI1,峰值计算负载 150 kW、平均 120 kW,翼展 70 米,配备 150 kW 太阳能阵列和 110 m² 可展开液体散热器。
Anthropic 发布 Claude Fable 5 和 Claude Mythos 5,两者采用同一底层模型,主要差异在安全护栏,Fable 5 面向所有用户开放。
推荐理由:文中列出两款新模型的能力基准、定价与安全护栏差异,读者可据此了解其开放范围与限制。
Anthropic 发布 Claude Code 一周年对谈,负责人 Boris Cherny 与产品负责人 Cat Wu 回顾一年间内部经历两次认知跃迁,从与 Agent 对话让它写代码,转向用例程调度 Agent。
Anthropic 发布关于生物 Agent 的研究,认为瓶颈不在模型推理能力,而在于生物数据基础设施没有为 Agent 做好准备。
苹果在 WWDC26 上把 Siri 从底层重做,推出新版 Siri AI,其 Apple Intelligence 基座模型与谷歌合作、基于 Gemini 系列,能理解个人情境并跨 App 操作,还配有独立 App。
美图设计室推出全新 AI 拆分图层功能,可自动识别画面元素并一键拆分为背景层、主体层、文字层和装饰层,用户能单独换背景、改价格文案、移动主体或删除杂物,无需手动抠图。上传任意图片后点击「AI 拆分图层」约 3 秒自动分层,支持导出高清图或透明底图并对接 PS 精修,零基础可免费使用。
据FT报道,OpenAI正筹备ChatGPT自2022年上线以来最大规模改版,将其从聊天机器人升级为集成编程工具Codex与AI智能体的超级应用,改版未来几周内从网页端和手机App界面开始。
用 DeepSeek V4 pro 和 Claude Sonnet 4.6 分别试写了今年高考作文,覆盖全国卷一、卷二、北京卷和上海卷。北京卷含微写作三选一(不超过150字)与大作文"做规划与下功夫""含英咀华"等题,上海卷要求不少于800字。文末邀请读者投票。
谷歌研究院与 Google Cloud 联合发布 Agentic RAG 框架,在事实性数据集上准确率相比标准 RAG 最高提升 34%。框架核心是充分上下文智能体,能在信息不足时指出缺失内容并驱动查询改写与迭代检索,还支持跨语料库路由。
谷歌为 Gemma 4 全系发布 Q4_0 格式的量化感知训练(QAT)检查点,其中 E2B 纯文本模型内存占用可低于 1GB,12B-QAT 可在 16G 内存设备上运行。
OpenAI 发布名为 Dreaming 的记忆系统,用于提升 ChatGPT 的记忆合成能力,美区 Plus 和 Pro 用户即日起可体验,免费用户和 Go 用户将在接下来几周内陆续开放。该系统会在后台持续读取历史对话并自动整理更新记忆状态,OpenAI 还将其服务免费用户所需的算力成本降低了约 5 倍,同时为 Plus 和 Pro 用户扩大了记忆容量。
Anthropic 公开内部研究数据,称 AI 正接管越来越多开发工作:2026 年第二季度其工程师每天合并的代码量是 2024 年的 8 倍,其中超过 80% 由 Claude 完成。
Lovart 年中大促开启,最低 43 折,为 2026 年全年最低价窗口,活动结束后恢复原价。作者以年费用户身份分享了 Brand Kit、Font Generator、Create Skill 和 Export PSD 四个常用功能,其中 Brand Kit 可存储设计风格并通过 @ 调用,Font Generator 约三分钟生成字体并自动存入 My Fonts。
Anthropic 分享了用 Claude 承接约 95% 内部业务数据分析请求、整体准确率约 95% 的方法。核心是分层数据技术栈和 Skill,用于应对概念与字段映射模糊、数据过期和检索失败三类失败模式;不加 Skill 时评测准确率不超过 21%,加入后稳定在 95% 以上。
谷歌DeepMind发布并开源Gemma 4 12B,这是一个统一、无编码器的多模态模型,只需16GB显存或统一内存即可在消费级笔记本上运行。它在标准评测基准上的成绩接近26B MoE模型,总内存占用不到后者一半,采用Apache 2.0协议,预训练与指令微调权重可从Hugging Face和Kaggle下载。
推荐理由:原文介绍了无编码器多模态架构如何降低延迟和内存占用,并列出16GB笔记本可用的本地运行入口。
Anthropic 推出命令行工具 ant,可在终端直接调用 Claude API、管理 Agent、上传文件并跑自动化任务。
OpenAI 为 Codex 推出三项更新,包括 6 个职位专属插件、网站生成功能 Sites 和精准标注功能。6 个插件共包含 62 款主流应用和 110 项技能,覆盖数据分析、创意生产、销售、产品设计、公开股权投资和投资银行等角色,安装即用无需写代码。
图灵奖得主 Richard Sutton 在 SAIR 人工智能科学研讨会视频中指出,通过监督学习训练的生成式 AI 只能做到输出新颖或优质二者之一,无法同时兼顾,因此从根本上无法做出真正的科学发现。他认为生成式 AI 缺失的关键是「评估」这一步,没有评估就没有选择性保留,也就没有发现与创造力。Sutton 主张让 AI 与人类共享目标,使其能创造、评估、发现,从而实现创造力与发现的完全自动化。
黄仁勋在中国台北GTC大会上称算力就是收入,并宣布NVIDIA Vera Rubin全面量产、RTX Spark PC芯片和Nemotron 3 Ultra模型。
Agnes AI 宣布自6月1日起,旗下文本、图像、视频全模态模型 API 面向全球开发者无限期免费开放,无需绑定信用卡。文本模型 Agnes-2.0-Flash 此前定价为输入 0.03 刀/1M tokens、输出 0.15 刀/1M tokens,图像模型为 3 刀/100 张,视频模型为 0.3 刀/分钟,现均降至免费,视频支持原生 720P/1080P 输出。
AI寒武纪分享用Codex把截图或设计稿转成前端代码的实践,核心是OpenAI官方提供的一段起始提示词。该提示词要求复用项目已有的组件与设计变量、贴近截图的间距和层级关系,并在桌面端和移动端做响应式适配,验收时让Codex用Playwright打开真实浏览器与参考截图逐一比对,反复迭代直到吻合。
ElevenLabs 正式发布音乐生成大模型 Music v2,人声表现、乐器演奏和编曲水平在所有流派全面提升,并支持单曲内流派无缝切换、密集歌词与快嘴说唱,以及选定片段的局部重绘。
Anthropic 完成 H 轮融资,筹集 650 亿美元,投后估值达 9650 亿美元,领投方为 Altimeter、Dragoneer、Greenoaks 和 Sequoia,黑石、富达、淡马锡、General Catalyst 等跟投,三星、美光、SK海力士作为芯片供应链战略合作方加入。
推荐理由:这轮融资把年化营收、算力协议和投资方名单一并披露,可看到前沿模型公司的资本与算力绑定关系。
Anthropic 发布 Claude Opus 4.8,同时为 claude.ai 加入努力值控制,并在 Claude Code 中推出研究预览阶段的动态工作流。
推荐理由:Opus 4.8 的诚实度优化和 Claude Code 动态工作流案例,展示了长期任务交给模型时的可控性与用量权衡。
AI寒武纪整理了 OpenAI 官方的 Codex 使用最佳实践,核心观点是把 Codex 当成需要持续配置和改进的队友,而非一次性助手。内容涵盖提示词的目标、上下文、约束条件、完成标志四要素,AGENTS.md 多层级规范文件,/review 代码审查,MCP 连接代码库外的工具,以及把重复工作流封装成 Skill 并交给后台自动化定时执行。
文章整理了一套让 Claude Code 自动发现并修复 bug 的配置方法,由 CLAUDE.md 规则、钩子和记忆系统三层组成。文中引用 Claude Code 创始人 Boris Cherny 的采访称,团队已停止人为修复 Claude 的错误,改为让 Claude 自己修复。