推荐理由:指南覆盖模型选型、迁移调参和 Claude Code 使用三方面,开发者可直接对照迁移工作流。
教程实践
全部主题拿来就能用的实操内容:提示词技巧、工作流搭建、工具用法与踩坑经验。
当前仅显示精选新闻最新精选
第 21–40 条 · 共 114 条
ClaudeDevs@ClaudeDevs精选AI 评分8383
Databricks Blog精选AI 评分6565 Databricks 如何让 12,000 名员工在模型发布首日即可用新模型
Databricks 介绍其通过 Unity Gateway 让全体员工在 Opus 5.5、GPT-6 Sol 和 GPT-Luna 发布首日即获得实验性访问的完整流程:先用实验标签和按用户预算(月度上限、每日 runaway 限额、质量前沿预算、实验预算四类)控制风险,再依据内部基准、用户反馈和 OpenTelemetry 成本追踪评估。
推荐理由:原文给出企业内部让全体员工 Day 1 用上新模型的完整流程和成本数据,方法可迁移到类似的模型接入评估场景。
数字生命卡兹克 · 微信公众号精选AI 评分7373 GPT-Image 2.5 的 12 种照片玩法合集:去游客、调光、海报与涂鸦提示词
数字生命卡兹克整理了用 GPT-Image 2.5 编辑旅行照片的 12 种玩法,并附上全部可复制的提示词。玩法分三类:消除背景游客、自动调光、专业美颜等基础编辑;拍立得 3D 公仔、明信片、贴纸、行李箱拼贴、旅行海报等创意出片;以及演唱会氛围感照片、美食飞溅、文字涂鸦、ins 风画面注释等网感大片。
推荐理由:作者亲测GPT-Image 2.5整理出12个照片编辑玩法并附完整提示词,读者可以直接复制复用到自己的假期照片上。
AGI Hunt · 微信公众号精选AI 评分7878 Claude Code 团队 Thariq 详解 effort 参数怎么选
Anthropic Claude Code 团队的 Thariq 发文讲解 effort 参数的作用,即调节 Claude 做多少验证、测多少边界情况以及自主决策程度。
推荐理由:原文用多组实测数据和失败原因分析说明各档 effort 的适用场景,读者可以按任务类型选档。
ClaudeDevs@ClaudeDevs精选AI 评分7070推荐理由:作者用具体数字拆解了 Opus 5.5 降价对 Claude Code 单任务成本的实际影响,并给出可复用的成本计算器入口。
GitHub Blog · AI & ML精选AI 评分6060 GitHub Copilot app 新手教程:如何用 canvases 构建自定义工作流
GitHub Copilot app 提供 canvas 功能,运行 /create-canvas 技能并用自然语言描述工作流、界面操作和 agent 职责三要素,即可生成看板、清单等自定义界面并保存为可共享的 extension。
推荐理由:官方教程给出从描述到生成可复用 canvas 界面的具体步骤和三个提问框架,读者可以直接照做迁移到自己的工作流。
GitHub Blog · AI & ML精选AI 评分6161 GitHub Copilot 博客:为什么聊天界面往往不是正确的 UI,用 canvas 试试
GitHub Copilot 博客作者提出聊天(chat)很多时候是错误的 AI 交互界面,介绍 GitHub Copilot app 中的 canvas,它是在应用内运行、无浏览器外壳的全栈小应用,可与 Copilot agent 双向通信。
推荐理由:作者作为 Copilot 团队成员提出用 canvas 自定义界面替代聊天框,并结合工作流自动化等实例说明何时值得让智能体先造工具。
GitHub Blog · AI & ML精选AI 评分6363 GitHub Security Lab 发布 Fuzzing Taskflow:用 LLM 智能体自动化 C/C++ 模糊测试
GitHub Security Lab 的 Antonio Morales 基于自家的 Taskflow Agent 框架构建了 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线。
推荐理由:原文给出完整的架构设计、覆盖反馈循环和分层判断方法,读者可以据此把 LLM 智能体接到自己的模糊测试流程里。
LangChain Blog精选AI 评分6868 LangChain 官方解读如何用 Jev 与 LangGraph 构建 "prod, not god" 生产系统
LangChain 发布教程,讲解如何将 TypeSafe 新发布的决策模型 Jev 与 LangGraph 结合构建 AI 驱动软件。
推荐理由:LangChain 官方展示了如何用决策模型 Jev 搭配 LangGraph 构建生产系统,含诉讼文档审阅等实测对比,可迁移到自身智能体架构。
Cursor Blog精选AI 评分6565 Cursor 通过精简系统提示和缓存断点等手段将智能体 token 成本降低 7%
Cursor 官方博客介绍其智能体 harness 的多项 token 效率优化,整体将用户 token 成本降低 7% 且质量未下降。
推荐理由:Cursor 自述其 harness 层的多项 token 优化手段与量化收益,读者可以借鉴这些方法来降低长时智能体运行成本。
OpenRouter Announcements精选AI 评分6464 OpenRouter 评测 2026 年最佳嵌入模型并按用例给出推荐
OpenRouter 发布 2026 年嵌入模型选购指南,通过对 19 个模型发起 28 项 API 实测,按用例给出推荐:英文 RAG 首选 openai/text-embedding-3-small。
推荐理由:OpenRouter 用自家端点实测 19 个嵌入模型并按用例给出推荐表,读者可直接按输入类型和价格约束对号入座。
Claude Blog精选AI 评分6767 Anthropic 工程师分享如何为 AI 驱动的代码现代化项目做准备
Anthropic 前线部署工程师在 Notes from the Field 系列中分享管理大规模代码现代化项目的经验:原本需数年的项目现在可在数月或数周内完成,但瓶颈从编写变更转移到组织动员。
推荐理由:来自 Anthropic 一线工程师的实战经验,给出 AI 代码现代化项目启动前的组织性准备工作清单和可复用六步流程。
OpenRouter Announcements精选AI 评分6161 OpenRouter 解析 NVIDIA Nemotron 3.5 Lightning 如何承担智能体高频执行调用
OpenRouter 发文解析 NVIDIA 的 Nemotron 3.5 Lightning,这是一个 30B 总参数、每 token 激活约 3B 的 MoE 开源权重模型,定位于智能体工作流中的高频执行步骤。
推荐理由:原文梳理了模型规格、与 Ultra 的分工、各端点差异和路由方法,可帮助读者判断何时用它替代大模型执行高频调用。
Linear Now精选AI 评分6767 Linear 分享如何把 CI 等待时间从 6 分钟降到 5 分钟以适应 AI 编码节奏
Linear 因 AI 智能体加速写代码使 CI 成为瓶颈,系统性改造后把 PR 等待时间从 6 分多钟降到 5 分多钟,单个测试的 runner 时间约减半。
推荐理由:原文给出完整的 CI 优化路径和各步骤量化收益,其他团队可对照迁移到自己的流水线。
GitHub Blog · AI & ML精选AI 评分7878 GitHub 用 Copilot 将 Copilot agent runtime 迁移到 Rust
GitHub 用 Copilot 智能体将 Copilot agent runtime 从 TypeScript 完整重写为 832,378 行生产 Rust,共 128 个 PR,于 8 月 21 日完成。
推荐理由:作者以第一手移植经历拆解了 AI 智能体团队完成大规模重写的具体策略、会话数据和教训,方法细节对类似工程迁移有直接参考价值。
OpenRouter Announcements精选AI 评分6767 OpenRouter 教程:用 TypeScript SDK 构建可靠的工具调用 Agent 循环
OpenRouter 发布教程,演示如何用其 TypeScript SDK 从零构建工具调用 Agent 循环,示例使用本地天气数据可独立运行。教程覆盖停止条件设计、按 toolCallId 返回结果、指纹计数拦截重复调用、models 参数实现有序模型回退,以及 Auto Exacto 默认按工具调用成功率重排提供商;并说明 MCP 只改变工具执行位置,循环控制仍是必要的。
推荐理由:教程给出了完整的停止条件、重复检测和模型回退实现,可用作自建 tool-calling 循环的参考骨架。
AI科技评论 · 微信公众号精选AI 评分6666 拆解 Gemini 3.8 Live:一句插话为何牵动整个 Agent 系统
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,把语音、视觉、推理和 Tool Calling 放进同一条持续运行的链路。
推荐理由:文章从异步 Tool、KV Cache 和调度角度拆解实时语音会话背后的系统问题,读者可以迁移到自己的 Agent Runtime 设计。
Hugging Face Blog精选AI 评分6363 IBM Research 为 ALTK-Evolve 推出 Consistency Analyzer,将智能体一致性缺口从 24.4pp 降到 12.0pp
IBM Research 在 ALTK-Evolve 中新增 Consistency Analyzer 和一致性指南,用于衡量并改善智能体重复执行同一任务时的稳定性。
推荐理由:原文给出 Pass^k 与 Mean@k 的区别和一种只靠单条轨迹、无需标注的稳定性诊断方法,可将智能体一致性缺口缩小约一半。
OpenRouter Announcements精选AI 评分6262 OpenRouter Ori Eval 教程:用 LLM-as-a-Judge 自动评估 AI Agent 输出
OpenRouter 发布教程,讲解如何用独立的 judge 模型按书面评分标准自动给 Agent 输出打分,弥补确定性测试无法检查最终回答质量的问题。
推荐理由:原文给出可复用的评测方法和 Ori Eval 具体代码,覆盖评分模式选择与 judge 校准的实操细节。
LangChain Blog精选AI 评分6666 LangChain 发布付费广告 Agent 并开源,分享构建经验
LangChain 开源其 Paid Media Agent 并复盘构建过程,该 Agent 驻留 Slack,用于管理跨五个付费渠道的广告活动。六个月内付费媒体从 0 做到占营销管道的 20%,CPL 从 6 月到 8 月下降 30%。
推荐理由:原文给出了 Agent 工程的具体设计决策和成本数据,读者可以迁移其上下文分层和权限设计方法到自己的 Agent 项目。