跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

当前仅显示精选新闻
497条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 481–497 条 · 共 497 条
2月3日周二
  1. Qwen Blog63

    Qwen 发布 Qwen3-Coder-Next:面向编码智能体的开源权重混合架构模型

    Qwen 团队发布开源权重模型 Qwen3-Coder-Next,专为编码智能体和本地开发设计。模型基于 Qwen3-Next-80B-A3B-Base 构建,采用混合注意力加 MoE 的新架构,通过大规模可执行任务合成、环境交互和强化学习进行 agentic 训练。

    推荐理由:原文说明该模型面向编码智能体与本地开发,并给出混合注意力加 MoE 的架构与训练方式,读者可据此评估其定位。

1月28日周三
  1. Mistral AI70

    Mistral 发布 Mistral Vibe 2.0 终端编码智能体并调整 Devstral 2 定价

    Mistral AI 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、多选澄清、斜杠命令技能和统一智能体模式。

    推荐理由:官方公告给出 2.0 的功能清单、订阅方案和 Devstral 2 API 定价,读者可以据此评估是否把它纳入自己的终端开发工作流。

1月21日周三
  1. Replit Blog63

    Replit 介绍 Replit Agent 的决策时引导方法,提升长轨迹可靠性

    Replit 发布博文,介绍其为 Replit Agent 设计的决策时引导(decision-time guidance)机制,用轻量多标签分类器在关键决策点注入简短情境化指令,替代静态系统提示词,将可控引导从 4–5 条静态提醒扩展到数百条。

    推荐理由:Replit 自述其 Agent 的决策时引导机制,包含注入位置对比实验和缓存成本数据,方法对同类 Agent 工程有可迁移性。

1月8日周四
  1. PromptArmor:Threat Intelligence66

    PromptArmor 披露 IBM Bob 编码智能体可经提示词注入下载并执行恶意软件

    PromptArmor 披露 IBM 的编码智能体 Bob(含 Bob CLI 与 Bob IDE,当前 Closed Beta)存在漏洞:用户只要对一条已知可信命令(如 echo)设置 always allow,攻击者即可通过间接提示词注入触发恶意软件的下载与执行。

    推荐理由:原文演示了 IBM Bob CLI 在一次自动批准下被间接提示词注入触发恶意软件执行的完整链路,并给出三个被绕过的防御细节。

12月23日周二
12月9日周二
  1. Mistral AI76

    Mistral 发布 Devstral 2(123B)与 Devstral Small 2(24B)开源编码模型及 Vibe CLI

    Mistral 发布开源编码模型 Devstral 2(123B,修改版 MIT)和 Devstral Small 2(24B,Apache 2.0),SWE-bench Verified 分别达 72.2% 和 68.0%,均支持 256K 上下文。

    推荐理由:官方给出了两个尺寸的开源编码模型参数量、SWE-bench Verified 成绩、API 定价和部署门槛,可与闭源竞品直接对比。

10月27日周一
  1. MiniMax Blog74

    MiniMax 开源并发布面向 Agent 与编码的 MiniMax M2

    MiniMax 开源并发布面向 Agent 和编码场景的模型 MiniMax M2,API 定价为每百万输入 tokens $0.30/¥2.1、输出 $1.20/¥8.4,为 Claude 4.5 Sonnet 的 8%,推理速度接近其两倍,TPS 约 100。

    推荐理由:官方给出了 M2 的定价、推理速度、基准成绩与部署方式,读者可据此评估其在 Agent 工作流中的成本与性能权衡。

9月25日周四
  1. Factory 研究 / 产品64

    Factory Droid 以 58.8% 登顶 Terminal-Bench,并详解智能体设计方法

    Factory 宣布其软件开发智能体 Droid 以 58.8% 的任务解决率在 Terminal-Bench 排行榜第一,Opus 4.1、GPT-5 和 Sonnet 4 三种单模型配置均显著领先其他单模型智能体,并超过 Codex CLI(42.8%)和 Claude Code(43.2%)。

    推荐理由:原文在成绩之外给出智能体设计的可复用做法,如分层提示词、模型专属适配和精简工具,能帮助改进自己的 Agent。

9月5日周五
  1. Factory 研究 / 产品68

    Factory 讲解如何用 Linter 约束 Agent 代码生成

    Factory 发布实践文章,主张把架构、边界和规范编码为 lint 规则,让 LLM Agent 在代码生成循环中获得自动反馈并自我修正,将“lint green”作为完成标准。文章给出可检索性、代码组织、架构边界、安全、测试、可观测性等规则类别,介绍 lint 驱动的大规模迁移方法,并说明 AGENTS.md 负责“为什么”,linting 提供机器可执行的保证。

    推荐理由:文章给出把架构规范编码为 lint 规则的完整类别清单和落地流程,可直接迁移到自己团队的 Agent 开发工作流。

7月11日周五
7月1日周二
  1. Factory 研究 / 产品70

    Factory 提出 Agent-Native Development 智能体开发方法论

    Factory 发布 Agent-Native Development 指南,讲解如何让智能体运行完整的开发内循环:收集上下文、规划、实现、验证并提交可审查的变更。

    推荐理由:Factory 提出 Agent-Native Development 方法论,给出精确规格、环境配置和任务失败时的恢复策略,可直接迁移到日常智能体编码工作流。

5月28日周三
5月21日周三
5月7日周三
3月24日周一
9月5日周四
6月28日周五