推荐理由:原文给出协调者调度子 Agent、全局上下文与事件驱动三项设计,可据此理解编码智能体从单次对话转向常驻项目协作的变化。
AI 编码
全部主题AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。
当前仅显示精选新闻最新精选
第 81–100 条 · 共 436 条@AYi_AInotes@AYi_AInotes精选AI 评分6767 
@rohanpaul_ai@rohanpaul_ai精选AI 评分8787 

推荐理由:6 款开源模型从 0.9B 覆盖到 375B,并公开中间 checkpoint 与训练日志,便于观察完整训练过程。
@OpenBMB@OpenBMB精选AI 评分6868 



推荐理由:原文列出 UltraData 各数据集的规模与覆盖范围,可据此判断这批开源训练数据的复用价值。
Cursor Blog精选AI 评分7676 Cursor 推出 Projects,用协调智能体指挥数千个子智能体
Cursor 在 Cursor 中推出 Projects 并进入 beta 阶段,逐步向所有用户开放,用户可通过与 Project 的协调智能体对话,把一项功能、一次迁移或一个完整应用交给它长期承接。
推荐理由:原文给出 Projects 的三项核心机制与内部使用数据,读者可据此了解多智能体长期协作的工作方式。
Cursor Blog精选AI 评分7676 Cursor 推出 Projects,用协调智能体管理大规模长期开发工作
Cursor 推出 Projects,可承接一项功能、一次迁移或完整应用等大规模工作,在长达数月的工作中维持上下文,并向数千个子智能体委派任务。它由不写代码的协调智能体统一指挥,核心包括默认云端运行、跨机器同步的共享上下文,以及监听 Slack、按计划运行和跟进 PR 的订阅能力。
推荐理由:官方说明给出协调机制、共享上下文和订阅三类核心功能,以及内部使用数据,读者可据此评估是否纳入自己的开发流程。
@kimmonismus@kimmonismus精选AI 评分7474 DeepSeek 发布 V4.1-Flash,作者引用 DeepSeek 的测试称其在多项编码与智能体基准上追平或超过 GPT-5.6 Sol,而输出 token 价格低 94%。

引用@kimmonismus@kimmonismusDeepSeek just released V4.1-Flash with a new architecture, six weeks after its July V4-Flash update. July’s release improved post-training while keeping the architecture unchanged. (Same with GLM-5.3/Flash) V4.1 introduces a Causal Encoder–Decoder architecture with native visual understanding. DeepSeek reports: - 552B MoE parameters, with 8B active during input processing and 16B during output generation. - KV-cache requirements cut to ¼ of the HBM and ⅛ of the SSD storage versus the previous generation. - Lower API prices. These are *significant* jumps in just a few weeks with post training. This is the new reality we have to adapt to: weekly releases with significant improvements. The company says Flash now beats V4-Pro on capability, cost and speed. Starting September 14, V4-Pro API requests will temporarily route to V4.1-Flash until V4.1-Pro arrives.
推荐理由:文中给出 DeepSeek V4.1-Flash 的定价与 DeepSWE 基准对比,读者可据此判断价格战对智能体调用成本的影响。
@rohanpaul_ai@rohanpaul_ai精选AI 评分7272
引用@OpenAI@OpenAIWe mobilized 250+ people to strengthen our defenses across hundreds of systems. Our latest cyber models helped us find and fix vulnerabilities we might never have discovered otherwise. We’re sharing what we learned, the architecture, and a practical playbook so you can build your own Defense Factory: a continuous loop where AI agents find vulnerabilities, validate them, and verify that fixes work. https://t.co/k1oWJHle8S
推荐理由:原文给出用 Codex 智能体编写全部安全补丁的参考架构,读者可了解把安全工作转成持续智能体循环的思路。
Mistral AI精选AI 评分6464 Mistral 用 AI 智能体将欧洲能源运营商 40,000 行 Fortran 77 迁移到 C++
Mistral 帮助一家欧洲能源运营商将 40 万行油藏模拟器代码库中的 40,000 行 Fortran 77 核心功能迁移到 C++,该代码无测试套件且文档分散。
推荐理由:原文复盘了完整迁移过程和三条可迁移经验,读者可以借鉴其验证优先与结构化工作流的落地方法。
@OpenAI@OpenAI精选AI 评分7979 推荐理由:OpenAI 公布 Astra 在 Codex 与 ChatGPT Work 中的可用层级,读者可据此了解哪些账户已能直接使用。
虎嗅APP · 微信公众号精选AI 评分7878 GPT-6 Astra 发布重回第一,OpenAI 在企业市场仍落后 Anthropic
OpenAI 于 9 月 3 日发布 GPT-6 Astra,称其为世界上最智能的模型,在软件工程、计算机操作和专业工作等测试中大幅超过上一代 GPT-5.6 Sol。
推荐理由:借 GPT-6 Astra 发布梳理 OpenAI 与 Anthropic 在企业市场的此消彼长,说明模型能力领先未必等于商业领先。
@frxiaobei@frxiaobei精选AI 评分6868 推荐理由:原文梳理事件经过与数据边界争议,有助于理解把研究过程交给 AI 平台后需要追问哪些权限。
数字生命卡兹克 · 微信公众号精选AI 评分7878 实测 GPT-6 Astra:OpenAI 曾经的黄金时代回来了
GPT-6 Astra 已向所有订阅用户推送,作者在 ChatGPT 和 Codex 中实测后认为其综合能力追平 Claude Fable 5,速度比 GPT-5.6 Sol 大幅提升。前端与 3D 网页生成的细节和形式感提升明显,代码审查深度加强,一次系统性能审查列出大量问题并在约 2 小时内完成修复。作者还给出简化后的 AGENT.md 和手动开启 Codex 实验性上下文管理的配置方法。
推荐理由:作者以第一手实测对比 GPT-5.6 Sol,给出速度、前端 3D 生成和代码能力上的直观差异。
@rohanpaul_ai@rohanpaul_ai精选AI 评分6767 
推荐理由:Boris Cherny 建议 Claude Code 用户定期删掉 claude.md、skills 和 hooks,观察模型在缺少指令时的表现。
AI寒武纪 · 微信公众号精选AI 评分8888 Anthropic 用 Claude 11 天完成费马大定理 Lean 形式化,生成超 1300 万行证明代码
Anthropic 用 Claude 在 11 天内近乎全自主完成费马大定理的 Lean 形式化证明,代码超 1300 万行,是 Mathlib 规模的 5 倍以上。
推荐理由:Claude 在 11 天内完成费马大定理的 Lean 形式化,读者可据此了解机器验证在数学审查中的实际进展。
@sama@sama精选AI 评分8989 引用@sama@samaGPT-6 Astra is now available to all Pro, Enterprise, and Business Premium users in Work/Codex, and is available in the API. We will start rollout to Plus and Business users next. Thank you for the patience.
推荐理由:GPT-6 Astra 的可用范围从 Pro 和 Enterprise 扩展到 Plus 与 Business 用户,读者可据此了解其开放进度。
IT Home精选AI 评分8383 OpenAI GPT-6 Astra 上线 ChatGPT Work、Codex 及 API
OpenAI 于当地时间 9 月 3 日发布的 GPT-6 Astra 现已面向 ChatGPT Work 和 Codex 中的 Pro、Enterprise 及 Business Premium 用户开放,同时上线 API,面向 Plus 和 Business 用户的推送可能还需数日。
推荐理由:原文给出 Astra 的开放范围、105 万 token 上下文与 API 定价,读者可据此判断其可用性与调用成本。
@testingcatalog@testingcatalog精选AI 评分8383
引用@OpenAIDevs@OpenAIDevsGPT-6 Astra is now available in the API. It’s also available in ChatGPT Work and Codex for all Pro, Enterprise, and Business Premium users. https://t.co/6D0bFdqkgB
推荐理由:原文给出了 GPT-6 Astra 的 API 定价和 ChatGPT Work、Codex 的分批上线节奏,便于评估接入成本与可用时间。
@OpenAIDevs@OpenAIDevs精选AI 评分8383 引用@OpenAIDevs@OpenAIDevsGPT-6 Astra is our best model yet for computer use, software engineering, and visual understanding to date. Hear from the builders putting it to work: https://t.co/xZrolWBXXU
推荐理由:GPT-6 Astra 已在 API 与 ChatGPT Work、Codex 上线,读者可据此了解各付费档位的接入方式。
@OpenAI@OpenAI精选AI 评分8686 推荐理由:OpenAI 说明了 GPT-6 Astra 在各档账号的开放顺序与 API 上线状态,读者可据此判断自己何时能用上。
GitHub Blog · AI & ML精选AI 评分6767 GitHub 推出 Project HydraFusion 多模型编排研究预览
GitHub 发布 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级编码质量,所有 GitHub Copilot 计划用户可在 Copilot CLI 通过 /experimental 使用。
推荐理由:原文给出三种执行模式和三项基准的质量与成本数据,读者可以据此评估多模型编排对现有编码工作流的适用性。