跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

当前仅显示精选新闻
456条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 221–240 条 · 共 456 条
8月14日周五
  1. IT Home80

    SpaceX 以 600 亿美元完成对 AI 编程公司 Cursor 的收购

    SpaceX 于当地时间 8 月 14 日正式完成对 AI 编程初创公司 Cursor 的 600 亿美元收购,此前两个月双方已宣布达成收购协议。Cursor 通过博客表示,收购后可动用全球规模最大的 GPU 集群,用充足算力开发能力更强、运行成本更低的模型。双方在交易完成前已于 7 月推出首个联合模型 Grok 4.5,主要用于编程、金融和法律任务,两家公司称其使用成本低于其他竞争模型。

    推荐理由:这笔 600 亿美元交易连同使用大规模 GPU 集群的承诺,呈现了 AI 编程赛道当前的资本与算力竞争体量。

  2. Cursor Blog77

    Cursor 正式被 SpaceX 收购

    Cursor 正式被 SpaceX 收购,始于 4 月的收购流程至此完成。收购后 Cursor 将可使用全球最大的 GPU 集群,获得构建更强大且运行成本更低的模型所需的算力,从而以更低成本为客户提供能力更强的模型。文中称周三发布的 Grok 4.6 初步展示了双方如今能够共同打造的成果。

    推荐理由:收购完成后 Cursor 将接入 SpaceX 的 GPU 集群,原文给出了对模型成本与能力的具体预期。

  3. Cursor Blog79

    Cursor 宣布正式被 SpaceX 收购

    Cursor 宣布正式被 SpaceX 收购,始于 4 月的收购流程完成。Cursor 将使用 SpaceX 的 GPU 集群获得算力,以更低成本向客户提供能力更强的模型;其提到周三发布的 Grok 4.6 初步展示了双方合作的成果,Cursor 仍将继续帮助用户减少编写代码的时间。

    推荐理由:收购方官方宣布交易完成,并说明算力与模型成本的联动,读者可了解 Cursor 后续产品方向。

  4. 量子位 · 微信公众号78

    深度体验 DeepSeek Harness:开源编码 Agent 的插件化架构与实测对比

    DeepSeek Harness 正式发布并开源,作者内测半个月后把自己的 Vibe Coding 项目从 Codex 迁移到 DSH。DSH 采用一切皆插件的 Cordis 架构,内置 100 多个插件,提供标准、PTC、极简、创造四类 Agent 预设,并有可直接查看原始事件的轨迹回放视图。

    推荐理由:作者用半个月内测体验对比 Codex,呈现 DSH 的插件化架构与轨迹回放等设计,便于判断它与现有编码 Agent 的差异。

8月13日周四
  1. Hugging Face Blog71

    Hugging Face 复盘复现 2,226 篇 ICML 2026 论文的 hackathon

    Hugging Face 于 7 月 15 日至 8 月 2 日举办 ICML 2026 Open Reproductions 挑战赛,1,221 名参与者用 Claude Code、Codex、Cursor 等智能体在 19 天内发布 6,816 份 Trackio 日志,复现 2,226 篇论文,约占会议的 34%。

    推荐理由:官方复盘给出了逐条声明级别的复现数据和失败案例,可迁移到用智能体做大规模论文审计的工作流。

  2. 量子位 · 微信公众号78

    DeepSeek V4 Pro 正式版发布,多项基准对标 Fable 5

    DeepSeek V4 Pro 正式版发布,API 平台已上线 DeepSeek-V4-Pro-0813,官方博客尚未发布。在 HLE、Terminal Bench、Cybergym、DeepSWE 等 Agent 基准上,它几乎全面超过 Opus 4.8,逼近 Fable 5,部分榜单反超;百万 tokens 输入 3 元、缓存命中 0.025 元、输出 6 元。

    推荐理由:素材给出多项 Agent 基准对比与 API 定价,可据此判断国产开源模型与闭源前沿的差距及调用成本。

  3. IT Home77

    阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文

    阿里 Qwen 团队通过魔搭 ModelScope 社区开放 Qwen3.8-2.4T-A95B 模型权重,总参数 2.4T、每个 Token 激活 95B,原生支持 262,144 Token 上下文并可扩展至 1,010,000 Token。

    推荐理由:官方同时给出 MoE 路由结构、上下文长度与后训练三环节,可据此看清超大规模开源模型在长周期 Agent 任务上的工程取舍。

  4. Microsoft AI News66

    Microsoft AI 发布推理模型 MAI-Thinking-1

    Microsoft AI 发布推理模型 MAI-Thinking-1,为 35B 激活、约 1T 总参数的稀疏 MoE 模型。官方称其在 SWE-Bench Pro 上与 Claude Opus 4.6 相当,AIME 2025 达 97.0%、AIME 2026 达 94.5%,盲测中人类偏好高于 Sonnet 4.6。

    推荐理由:官方公布了模型规格与基准成绩,并说明不蒸馏、自建训练栈的路线,读者可据此评估中型推理模型的部署价值。

  5. Gemini API 更新日志65

    Gemini 3.7 Flash 正式发布 GA

    Google 在 Gemini API 更新日志中宣布 Gemini 3.7 Flash(gemini-3.7-flash)正式可用(GA),定位为面向编码和 Agent 的主力模型。官方称其在软件工程、Web 开发和智能体工作流上有大幅改进,2026年12月31日前提供入门价。

    推荐理由:官方说明点名软件工程与智能体工作流的改进,并给出了到2026年底的入门价格窗口。

  6. DeepSeek API updates84

    DeepSeek-V4-Pro 正式版上线,Agent 能力提升并支持 Responses API

    DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 上线,模型名 deepseek-v4-pro,API 调用方式不变。官方称 Agent 能力大幅提升,生产环境性能表现提升尤为显著,并公布 HLE (wo / w tools) 42.7/60.0、Terminal Bench 2.1 87.9、NL2Repo 61.5 等基准成绩。

    推荐理由:官方公告列出了正式版在多项 Agent 与编码基准上的分数、Responses API 支持和峰谷定价细节,方便用户评估迁移与调用时机。

8月12日周三
  1. IT Home78

    SpaceXAI 发布 Grok 4.6 模型,强化长流程智能体任务

    Grok 4.6 正式发布,在 Grok 4.5 基础上进一步强化长时间运行的智能体任务,以及复杂的交互和视觉工作。在综合 9 项基准的 Artificial Analysis Intelligence Index 上,Grok 4.6 与 GPT-5.6 Sol 取得相同成绩,并已在 Cursor 和 Grok Build 上线。

    推荐理由:Grok 4.6 强化长流程智能体任务,在 9 项基准综合指数上与 GPT-5.6 Sol 同分。

  2. Cursor Blog68

    Cursor 与 SpaceXAI 发布 Grok 4.6,面向长时间运行的智能体

    Cursor 与 SpaceXAI 联合发布 Grok 4.6,该模型基于 Grok 4.5 打造,重点面向长时间运行的智能体以及更复杂的交互与视觉工作。它在由九项基准测试构成的 Artificial Analysis Intelligence Index 上与 GPT-5.6 Sol 持平。

    推荐理由:Grok 4.6 与 GPT-5.6 Sol 在综合智能指数上持平,文中给出了与 Grok 4.5 及 GPT-5.6 Sol 的多项基准对比。