跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

当前仅显示精选新闻
436条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 301–320 条 · 共 436 条
6月16日周二
  1. Tomer Tunguz65

    本地编码栈格局:Qwen 3.6 35B-A3B 提及率居首,Pi 以 49% 领跑智能体框架

    Tomer Tunguz 梳理了一篇 Hacker News 热帖的 500 多条评论,勾勒出本地编码栈的现状:Qwen 3.6 35B-A3B 以 33% 的提及率居首,27B 变体占 20%,DeepSeek Pro 与 Gemma4 31B 进入前四;智能体框架方面 Pi 以 49% 领先,OpenCode 紧随其后达 45%。

    推荐理由:帖子数据勾勒出本地编码模型与智能体工具的占比,并与 Claude 做能力对比,便于判断本地替代的可行边界。

6月15日周一
  1. AI前线 · 微信公众号84

    Fable 5 被白宫下令下架三天后 Anthropic 赴华盛顿谈判,材料给出与 GPT 5.5 的基准对比

    Anthropic 的 Fable 5 于 6 月 9 日发布,仅上线三天后便在 6 月 12 日被特朗普政府下令下架,公司高级成员已赴华盛顿就出口管制分类进行谈判。

    推荐理由:文中列出 Fable 5 与 GPT 5.5 在 SWE-Bench Pro 等基准上的具体差距,读者可据此判断此次下架对编码工作流的替代影响。

6月12日周五
  1. Linear Now72

    Linear 推出 coding sessions、自动化 triage 和 Diffs,让 Linear Agent 直接完成编码

    Linear 发布 coding sessions、自动化 triage 和 Diffs,Linear Agent 可以从 issue 直接触达实现:阅读 issue 与讨论、调查代码库、提出方案、写代码并开 PR,全程在云端用 Claude Code 或 Codex 等模型与 harness 完成。

    推荐理由:Linear 官方给出从 issue 到 PR 的完整执行闭环细节,并附自用数据与 Ramp、Coinbase 案例,读者可评估其对工程流程的影响。

6月11日周四
6月10日周三
  1. 量子位 · 微信公众号79

    Anthropic 发布 Claude Fable 5,首日实测对比 GPT-5.5

    Anthropic 发布 Claude Fable 5,称其进入 Mythos 新段位,模型开放首日开发者集中实测其编码、设计与网页搭建能力。网友将其与 GPT-5.5 同台对比,在《我的世界》复刻推特中 Fable 5 还原度更高,另有开发者称其在 FC Diamond 榜单成功率从 Opus 4.8 的约14%升到30%以上。

    推荐理由:汇总模型开放首日开发者在编码、设计与网页搭建上的实测反馈,可与前代及竞品表现对照。

  2. 赛博禅心 · 微信公众号84

    Claude Fable 5 全解析:Mythos 级模型加护栏后对外开放

    Anthropic 发布 Claude Fable 5,它与只开放给政府和特定机构的 Mythos 5 是同一个模型,区别在于护栏。Fable 5 定价为 $10/百万 token 输入、$50/百万 token 输出,Pro、Max、Team 等用户可在 6 月 22 号前使用(消耗 Opus 两倍额度),之后需花 usage credits。

    推荐理由:文章对比了 Fable 5 与 Mythos 5 的护栏差异,并给出作者实测中被退回 Opus 4.8 的体验。

  3. @berryxia67

    Google 开发者账号宣布,Gemini 模型现已通过 Apple 的 Foundation Models 框架和 Xcode 中的原生支持,向数百万 Apple 开发者开放。

    引用Google for Developers (@googledevs)@googledevs

    Gemini models are now accessible to millions of Apple developers through Apple’s Foundation Models framework and natively within Xcode. You can now easily swap between local and cloud inference using a shared API surface to build next-generation agentic app experiences, increase development velocity, and offload heavy workloads to the cloud. Additionally, you can use agentic coding assistance from Gemini in Xcode to accelerate multi-step development tasks. Check out the full announcement to get started: goo.gle/3Q1YDnD Video

    推荐理由:该消息交代了 Gemini 接入 Xcode 与 Foundation Models 框架的具体入口,便于判断 Apple 开发者的模型选择格局。

  4. 量子位 · 微信公众号88

    Anthropic 发布 Claude Fable 5 与 Claude Mythos 5,5000 万行代码库迁移一天完成

    Anthropic 发布 Claude Fable 5 与 Claude Mythos 5 两个版本,Fable 5 面向所有用户开放,Mythos 5 只给少数受信任用户使用,两者统一定价为每百万输入 Token 10 美元、每百万输出 Token 50 美元,比之前的预览版便宜一半以上。

    推荐理由:两款同内核模型按权限分级,Fable 5 用分类器降级路由兼顾能力与安全,可观察前沿模型的形态变化。

  5. @berryxia69

    Anthropic 发布 Claude Fable 5,这是一款 Mythos 级模型,已被做成安全版本面向通用场景开放,能力超过其此前任何公开模型。基准评测近乎全线 SOTA,在软件工程、知识工作、科研和视觉等硬任务上领先,长任务越复杂领先越多。

    引用Claude (@claudeai)@claudeai

    Introducing Claude Fable 5: a Mythos-class model that we’ve made safe for general use. Its capabilities exceed those of any model we’ve ever made generally available. Video

    推荐理由:原文列出该模型基准几乎全线 SOTA,并说明敏感领域会自动回退到 Opus 4.8 的机制。

  6. @karpathy72

    Anthropic 发布 Claude Fable 5,官方称其在几乎全部测试基准上达到 SOTA,软件工程、知识工作、科研和视觉表现尤为突出。Karpathy 指出它与 Mythos 是同一底层模型、额外加了安全防护,属于值得大版本升级的质变,尤其适合高难度长程问题求解,但发布期安全防护触发偏敏感。

    引用Claude (@claudeai)@claudeai

    Fable 5 is state-of-the-art on nearly all tested benchmarks, with exceptional performance in software engineering, knowledge work, scientific research, and vision. The longer and more complex the task, the larger Fable 5’s lead over our other models.

    推荐理由:Karpathy 以第一手使用体验判断 Claude Fable 5 属版本级跃迁,并点出发布期安全阈值偏严的取舍。

  7. @kimmonismus79

    Claude 5 Fable 在几乎所有已测试的 AI 能力基准上达到 SOTA,在软件工程、知识工作、视觉与科研方面表现突出。作者称其比过往 Claude 模型更省 token,能在数百万 token 的长任务中保持专注并用自记笔记改进输出。Stripe 早期测试称该模型把数月工程压缩到数天,在 5000 万行 Ruby 代码库中用一天完成原本需团队两个多月的全库迁移。

    引用Chubby♨️ (@kimmonismus)@kimmonismus

    Claude 5 Fable Benchmarks! Holy moly, significant jump even to Mythos

    推荐理由:原文汇总了 Fable 5 的基准成绩和 token 效率变化,并借 Stripe 的迁移案例展示其长任务表现。

  8. @op741872

    Anthropic 发布 Mythos 低配版 Claude Fable 5,向 API、Pro、Max、Team 及企业用户开放。它采用与 Mythos 5 相同的底层模型,API 输入每百万 Token 10 美元、输出 50 美元,比 Mythos Preview 便宜一半。Fable 加强了安全防护,涉及网络攻击、生化攻击或大规模能力蒸馏的请求会被拒绝,并回退到 4.8 版本。

    引用Claude (@claudeai)@claudeai

    Introducing Claude Fable 5: a Mythos-class model that we’ve made safe for general use. Its capabilities exceed those of any model we’ve ever made generally available. Video

    推荐理由:梳理了 Fable 5 与 Mythos 5 的开放范围、API 定价减半及安全回退机制,可据此评估其可用性。

  9. Claude Code GitHub Releases70

    Claude Code v2.1.170 发布:引入 Claude Fable 5 并修复会话转录保存问题

    Claude Code 发布 v2.1.170,宣布引入 Claude Fable 5,称其为面向通用场景开放、能力超过此前所有公开模型的 Mythos 级模型,升级该版本即可使用,并附 Anthropic 公告链接。该版本还修复了从 VS Code 集成终端或继承 Claude Code 环境变量的 shell 启动时,会话不保存转录且不出现在 --resume 中的问题。

    推荐理由:原文给出新模型的获取方式和一个会话转录保存的修复,Claude Code 用户可据此决定是否升级到该版本。

  10. @dotey79

    Anthropic 发布 Claude Fable 5 和 Claude Mythos 5 两个模型,二者共用同一底座,Fable 5 加装安全分类器面向所有用户开放,Mythos 5 去掉部分安全限制只给 Project Glasswing 网络安全合作伙伴使用。

    引用Claude (@claudeai)@claudeai

    Introducing Claude Fable 5: a Mythos-class model that we’ve made safe for general use. Its capabilities exceed those of any model we’ve ever made generally available. Video

    推荐理由:同底座的两个模型分走通用与受限两条路线,安全降级机制与定价变化构成理解这次发布的关键。

  11. @OpenRouter67

    Anthropic 的 Claude Fable 5 已在 OpenRouter 上线,被称为 Anthropic 最强的编码模型。该模型面向长时程、模糊任务,包括 legacy migrations、生产环境疑难 bug 以及运行数小时到数天的异步会话,在几乎所有测试基准上达到 SOTA。

    推荐理由:Anthropic 这款主打长时程异步编码任务的模型已接入 OpenRouter,读者可据此了解它的能力定位与使用入口。