Claude Sonnet 5.5 上线 Amazon Bedrock 及 AWS Claude Platform
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 可用,定位为更聪明高效、多数任务单次成本更低且速度更快的编码与知识工作模型。
推荐理由:官方介绍了 Sonnet 5.5 在 Bedrock 的能力定位、与 Opus 5.5 的分工和入门调用方式,方便评估接入路径。
AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。
当前仅显示精选新闻AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 可用,定位为更聪明高效、多数任务单次成本更低且速度更快的编码与知识工作模型。
推荐理由:官方介绍了 Sonnet 5.5 在 Bedrock 的能力定位、与 Opus 5.5 的分工和入门调用方式,方便评估接入路径。
Introducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:原文给出 Sonnet 5.5 相对 Sonnet 5 的速度、成本与适用任务,开发者可据此判断是否切换日常 Claude Code 用法。
Anthropic 发布 Claude Sonnet 5.5,定位为 Opus 5.5 更快更便宜的搭档。输出速度比 Sonnet 5 快 30% 以上,单任务成本最多低 30%;价格与 Sonnet 5 一致,输入 $2、输出 $10(每百万 token),为 Opus 5.5 的一半。
推荐理由:原文汇总了官方跑分、effort 档位成本曲线和客户实测数字,读者可据此判断该在哪类任务中用 Sonnet 5.5 替换更高档模型。
智谱 9 月 28 日公布 ZCode 数据上传争议补偿方案,付费用户可获 4 张周额度重置卡和 4 张 5 小时额度重置卡,9 月 28 日至 10 月 7 日期间每日向全体用户发放十万份 1 亿 token。
推荐理由:文章围绕 ZCode 开源与补偿方案,梳理了仍缺失的代码历史、数据规模披露和核查范围,可帮助读者理解 Coding Agent 数据边界的验证难题。
Cognition 年化收入本月有望达 10 亿美元,较约四个月前增长约一倍。其早前完成新一轮 20 亿美元融资,估值从约三个月前的 260 亿美元升至 480 亿美元;此前 SpaceX 以 600 亿美元收购其竞争对手 Cursor,8 月完成,SpaceX 曾接触 Cognition 探讨潜在收购。客户包括英伟达、花旗集团和梅赛德斯-奔驰集团。
推荐理由:原文给出 Cognition 的 ARR、估值变化和融资细节,可帮助读者了解 AI 编程赛道的资本与收入格局。
Anthropic 发布 Claude Sonnet 5.5,为 Claude 5.5 家族第二款模型,生成速度比 Sonnet 5 快 30% 以上,测试中单任务成本最多低 30%。
推荐理由:官方发布给出了与 Sonnet 5 和 Opus 5.5 的多项基准对比、定价和成本数据,读者可以据此判断它在自己场景下是否值得迁移。
Anthropic Claude Code 团队的 Thariq 发文讲解 effort 参数的作用,即调节 Claude 做多少验证、测多少边界情况以及自主决策程度。
推荐理由:原文用多组实测数据和失败原因分析说明各档 effort 的适用场景,读者可以按任务类型选档。
Lovable 员工 Elena Verna 分享在这家 ARR 已达 5 亿美元的 AI Native 公司工作一年多的第一手记录。公司取消细分职级头衔、开会被刻意抑制、AI agent 成日常工作对象并设有负责其输出质量的「agent 家长」角色;员工主动用 AI 自动化自己的工作被视为证明价值,团队将扩张至近 500 人。
推荐理由:一线员工写下 AI Native 公司的真实运作细节,既呈现收益也直说摩擦,读者可借此对照自身组织的不同。
推荐理由:作者用具体数字拆解了 Opus 5.5 降价对 Claude Code 单任务成本的实际影响,并给出可复用的成本计算器入口。
I asked Opus 5.5 to explain camera focus by building an interactive lens lab Here's what it came up with after 1 hour 26 minutes in one shot, $25.66 API cost https://lens.lab.sael.net Move the focus ring and you can see the glass elements shift the sharp plane through the scene
推荐理由:官方汇总用户用 Opus 5.5 探索的成果,引用案例给出了单次生成时长与成本,可作实际使用参考。
GitHub Copilot 博客作者提出聊天(chat)很多时候是错误的 AI 交互界面,介绍 GitHub Copilot app 中的 canvas,它是在应用内运行、无浏览器外壳的全栈小应用,可与 Copilot agent 双向通信。
推荐理由:作者作为 Copilot 团队成员提出用 canvas 自定义界面替代聊天框,并结合工作流自动化等实例说明何时值得让智能体先造工具。
GitHub Security Lab 的 Antonio Morales 基于自家的 Taskflow Agent 框架构建了 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线。
推荐理由:原文给出完整的架构设计、覆盖反馈循环和分层判断方法,读者可以据此把 LLM 智能体接到自己的模糊测试流程里。
inclusionAI 正式开源 Ling 2.0 架构下的第三个 MoE 大语言模型 Ling-flash-2.0,总参数 100B、激活参数 6.1B(非嵌入 4.8B),基于 20T+ tokens 数据训练并经 SFT 和多阶段强化学习。
推荐理由:官方给出参数结构、基准对比和推理速度数据,读者可据此评估小激活 MoE 替代 40B 稠密模型的可行性。
inclusionAI 开源 Ling 家族旗舰模型 Ling-2.6-1T,参数量达 1T,面向复杂推理、编码和 Agent 工作流。
推荐理由:官方发布万亿参数旗舰开源模型,给出架构设计、benchmark 结果和 SGLang/vLLM 部署细节,便于评估其实际可用性。
Anthropic 发布 Claude Opus 5.5,称典型按 token 计费工作负载运行成本比 Opus 5 低约 40%,输入输出 token 降价 20%,缓存读取降价 60%。
推荐理由:官方拆解了 Opus 5.5 降价与缓存机制如何配合长上下文编码会话,并给出可执行的成本优化习惯。
Cursor 官方博客介绍其智能体 harness 的多项 token 效率优化,整体将用户 token 成本降低 7% 且质量未下降。
推荐理由:Cursor 自述其 harness 层的多项 token 优化手段与量化收益,读者可以借鉴这些方法来降低长时智能体运行成本。
Cursor 推出 Rollouts 和 Security Reviewer 两款软件开发 Bots。
推荐理由:官方说明了两款 Bot 的具体工作机制和启用入口,读者可以对照自身部署与安全审查流程评估适用性。
AINews 汇总 Claude Opus 5.5 发布:作为 Claude 5.5 家族首个模型,官方称多数任务达到 Fable 5.1 水平、比 Opus 5 快约 30% 且每任务便宜约 40%,token 单价从 $5/$25 降至 $4/$20,并成为 Claude Code 与 Claude 应用的新默认模型。
推荐理由:汇总了 Opus 5.5 与 GPT-6 Sol/Luna 同日发布的基准、定价与第三方评测,含实际每任务成本与争议细节,便于对比两家宣传口径。
Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线提供智能体能力,建议机器配备 24GB 以上 VRAM 或统一内存。
推荐理由:原文给出本地运行智能体的具体配置方法和混合编排演示数据,开发者可以直接照此把智能体工作流搬到本地 GPU 上。
Anthropic 于 9 月 22 日发布 Claude Opus 5.5,约一小时后 OpenAI 发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 Luna 定价 $0.10/$0.50 每百万 token,比 GPT-5.6 Luna 再降一半;Opus 5.5 降价 20% 至 $4/$20,缓存读取价格下降 60%。
推荐理由:作者用实测和价格对比表梳理了这轮降价的具体幅度,还发现 Opus 5.5 max 档过度思考撞上输出上限的问题。