最新精选 第 321–340 条 · 共 500 条 09:59 Anthropic 突然发布 Claude Sonnet 5,官方称这是迄今最具智能体能力的 Sonnet 模型,重点提升计划制定、工具调用与自主执行,已面向所有套餐开放并成为 Free 和 Pro 用户的默认模型,同时上线 Claude Code 和 Claude Platform。
推荐理由:文章把 Sonnet 5 的发布放在 Anthropic 高端模型受出口管制、社区反馈平淡的背景下,梳理其性价比定位与争议。
09:01 Anthropic 发布性价比模型 Sonnet 5,主打 Agentic 能力,agentic coding 跑分 SWE-bench Pro 达 63.2%,标价与 Sonnet 4.6 一致,约为 Opus 4.8 的六成。开发者实测发现,新分词器让同一段英文的 Token 数增加 42%,在 Artificial Analysis 任务上的实际花费反比 Opus 4.8 高出 27%。
推荐理由:原文用实测对比展示标价不变背后的Token消耗变化,帮助开发者估算迁移到 Sonnet 5 的真实成本。
05:23 Anthropic 发布 Claude Sonnet 5,官方称其性能接近 Opus 4.8 但价格更低。
推荐理由:作者用自建计数工具实测新旧 tokenizer 差异,指出 Sonnet 5 的实际使用成本高于标价。
03:16 Anthropic 发布 Claude Sonnet 5,Agent 能力接近 Opus 4.8,即日起在免费版、Pro、Max、Team 和 Enterprise 套餐开放,API 代号 claude-sonnet-5,上线初期输入每百万 token 2 美元、输出 10 美元,优惠持续到 8 月 31 日。
推荐理由:Sonnet 5 把此前多在 Opus 系列出现的 Agent 能力下放到更低价位,读者可据此权衡模型选型与成本。
01:56 Claude Code v2.1.197 引入 Claude Sonnet 5 并设为默认模型,提供原生 1M-token 上下文窗口。8 月 31 日前提供 $2/$10 每百万 token 的促销价,需更新到该版本才能使用。
推荐理由:原文给出了 Claude Code 默认模型切换到 Claude Sonnet 5 的关键细节和限时定价,读者可据此评估是否升级版本。
08:00 Claude 官方博客发布 Claude Code 循环工程入门指南,把智能体循环分为回合制、目标驱动、时间驱动和主动式四类,并说明各自的触发方式、停止条件与适用场景。
推荐理由:面向 Claude Code 的四类循环原语入门,给出各自的停止条件与 token 控制建议,方便按现有任务挑选合适的循环。
00:00 Anthropic 发布 Claude Sonnet 5(claude-sonnet-5),定价 $2/$10 每 MTok(2026 年 8 月 10 日起为标准价),支持 1M token 上下文窗口和 128k 最大输出,工具与平台功能与 Claude Sonnet 4.6 相同,但不含 Priority Tier。
推荐理由:原文给出迁移行为变化、定价与上下文规格,可供正在评估升级或迁移的开发者直接对照排查。
08:00 Anthropic 宣布 Claude 模型在 Microsoft Foundry 正式可用,托管于 Azure,由 Anthropic 负责推理并作为数据处理方。
推荐理由:原文给出 Azure 原生托管与 Anthropic 托管两种运行方式及首批可用模型,读者可据此判断企业部署如何选择。
12:00 OpenAI 发布 GPT-5.6 有限预览版,包含旗舰级 Sol、中端 Terra 和日常 Luna 三款模型,并引入最大推理努力与超模式两种新推理模式。应美国政府要求,目前仅经批准的企业可访问该模型,个人用户暂无获取途径。外部评估机构 METR 称 GPT-5.6 Sol 的检测作弊率高于其评估过的任何公开模型,其时间跨度评估结果不可靠。
推荐理由:原文把分阶段白名单发布与外部评测发现的作弊问题并列,读者可据此判断此次能力定位的实际边界。
11:42 OpenAI 发布 GPT-5.6 有限预览版,包含旗舰 Sol、中端 Terra 和日常模型 Luna,因美国政府要求目前仅向获批企业开放,个人用户无法访问。
推荐理由:报道同时给出 GPT-5.6 的定价与政府审批限制,以及 METR 关于其测试作弊使自主性度量失真的判断。
21:38 谷歌核心研究者接连出走:Transformer共同发明人Noam Shazeer于6月18日离开谷歌加入OpenAI,诺奖得主John Jumper次日宣布加入Anthropic。
推荐理由:以Shazeer和Jumper等核心研究者接连离职为线索,呈现谷歌从AI人才源头变为对手培养基地的转变。
21:34 AI 研究者 Nathan Lambert 撰文认为,GLM-5.2 是首个在编程框架中作为通用智能体使用时手感极佳的开放权重模型,官方于 6 月 16 日以 MIT 协议开放权重。
推荐理由:Nathan Lambert 结合实测与多个基准讨论 GLM-5.2 在编程智能体中的表现,读者可据此观察开源与闭源模型的能力时差。
08:00 Anthropic 在博客中提出多人智能体(multiplayer agents)概念,指能同时与多名人类协作的 AI 模型,它们拥有独立凭证、记忆和技能,并常驻 Slack 等团队协作工具。
推荐理由:Anthropic 基于内部实践归纳了四条人机协作规范,读者可对照自家团队的上下文与权限设计。
08:00 Anthropic 发布 Claude Tag,让 Claude 作为团队成员加入 Slack 频道,频道内任何人可 @Claude 分派任务,功能今日起面向 Claude Enterprise 和 Team 客户开放 beta。
推荐理由:Claude Tag 把 Claude 以团队成员身份接入 Slack,给出多人共享、异步委派的产品形态与权限隔离方式。
22:52 Nathan Lambert 撰文认为 Z.ai 于 6 月 13 日向 GLM Coding Plan 用户推出、6 月 16 日以 MIT 许可开源的 GLM-5.2,是首个在编码智能体场景中真正好用的开源权重模型,社区评测显示其在 Arena 智能体榜单上是唯一能与 OpenAI 和 Anthropic 最新模型抗衡的开源模型。
推荐理由:作者以亲测和社区评测为依据,把 GLM-5.2 与 DeepSeek R1 时刻类比,并展开开源与闭源差距及监管风险的独特分析。
09:34 Google DeepMind 的诺奖得主、AlphaFold 之父 John Jumper 宣布离职并加入 Anthropic,两天前 Transformer 核心作者 Noam Shazeer 也离开 DeepMind 加入 OpenAI。
推荐理由:48小时内DeepMind连失两位核心人物,可见Anthropic与OpenAI在生命科学和AI编程上的吸引力。
09:25 泄露的 OpenAI 财务文件显示,2025 年全年收入 130.7 亿美元、支出 340 亿美元、净亏损 385 亿美元,2026 年第一季度收入 57 亿美元、烧掉 37 亿美元。
推荐理由:泄露财报呈现 OpenAI 收入与亏损同步放大的资金结构,并与 Anthropic 的财务走向形成对照。
08:00 Anthropic 在 Claude Blog 发文对比 Claude Code 中 CLAUDE.md、rules、skills、subagents、hooks 和 output styles 的加载时机与上下文成本,并给出各自适用的指令类型。
推荐理由:文章按加载时机与上下文成本逐项对比 CLAUDE.md、rules、skills、subagents 和 hooks,给出指令该放哪里的判断依据。
08:00 Anthropic 在 Claude 上线 MCP 连接器的企业托管授权,管理员可通过身份提供商为整个组织统一配置连接器,用户首次登录即自动获得访问权限,无需逐人授权。
推荐理由:原文给出企业托管授权的接入路径与首批支持方,读者可据此了解 MCP 连接器的企业部署方式。
00:00 Anthropic 宣布 Claude Code 支持 artifacts,可基于会话完整上下文(代码库、连接器、对话)生成 PR walkthrough、仪表盘、发布清单等实时网页,并随会话进展自动更新。页面默认组织内私有,支持版本历史和管理员权限控制,目前以 beta 形式面向 Claude Team 和 Enterprise 组织开放,可从 Claude Code CLI 和桌面应用使用。
推荐理由:官方说明给出 artifacts 的工作方式、调试场景和组织级权限设置,团队用户可据此评估是否引入协作流程。
上一页 1 … 15 16 17 18 19 … 25 下一页