推出 Gemini 4 Argon——我们的全新前沿模型。 它专为编码、企业知识工作和网络安全防御等复杂工作流打造——今天起通过我们的 Fairwind Program 向一批受信任的测试者开放。
#编码
#编码
今日 26 条
Google DeepMind@GoogleDeepMindAI 评分3939
Google DeepMind精选AI 评分7474 Google DeepMind 发布 Gemini 4 Argon,输出上限扩至 1M tokens
Google DeepMind 发布前沿模型 Gemini 4 Argon,先向 Fairwind Program 的可信网络防御者开放,后续将面向开发者、企业和消费者推出。
推荐理由:官方博客给出定价、输出上限和多个基准成绩,可帮读者评估该模型在编码与安全防御场景的实际定位。
eric zakariasson@ericzakariassonAI 评分4848来看看我们 Grok Bot 市场里的工程类机器人! https://x.ai/bot/marketplace/engineering
引用Grok Bot@botGrok Bot is now more powerful for building software. Bots can hand off coding tasks to Cursor, manage your PRs with GitHub and Origin plugins, and share video demos of what they build.
Claude Code GitHub ReleasesAI 评分3636 Claude Code v2.1.286 发布
Claude Code v2.1.286 发布,权限提示新增“2 of 5”计数,全屏列表的“N more”行支持鼠标点击跳转。本次修复涵盖多进程重复打开登录浏览器、claude --resume 与 --continue 丢失并行工具调用轮次、工具返回对象或数字导致的 API 400 错误,以及云会话因容器停止而无法唤醒等问题。
eric zakariasson@ericzakariassonAI 评分3939这是我一直在用的、配合新模型构建游戏的技能 npx skills add ericzakariasson/skills --skill game-builder



LangChain Blog精选AI 评分7070 LangChain 如何在 harness 中构建模型路由器,Open SWE 单线程中位成本降 64%
LangChain 为其开源编码 Agent Open SWE 构建了模型路由器,在 973 条线程的 A/B 测试中,相比始终使用 GPT-6 Astra,中位成本从 $2.61 降至 $0.94(降 64%),PR 合并率无显著差异(29.2% vs 27.3%,p=0.49)。
推荐理由:作者用自身 Open SWE 的 A/B 数据说明路由放在 harness 内的理由和成本收益,方法可迁移到其他多任务 Agent。
Anthropic Research精选AI 评分7373 物理学家 Schwartz 分享用 Claude 与 BootLoops 做跨领域定量科学的方法与成果
物理学家 Matthew Schwartz 发文介绍一种 AI 加速科研的新思路:不再对抗模型短板,而是寻找适合当前 LLM 的 "Claude-shaped" 问题,并开源了定量科学计算工具包 BootLoops。
推荐理由:作者复盘了寻找 AI 擅长问题并联合领域专家雕琢结果的完整方法,这套协作模式对科研用户可直接借鉴。
Anthropic NewsroomAI 评分4949 Barclays 扩大与 Anthropic 合作,将 Claude 推广至全行
Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率,预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。
Qwen@Alibaba_QwenAI 评分3737Qwen3.8-27B 现已通过 @nebiustf 开放使用。无论你是在构建智能体还是做深度研究,这个 27B 稠密模型都已为你的多步骤工作流准备就绪!🥳
引用Nebius Token Factory@nebiustfQwen3.8-27B is now live on Nebius Token Factory. A compact 27B dense model for coding, research, and agent workflows, with a focus on planning and completing tasks across multiple steps. Start building: https://tokenfactory.nebius.com/endpoints?modals=endpoint-details&model-id=Qwen/Qwen3.8-27B
ginobefun@hongming731AI 评分4646引用Tw93@HiTw93想给大伙随便聊聊如何给产品进行一次图标升级,有哪些需要注意的以及可以优化的点。 早上给 Mole 的图标进行了一次精细化的升级,之前使用的是系统的图标,对于简单的产品场景我感觉完全够用,不过细看会感觉缺少一点灵性的感觉。 经过调研,比较适合做 App 产品 Icon 的有 Remix Icon 和 Phosphor Icon这两个,之前写 Web 的时候用 Remix 很多,简单舒服,但是放到 App 上我感觉不是很好看,于是就换上了 Phosphor 这个,展示效果很有灵性,非常不错,差不多有 70% 左右,可以不修改直接使用,然后有 30% 的图标是我用 opus 5.5 来写SVG 自绘的,这样整体更加一致。 可能大伙直接看下面的对比图很难感觉到两者的区别,很多时候需要实际放到真实的产品里面去,我一般还会考虑到本身这个模块下一组图标的搭配感,有时候全部图标单个都好看,组合到一起就不好看的情况也有,好比一个人每一个五官单独出来都好看,但是放到一个脸上却不那么好看,这里建议就是图标的根更换你一定要放到实际的产品里面去看,放到一起去看,才会有比较好的效果。 其次,我一直想着,我们做的产品应该是有灵性的,有生命的那种感觉,而非直接 AICoding 不经任何你的思考出来的那种冷冰冰的编译产物,这个时候小细节比如icon会是给这个产品带来生命力的一个很好的切入点,比如大伙看 保持常亮我使用的是 一杯咖啡,这里会有一种 Caffeine 比喻,就是让你的电脑好像喝了咖啡一样睡不着的感觉,然后关于一般会用一个感叹号,但是我想着应该是 hello,所以就用的挥手的标志,诊断正常会有排查的那种标志,但是这里使用的是一个听诊器的标志,更像是给你的问题做一次医生检查,类似这样,很多时候,可以在产品里面加入不少你的小巧思,会让整体有趣很多。 最后,好看的设计几乎都离不开对齐、整齐、错落有致这些原则,如何在人眼看到的场景下让图标和内容以及上下模块看起来是整齐的、大小一致的,甚至是上下居中对齐的,都需要一个一个去看,去调整,包括字体和icon的对齐,以及字体里面中英文本身也没有垂直对齐应该如何优化,类似这样的,可以精雕细琢很久,非常有意思。 这种看似无用功,其实是我很喜欢做的事情,AI 可以给优秀编码、及格审美带来非常大的促进,人看着好像不要做啥了,只要动动嘴就好,反而我认为不是的,人在这里的作用更大了,AI 帮你节约的时间,刚好可以放到打磨产品上,让1%的用户有种用你产品的时候,时不时有一种秒懂、卧槽、变魔术的感觉,那就非常非常有价值和意思了,或许这也是我认为做独立产品有意思的地方。
OpenAI Developers@OpenAIDevsAI 评分2727准备好来一场 DevDay 支线任务了吗? 10 个开发者挑战。 5 个 Codex Micro 等你来拿。 完成任意 5 个支线任务,即可为每个任务获得 1 张抽奖券。 48 小时。随时随地参与 🌎

Claude Code GitHub ReleasesAI 评分3737 Claude Code v2.1.285 发布:新增 WebFetch 开关与桌面端启动命令
Claude Code v2.1.285 新增 CLAUDE_CODE_DISABLE_WEB_FETCH 环境变量以关闭 WebFetch 工具,并支持 claude --desktop 在当前目录打开 Claude 桌面应用。
Andrew Milich@milichabAI 评分4646引用Cursor@cursor_aiCursor can now build charts and diagrams right in the chat. Use /visualize to analyze data and see the answer inline. Available now in the Agents Window.
OpenAI Developers@OpenAIDevsAI 评分5555OpenAI 发布 Codex CLI 重大更新,带来新外观和更强能力。更新包括全新全屏界面、更好的可读性,以及管理并行任务的新方式,全部在终端内完成,OpenAI 表示将继续为命令行开发者投入。

OpenAI@OpenAIAI 评分5656
Claude BlogAI 评分5050 Claude for Government 正式可用,Claude Code CLI 与 Claude for Microsoft 365 开启早期访问
Anthropic 宣布 Claude for Government 面向美国联邦与州级机构正式可用,该平台通过 FedRAMP High 授权环境提供 Claude 的编码与智能体工作能力,此前自 7 月起处于公开测试阶段。
Yuchen Jin@Yuchenj_UWAI 评分3434OpenAI News精选AI 评分7070 OpenAI 发布 GPT-6.1 Sol,以 Astra 五分之一的价格提供近 Astra 智能水平
OpenAI 发布 GPT-6.1 Sol,定位为接近 Astra 智能水平的模型,主打编码、计算机使用和专业工作场景,价格为 Astra 标准 API 输入和输出 token 价格的五分之一。
推荐理由:原文明确了模型定位与五分之一的价格对比,读者可以据此评估在不同工作负载下替换现有模型API的成本空间。
Yuchen Jin@Yuchenj_UWAI 评分5252
Latent Space精选AI 评分7676 AMD 以 82 亿美元收购 World Labs,其 Atlas 模型解决稀疏重建问题
AMD 收购李飞飞创立的空间智能公司 World Labs,因 AMD 是上市公司,收购价格 82 亿美元得以确认。World Labs 发布的 Atlas 是从零训练的全域模型架构,能从 2D 图像输入预测下一个视角,结合生成模型与多视角几何解决了计算机视觉中长期存在的稀疏重建问题,应用于机器人 RL 环境、场景生成和房产设计等领域。
推荐理由:原文补充了公开公司可查的收购价格,并梳理 Atlas 的稀疏重建能力,读者可了解这笔交易背后的技术底细。
Latent SpaceAI 评分7171 Anthropic Thariq Shihipar 谈 Claude Code 下一阶段:Claude Mods、artifacts 与可变软件
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar 讨论Claude Code的演进方向,涵盖Claude Mods自定义harness、artifacts作为持久生成式界面、云脑与本地双手分离的架构,以及Claude Tag和Projects的多智能体协作。
Hugging Face Daily PapersAI 评分3333 Rules to Tools:为科学计算中的 LLM 智能体提供可执行检查
Rules to Tools(R2T)为科学计算场景的 LLM 智能体提供公开科学需求的可执行检查,在 SciCode 修复任务中,工具组完整修复达 29/30,纯文本组为 26/30。
Hugging Face Daily PapersAI 评分3333 CorrGRPO:面向多奖励学习的相关性归一化 GRPO
CorrGRPO 提出将 GRPO 中成对奖励协方差归一化为皮尔逊相关系数,在不改变中心化总奖励的前提下,平衡不同尺度奖励对归一化的影响,避免大尺度奖励主导优势值计算。研究者在代码生成、工具调用和智能体安全三类任务上,使用 0.5B 至 8B 参数的模型进行对比,结果显示 CorrGRPO 在三项任务上均优于 GRPO 及其他变体。代码已开源。
AWS Machine Learning BlogAI 评分4848 xAI 的 Grok 4.7 上线 Amazon Bedrock
xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,支持 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过跨区域推理配置在 bedrock-runtime 端点提供服务,兼容 Responses、Chat Completions 和 Converse API。
Simon WillisonAI 评分7474 Anthropic 发布 Claude Sonnet 5.5,并成为 claude.ai 免费层模型
Anthropic 发布 Claude Sonnet 5.5,官方称速度提升 30% 以上,多数工作成本降低最多 30%,定价与 Sonnet 5 相同但在各项基准上更强。
ClaudeDevs@ClaudeDevs精选AI 评分8383
推荐理由:指南覆盖模型选型、迁移调参和 Claude Code 使用三方面,开发者可直接对照迁移工作流。
ClaudeDevs@ClaudeDevsAI 评分5959Databricks Blog精选AI 评分6565 Databricks 如何让 12,000 名员工在模型发布首日即可用新模型
Databricks 介绍其通过 Unity Gateway 让全体员工在 Opus 5.5、GPT-6 Sol 和 GPT-Luna 发布首日即获得实验性访问的完整流程:先用实验标签和按用户预算(月度上限、每日 runaway 限额、质量前沿预算、实验预算四类)控制风险,再依据内部基准、用户反馈和 OpenTelemetry 成本追踪评估。
推荐理由:原文给出企业内部让全体员工 Day 1 用上新模型的完整流程和成本数据,方法可迁移到类似的模型接入评估场景。
AWS Machine Learning Blog精选AI 评分7575 Claude Sonnet 5.5 上线 Amazon Bedrock 及 AWS Claude Platform
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 可用,定位为更聪明高效、多数任务单次成本更低且速度更快的编码与知识工作模型。
推荐理由:官方介绍了 Sonnet 5.5 在 Bedrock 的能力定位、与 Opus 5.5 的分工和入门调用方式,方便评估接入路径。
ClaudeDevs@ClaudeDevs精选AI 评分7474
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:原文给出 Sonnet 5.5 相对 Sonnet 5 的速度、成本与适用任务,开发者可据此判断是否切换日常 Claude Code 用法。
Boris Cherny@bchernyAI 评分6161
引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
Claude Code GitHub ReleasesAI 评分5555 Claude Code v2.1.284 发布,新增 Claude Sonnet 5.5 为默认模型
Claude Code v2.1.284 新增 Claude Sonnet 5.5(claude-sonnet-5-5),作为 Anthropic API 默认 Sonnet 模型,支持 1M 上下文,定价 $2/$10 per Mtok、缓存读取 $0.20/Mtok。
Google Cloud: DatabasesAI 评分4242 Google Earth Engine 推出 Ask 功能,在代码编辑器中集成 Gemini 辅助地理空间编程
Google Earth Engine 推出新功能 Ask,将 Gemini 能力直接集成进 Code Editor,用户可用自己的 Gemini API key 编写、调试、理解和优化地理空间查询。
François Chollet@fcholletAI 评分5353
Deedy@deedydasAI 评分3838
OpenAI NewsAI 评分2222 OpenAI 征集 Codex Originals 用户故事
OpenAI 启动 Codex Originals 项目下一阶段,征集使用 Codex 的开发者、研究者与创作者的真实故事和项目。参与者需提交自己的故事与项目介绍,入选者将参与该项目的新篇章。
Simon WillisonAI 评分7474 Simon Willison 演讲盘点 2026 年 LLM 大事记
Simon Willison 在 WeAreDevelopers World Congress North America 发表闭幕主题演讲,按时间线盘点 2026 年 LLM 领域的关键进展,附注释版幻灯片。
Deedy@deedydasAI 评分3030引用Flo Crivello@AltimorCI has become the top bottleneck of every engineering team I talk to (including Lindy). Our CI spend has become stratospheric.
MiniMax (official)@MiniMax_AIAI 评分4747引用MiniMax_Agent@MiniMaxAgentMiniMax's latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it's fast, reliable, and ready for real work, from quick bug fixes to full features.
Anthropic Newsroom精选AI 评分8585 Anthropic 发布 Claude Sonnet 5.5:速度提升 30% 以上、单任务成本最多降 30%
Anthropic 发布 Claude Sonnet 5.5,为 Claude 5.5 家族第二款模型,生成速度比 Sonnet 5 快 30% 以上,测试中单任务成本最多低 30%。
推荐理由:官方发布给出了与 Sonnet 5 和 Opus 5.5 的多项基准对比、定价和成本数据,读者可以据此判断它在自己场景下是否值得迁移。