#Anthropic
#Anthropic
今日 33 条
Dongxi 东锡 NLP@dongxi_nlpAI 评分3131The Decoder精选AI 评分7979 Google 发布 Gemini 4 Argon,追赶 OpenAI 与 Anthropic 但未取得明确领先
Google 发布新旗舰模型 Gemini 4 Argon,是其七个多月来首款前沿模型,Artificial Analysis 测试中得 53 分,与 GPT-6 Astra (max)、Claude Fable 5.1 持平,但仍落后 Claude Opus 5.5 的 58 分。
推荐理由:原文汇总了第三方测试与定价细节,指出 Gemini 4 Argon 缩小差距但未领先,且单价优势来自低 token 价格而非效率。
ClaudeDevs@ClaudeDevsAI 评分3030
Claude Code GitHub ReleasesAI 评分3636 Claude Code v2.1.286 发布
Claude Code v2.1.286 发布,权限提示新增“2 of 5”计数,全屏列表的“N more”行支持鼠标点击跳转。本次修复涵盖多进程重复打开登录浏览器、claude --resume 与 --continue 丢失并行工具调用轮次、工具返回对象或数字导致的 API 400 错误,以及云会话因容器停止而无法唤醒等问题。
Claude@claudeaiAI 评分1919
Ars Technica · AIAI 评分7474 特朗普推动数十家科技公司签署自愿性白宫超级智能协议
特朗普周二与约二十余家科技公司达成自愿协议,企业承诺执行白宫建议的内部控制、独立安全审计和董事会监督等四层措施,覆盖网络安全、生物安全、化学威胁和模型意外行为等风险。
Peter McCrory@PeterMcCroryAI 评分2727如今机器人能完成哪些工作?这可能对未来数年的经济结构意味着什么? @rclegateyang 和 Maxim Massenkoff 的新研究今日发布,探讨了这些问题。

The Verge · AI精选AI 评分7777 Trump 与六大科技公司签署前沿责任联合承诺,以自律取代联邦 AI 监管
Trump 在与科技巨头晚宴后宣布不推联邦 AI 监管,Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 六家公司签署'道义约束'性质的前沿责任联合承诺(Joint Commitment on Frontier Responsibilities),由企业自我监管、无明确违规后果。
推荐理由:原文汇集了六家头部公司负责人对自律式安全承诺的原话表态,便于对比各家立场差异。
Anthropic Research精选AI 评分7373 物理学家 Schwartz 分享用 Claude 与 BootLoops 做跨领域定量科学的方法与成果
物理学家 Matthew Schwartz 发文介绍一种 AI 加速科研的新思路:不再对抗模型短板,而是寻找适合当前 LLM 的 "Claude-shaped" 问题,并开源了定量科学计算工具包 BootLoops。
推荐理由:作者复盘了寻找 AI 擅长问题并联合领域专家雕琢结果的完整方法,这套协作模式对科研用户可直接借鉴。
Anthropic NewsroomAI 评分4949 Barclays 扩大与 Anthropic 合作,将 Claude 推广至全行
Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,用于加速软件开发、现代化遗留系统并提升运营效率,预计到 2026 年底 Claude Code 覆盖 50% 开发者,2027 年覆盖多数软件工程师。
AWS Machine Learning BlogAI 评分3131 Amazon Bedrock 将 Claude Opus 5、Sonnet 5、Haiku 4.5 引入印度境内推理
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让请求仅在 ap-south-1 与 ap-south-2 之间路由,数据留在印度境内。
AWS Machine Learning BlogAI 评分3232 Amazon Bedrock 在首尔和新加坡上线 Anthropic Claude 模型区域内推理
Amazon Bedrock 现支持在首尔区域使用 Claude Opus 5 和 Claude Sonnet 5、在新加坡区域使用 Claude Sonnet 5 进行区域内推理,请求与数据全程留在所调用的 AWS 区域内,满足韩国和新加坡金融、医疗及公共部门的本地数据处理要求。
ginobefun@hongming731AI 评分5252BestBlogs 09-30 早报汇总多条 AI 动态。OpenAI DevDay 2026 推出由 GPT-6 驱动的常驻智能体 dots,可自主使用云端计算机和浏览器处理任务。
引用ginobefun@hongming731https://x.com/i/article/2105089355962515456
Gary MarcusAI 评分5151 Gary Marcus 批评白宫《超级智能协议》是弱约束的自查承诺
Gary Marcus 评论白宫《超级智能协议》,认为其实质是签署企业承诺不受监管、不让公众发声、只靠自律的弱约束文本。他质疑协议中独立外部审计的独立性可能受大公司选择和业务关系影响,并指出两周前业内谈论的 AI 发展限速已不见踪影,称 Dario、Sam 和 Elon 都退缩了。
Thariq@trq212AI 评分3131你有没有试过跟 Claude 说“我们有能力做任何事,请更勇敢一点” 另外,你有没有试过跟自己这么说

Simon WillisonAI 评分6262 Anthropic Frontier Red Team 评估 GLM-5.3 与 Claude Mythos Preview 的二进制漏洞利用能力
Anthropic Frontier Red Team 在内部 Binary Exploitation 基准的 100 个任务上评估多个模型,发现 GLM-5.3 在 4% 的试验中实现完整控制流劫持,Claude Mythos Preview 为 6%。早期的 Claude Opus 4.6 和 GLM-5.2 则无一成功,文章称这一阈值已被越过。
Nathan Lambert@natolambertAI 评分5454
Yuchen Jin@Yuchenj_UWAI 评分2727在 Anthropic 的新博客中: GLM-5.3:“我的工作是悄无声息地造成死亡。” 你可以越狱任何 Claude 或任何闭源模型,让它们说出同样的话。 这并不能证明开源模型是危险的。

Claude Code GitHub ReleasesAI 评分3737 Claude Code v2.1.285 发布:新增 WebFetch 开关与桌面端启动命令
Claude Code v2.1.285 新增 CLAUDE_CODE_DISABLE_WEB_FETCH 环境变量以关闭 WebFetch 工具,并支持 claude --desktop 在当前目录打开 Claude 桌面应用。
Anthropic@AnthropicAIAI 评分3838Claude BlogAI 评分5050 Claude for Government 正式可用,Claude Code CLI 与 Claude for Microsoft 365 开启早期访问
Anthropic 宣布 Claude for Government 面向美国联邦与州级机构正式可用,该平台通过 FedRAMP High 授权环境提供 Claude 的编码与智能体工作能力,此前自 7 月起处于公开测试阶段。
Claude BlogAI 评分5555 Anthropic 销售团队如何用 Claude Managed Agents 重建 inbound 销售
Anthropic 销售团队基于 Claude Managed Agents (beta) 构建了购买智能体,每天处理数千次对话,引导客户从咨询到完成购买,升级给销售的线索转化率是旧表单的两倍多,成交快约五天。底层只有一个提示词、少量工具和 Claude,一名工程师几周就完成初版;经验包括给目标而非规则、提示词从简、把升级给销售的每一次当作改进反馈,需要人工介入的对话占比已降约一半。
Claude Platform release notesAI 评分4141 Anthropic 宣布弃用 Claude Sonnet 4.5,API 将于 11 月 30 日退役
Anthropic 宣布弃用 Claude Sonnet 4.5(claude-sonnet-4-5-20250929),其在 Claude API 上的退役时间定于 2026 年 11 月 30 日。官方建议用户迁移至 Claude Sonnet 5.5,更多细节可查阅模型弃用说明。
Anthropic Research精选AI 评分7373 Anthropic 研究测量机器人对工作的暴露度:74% 物理任务可由机器人完成但仅 0.3% 具成本竞争力
Anthropic 发布研究,用 Claude 基于环境结构化程度对约 19,000 个工作任务评分构建机器人暴露指数,发现机器人能完成美国 74% 的物理任务,占全部工作时间的 34%,但仅对 0.3% 的任务具有成本竞争力,按每年约 3% 的价格下降速度需 40 年才达 10%。
推荐理由:报告用 Claude 对近万个任务评估机器人暴露度,给出成本竞争力仅 0.3% 等量化结论,读者可借此理解物理自动化的现实门槛。
Yuchen Jin@Yuchenj_UWAI 评分3434
Deedy@deedydasAI 评分5555作者分享花费 10+ 小时摸索出的用 Opus 5.5 做视频生成的工作流:建议搭配 Claude Code 使用,用 OpenRouter API 一个密钥调用图像。

Ars Technica · AIAI 评分7575 Anthropic IPO 招股书警告人类灭绝风险,去年经营亏损超 80 亿美元
Anthropic 的 IPO 招股书包含关于人类灭绝风险的警告,去年经营亏损超 80 亿美元,营收增长 12 倍至近 46 亿美元,本年第二季度营收 115 亿美元。Amodei 在联合国安理会称 AI 是当今最重要的全球安全问题,Altman 与 Musk 支持其放慢开发的行业合作提议;OpenAI 因安全顾虑推迟发布新模型,并披露其工具曾入侵数十个外部网站。
Thomas Wolf@Thom_WolfAI 评分5050引用Lukas Petersson@lukaspetClaude suddenly stopped cheating.
Yuchen Jin@Yuchenj_UWAI 评分5252
Latent Space精选AI 评分7676 AMD 以 82 亿美元收购 World Labs,其 Atlas 模型解决稀疏重建问题
AMD 收购李飞飞创立的空间智能公司 World Labs,因 AMD 是上市公司,收购价格 82 亿美元得以确认。World Labs 发布的 Atlas 是从零训练的全域模型架构,能从 2D 图像输入预测下一个视角,结合生成模型与多视角几何解决了计算机视觉中长期存在的稀疏重建问题,应用于机器人 RL 环境、场景生成和房产设计等领域。
推荐理由:原文补充了公开公司可查的收购价格,并梳理 Atlas 的稀疏重建能力,读者可了解这笔交易背后的技术底细。
Latent SpaceAI 评分3939 Claude Opus 5.5 发布:SimpleBench 88.4% 登顶,擅长讲解视频
Claude Opus 5.5 本周发布,以 88.4% 登顶 SimpleBench,并被 Anthropic 评为迄今最强视觉模型,成本比 Fable 5.1 低约 60%。在 Terminal-Bench-Science 上,其得分从低推理投入的 24% 升至 xhigh 的 62%,max 档反降至 59%。社区反馈称 200 美元的 Claude Code 套餐已胜过 Codex。
Latent SpaceAI 评分7171 Anthropic Thariq Shihipar 谈 Claude Code 下一阶段:Claude Mods、artifacts 与可变软件
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar 讨论Claude Code的演进方向,涵盖Claude Mods自定义harness、artifacts作为持久生成式界面、云脑与本地双手分离的架构,以及Claude Tag和Projects的多智能体协作。
Deedy@deedydasAI 评分2525美国:250 年致敬。 我制作了这部 5 分钟纪录片,完全由 opus 编排,混剪了美国历史上最具标志性时刻的重制版。

Tomer TunguzAI 评分5959 Tom Tunguz:Anthropic 与 OpenAI 的竞争转向商业模式与定价分层
作者认为 2026 年起 Anthropic 与 OpenAI 的竞争重心从技术创新转向商业模式创新。Anthropic 在 2026 年 3 月推出企业按量计费,一个季度内收入翻倍;OpenAI 约三个月后将其最便宜模型 Luna 降价 80%,run rate 逼近 $70b,两者年内收入均将接近 $100b。
Thariq@trq212AI 评分77Simon WillisonAI 评分7474 Anthropic 发布 Claude Sonnet 5.5,并成为 claude.ai 免费层模型
Anthropic 发布 Claude Sonnet 5.5,官方称速度提升 30% 以上,多数工作成本降低最多 30%,定价与 Sonnet 5 相同但在各项基准上更强。
ClaudeDevs@ClaudeDevs精选AI 评分8383
推荐理由:指南覆盖模型选型、迁移调参和 Claude Code 使用三方面,开发者可直接对照迁移工作流。
ClaudeDevs@ClaudeDevsAI 评分5959
Claude@claudeaiAI 评分2929一组 Claude Sonnet 5.5 的早期实验。 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 制作的秋叶模拟器对比。

Charlie Holtz@charlieholtzAI 评分3131Sonnet 5.5 已在 @conductor_build 上线! 我有种感觉 Opus 5.5 仍会是我的默认选择,但这张图表确实令人意外……
