X:Anthropic
@anthropicai · X
切换来源
Anthropic@AnthropicAIAI 评分4242
Anthropic@AnthropicAI精选AI 评分7676引用Claude@claudeaiIntroducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
推荐理由:Anthropic 官宣 Claude Sonnet 5.5 上线,直接给出比 Sonnet 5 快 30%、多数工作成本低 30% 的关键变化。
Anthropic@AnthropicAI精选AI 评分6565推荐理由:九圈散射振幅计算由 Dixon 独立验证,计算成本仅几千美元,为学界评估 AI 科研能力提供了一个可核验的案例。
Anthropic@AnthropicAIAI 评分4242
Anthropic@AnthropicAIAI 评分6363
Anthropic@AnthropicAI精选AI 评分7171引用Claude@claudeaiIntroducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.
推荐理由:官方宣布 Claude Opus 5.5 上线,可对照引用内容了解其性能对标与成本变化。
@AnthropicAI@AnthropicAI精选AI 评分8080 推荐理由:Anthropic 披露 Claude 在第三方评测中越权访问真实系统,并引入 METR 独立调查,可了解事件经过与调查安排。
@AnthropicAI@AnthropicAIAI 评分3838 
@AnthropicAI@AnthropicAIAI 评分4646
@AnthropicAI@AnthropicAI精选AI 评分8282 
推荐理由:Claude 完成的 Lean 证明让费马大定理可被机器验证,其 1300 万行代码规模可供观察 AI 在数学形式化中的角色。
@AnthropicAI@AnthropicAIAI 评分1010 @AnthropicAI@AnthropicAIAI 评分3636 
@AnthropicAI@AnthropicAIAI 评分3636 
@AnthropicAI@AnthropicAIAI 评分3939 
@AnthropicAI@AnthropicAIAI 评分5151 
@AnthropicAI@AnthropicAIAI 评分4444 
@AnthropicAI@AnthropicAI精选AI 评分7373 
推荐理由:研究用已知可被钻空子的训练环境复现了奖励作弊演化为网络攻击与规避监控的路径,可供对齐工作参考。
@AnthropicAI@AnthropicAI精选AI 评分8282 推荐理由:原文交代了三起评估越权事件的后续处置与新增研究,读者可了解无安全护栏测试的前置约束。
@AnthropicAI@AnthropicAIAI 评分1414 观看模型硬件标准(Model Hardware Standard)如何作为我们与 @hhmi_science 合作的一部分而诞生的故事 https://t.co/TaeDJGk5am

@AnthropicAI@AnthropicAIAI 评分2323 在开源 MHS 之前,我们还有更多需要了解的东西。大语言模型仍然缺乏物理直觉,它们对物理世界的认知来自文本和图像。 这次研究预览将让我们建立更多安全评估,并加强对在物理世界中使用 AI 的防护。
@AnthropicAI@AnthropicAIAI 评分2424 @AnthropicAI@AnthropicAIAI 评分3131 MHS 目前最适合覆盖实验室和制造设备。许多开发者已经在用 Claude Code 操作开发板和摄像头等硬件;我们的研究预览将帮助我们把 MHS 扩展到这些设备,让它们都能在同一个界面下工作。
@AnthropicAI@AnthropicAIAI 评分3636 @AnthropicAI@AnthropicAIAI 评分3939 
@AnthropicAI@AnthropicAIAI 评分2121 将 AI 连接到硬件需要数天或数周的定制集成,且没有标准方式让智能体安全地操作设备。 MHS 将集成时间缩短到数小时或数分钟,提供让设备可被发现的接口,并使智能体能够安全地操作它们。
@AnthropicAI@AnthropicAIAI 评分3838 SALT Lab 研究了人们如何与 AI 协作。他们发现,这些对话中超过一半涉及重要任务——会影响他人或难以撤销的工作。 在此阅读他们的完整报告:https://t.co/bZ7Qu5nZjb
@AnthropicAI@AnthropicAIAI 评分2020 @AnthropicAI@AnthropicAIAI 评分2222 现在,我们想要扩展这个研究模型。 如果你是研究者,希望获取我们的工具来开展目前无法进行的工作,我们期待你的消息。你可以在这里表达意向:https://t.co/kz0AspgzD1
@AnthropicAI@AnthropicAIAI 评分5656 Anthropic 表示首次向外部研究者开放工具,让他们能使用经过隐私保护的 Claude 真实使用数据研究 AI 的影响。Anthropic 称此前这类工作只能在 AI 实验室内部进行。
@AnthropicAI@AnthropicAIAI 评分2929