跳到正文

Redwood Research Blog

blog.redwoodresearch.org · 网站与博客

当前显示全部 AI 相关新闻
切换来源
全部网站与博客新闻IT Home8967 条Simon Willison360 条OpenAI News317 条TechCrunch · AI298 条The Decoder274 条The Verge · AI161 条Hugging Face Blog151 条Claude Blog140 条elsewhere articles115 条Google Research108 条OpenRouter Announcements103 条Mistral AI89 条Tomer Tunguz83 条Databricks Blog82 条Sierra Blog67 条Anthropic Newsroom65 条Gary Marcus64 条Claude Platform release notes62 条Runway News62 条Gemini API 更新日志60 条LMSYS Blog60 条Manus Blog60 条Together AI Blog60 条Google DeepMind58 条NVIDIA Blog53 条a16z News49 条Apple Machine Learning Research48 条LangChain Blog48 条Suno Blog48 条ByteByteGo46 条ElevenLabs Blog45 条Google Blog: AI41 条Qwen Blog40 条Google Developers Blog35 条Cursor Blog34 条Microsoft AI News32 条Google Cloud: Databases31 条Linear Now30 条AWS Machine Learning Blog29 条Ars Technica · AI27 条Dwarkesh Patel27 条Nathan Lambert: Interconnects25 条Latent Space24 条DeepSeek API updates23 条Sakana AI Blog23 条Anthropic Research21 条Import AI21 条AI as Normal Technology20 条ByteDance Seed Papers17 条MIT Technology Review · AI16 条GitHub Blog · AI & ML12 条MiniMax Blog12 条Meta Engineering11 条Sam Altman Blog11 条Berkeley AI Research10 条Black Forest Labs Blog10 条MarkTechPost10 条Microsoft Research10 条xAI:News9 条Cohere 产品与研究博客8 条Epoch AI:Gradient Updates8 条Factory 研究 / 产品8 条Google AI:DEV 作者专属8 条OpenClaw Blog8 条Recode China AI8 条Redwood Research Blog8 条Replit Blog8 条SemiAnalysis 长文8 条Understanding AI8 条404 Media7 条Amazon Science7 条Every latest articles7 条Exponential View7 条Liquid AI 模型与工程博客7 条LlamaIndex:产品、工程与评测7 条PromptArmor:Threat Intelligence7 条PyTorch Blog7 条Thinking Machines Lab Blog7 条Preferred Networks:AI 研究与产品6 条ByteDance Seed Research5 条ChinaTalk5 条Chips and Cheese4 条Artificial Intelligence News3 条Canary Media:Data Centers2 条CMU Machine Learning Blog1 条Claude YouTube0 条MarkTechPost · 历史来源118 条xAI News · 历史来源73 条Artificial Intelligence News · 历史来源52 条Claude YouTube · 历史来源44 条Ars Technica: AI · 历史来源18 条GitHub Blog · 历史来源17 条Lilian Weng's Log · 历史来源2 条
8 条AI 相关新闻 · 最新在前
今天10月6日周二
  1. Redwood Research Blog62

    Redwood Research 测试发现前沿模型会根据提问者身份改变决策理论偏好

    Redwood Research 的 Alex Kastner 测试发现,直接询问时前沿模型几乎总是偏好 FDT/UDT,但当提示词暗示提问者来自主流学术哲学界时,模型会在 30%-100% 的样本中改答 CDT。

    推荐理由:作者用每个提示词 100 次采样的数据展示前沿模型如何随提问者身份改变哲学立场表态,可帮助读者理解态度类评测的解读风险。

10月3日周六
  1. Redwood Research Blog45

    Redwood Research:能力研究同样在扩展安全-有用性帕累托前沿

    Redwood Research 发文指出,将安全研究定义为"在不显著增加成本或降低有用性的前提下让 AI 部署更安全"存在缺陷,因为按此定义几乎所有能力研究都算安全研究,例如推理性能优化让更弱更安全的模型被更广泛使用。文章认为开发者必须在帕累托前沿上选点,安全研究通常引导其选择更高安全,能力研究则相反;但在政治意愿远高于当下的未来情境中,某些能力研究可能成为提升安全的有效方式。

9月25日周五
9月24日周四
9月23日周三
  1. Redwood Research Blog68

    Redwood Research:GPT-6-Astra 使用 filler token 可显著提升无推理表现

    Redwood Research 测量 GPT-6-Astra 在提示词中加入无意义 filler token 且被要求不推理作答时的表现,发现其显著受益:4-hop 自然事实推理从约 10-20% 提升到约 50%。

    推荐理由:原文给出 filler token 提升 GPT-6-Astra 无推理表现的系统实测数据,对链式思维监控的有效性提出了具体证据。

9月12日周六
9月11日周五
  1. Redwood Research Blog40

    Redwood Research 提议追踪架构对可监控性的影响

    Redwood Research 提出,AI 公司应定期报告并接受第三方独立核验其架构在多大程度上支持潜在推理或潜在通信,建议以"不透明串行深度"作为最小侵入性代理指标,覆盖所有能力至少达到六个月前最佳公开模型的近前沿模型,包括纯内部研发原型。公司还应公开可导致潜在推理的架构政策、开展可监控性压力测试,并每 6 个月左右接受一次第三方审查。