跳到正文
热点事件持续更新

Google DeepMind 发布 Gemini 4 Argon 模型

19 篇报道18 个报道来源12 小时前更新

先了解这件事

AI 综述

2026年10月1日,Google DeepMind 发布前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任测试者(初期为政府和网络防御者)开放,后续将面向开发者、企业和消费者推出。该模型面向编码、企业知识工作和网络安全防御等复杂工作流,输出上限扩至 1M tokens(此前为 64K)。Google 称其已用于内部大规模代码库迁移等流程,并将在更广泛发布前加强防范滥用、提示词注入攻击和监测错位等安全措施。性能方面,Ars Technica 称 DeepSWE v1.1 达 77.9%,高于 GPT-6 Astra、Fable 5.1 和 Opus 5.5,API 定价为每百万输入 token $2、输出 $10;Latent Space 称其自称在 19 项基准中的 13 项排名第一;Karina Nguyen 引述 PostTrainBench 得分 45.3%,高于 GPT-6 Astra 的 44.3%。但 The Decoder 称其在 Artificial Analysis 测试中得 53 分,与 GPT-6 Astra (max)、Claude Fable 5.1 持平,仍落后 Claude Opus 5.5 的 58 分。10月2日,一位 DeepMind 高级研究工程师驳斥 Bloomberg 关于该模型实际工作表现不佳的报道;Artificial Analysis 的编码 Agent 指数也将 Gemini 4 Argon 纳入评测,与 Claude Sonnet 5.5、GPT-6.1 Sol 接近榜首但成本差异大。模型仍处有限测试,普通用户暂无法使用。

AI 根据报道生成 · 8 小时前更新

事件进展

7 个进展
  1. 10月2日 08:17 · 1 篇报道
    Claude Sonnet 5.5等模型在编码代理指数中表现各异
    X:Artificial Analysis:Artificial Analysis 评测 Claude Sonnet 5.5、GPT-6.1 Sol 与 Gemini 4 Argon 的编码 Agent 表现与成本
  2. 10月2日 01:19 · 1 篇报道
    Google DeepMind研究员驳斥Bloomberg关于Gemini 4的负面报道
    X:Kim:DeepMind 工程师驳 Bloomberg 报道
  3. 10月1日 07:16 · 1 篇报道
    Nathan Lambert 评论 Google Gemini 4 发布
    X:Nathan Lambert:Nathan Lambert 评 Gemini 4:更多前沿实验室有益于竞争和世界
  4. 10月1日 05:07 · 1 篇报道
    Gemini 4新模型命名为Argon引发元素周期表命名讨论
    X:马东锡 NLP:Gemini 4 新模型为何取名 Argon?
  5. 10月1日 04:47 · 1 篇报道
    Gemini 4 Argon 模型预告
    X:fofr:Gemini 4 Argon 即将发布
  6. 10月1日 04:22 · 1 篇报道
    Yuchen Jin评论Google新模型表现优于Astra和Opus 5.5
    X:Yuchen Jin:Google 模型全面超越 Astra 与 Opus 5.5
  7. 10月1日 04:01 · 13 篇报道
    Google DeepMind 发布 Gemini 4 Argon 模型
    Google DeepMind:Google DeepMind 发布 Gemini 4 Argon,输出上限扩至 1M tokens

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. X:Artificial Analysis精选
    Artificial Analysis 评测 Claude Sonnet 5.5、GPT-6.1 Sol 与 Gemini 4 Argon 的编码 Agent 表现与成本

    Artificial Analysis Coding Agent Index 本周纳入 Claude Sonnet 5.5、GPT-6.1 Sol 和 Gemini 4 Argon,三者均接近榜首但成本差异大。

  2. X:Kim
    DeepMind 工程师驳 Bloomberg 报道

    今日最佳消息:@GoogleDeepMind 的一位 Senior Staff Research Engineer 称 Bloomberg 的报道是“胡说八道”。 Bloomberg 声称,虽然 Gemini 4 “在广泛用于衡量模型效能的基准测试中表现良好,但当员工真正将其投入工作时,表现就不那么好了。” 所以是的,这让我们更有理由期待一次出色的发布。

10月1日
  1. Latent Space
    Google DeepMind 发布 Gemini 4 Argon,支持 1M 输出 token

    Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作和网络防御,自称在 19 项基准中的 13 项排名第一,输出上限提升到 1M token(此前为 64K)。

  2. TechCrunch · AI
    Google 发布 Gemini 4 Argon,称其为迄今最强模型

    Google(Alphabet)发布新模型 Gemini 4 Argon,主打防御性网络安全,称其可自主发现、验证并修复关键软件漏洞,目前仅通过 Fairwind 安全计划向部分网络安全合作伙伴开放。该模型也用于编码、调试和代码库迁移等日常工程工作,并称在多项基准上显著领先 GPT-6 Astra 与 Anthropic 的 Fable 和 Opus。

  3. X:Nathan Lambert精选
    Nathan Lambert 评 Gemini 4:更多前沿实验室有益于竞争和世界

    Nathan Lambert 发文表示很高兴看到 Google 用 Gemini 4 给大家带来惊喜。他认为更多实验室站上前沿对消费者(竞争)和世界(减少权力集中)都有益,并期待其在真实场景中的表现。

  4. X:马东锡 NLP
    Gemini 4 Argon 等新模型发布节奏

    干净的圈子,规律的生活。几天就更新一次的 frontier,不是炫耀,是他们为数不多的爱好。 今天发布的 Gemini 氩,棒的氩口无言 9/21 — Grok 4.7 9/22 — GPT-6 Sol / Luna 9/22 — Claude Opus 5.5 9/28 — Claude Sonnet 5.5 9/29 — GPT-6.1 Sol 9/30 — Gemini 4 Argon

  5. The Decoder精选
    Google 发布 Gemini 4 Argon,追赶 OpenAI 与 Anthropic 但未取得明确领先

    Google 发布新旗舰模型 Gemini 4 Argon,是其七个多月来首款前沿模型,Artificial Analysis 测试中得 53 分,与 GPT-6 Astra (max)、Claude Fable 5.1 持平,但仍落后 Claude Opus 5.5 的 58 分。

  6. X:Demis Hassabis
    Gemini 4 Argon 前沿模型发布

    非常激动地宣布 Gemini 4 Argon,我们的全新前沿 AI 模型,在多项关键能力上迈出了一大步。我们专注于负责任地推出它,今天先通过我们的 Fairwind Program 面向政府和可信网络防御者开放,随后不久将更广泛地提供。

  7. X:Karina Nguyen
    Gemini 4 Argon 在 PostTrainBench 达 45.3%,超过 GPT-6 Astra

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,面向编码、企业知识工作和网络安全防御等复杂工作流,即日起通过 Fairwind Program 向部分受信任测试者开放。作者引述其 PostTrainBench 得分 45.3%,高于 Gemini 3.1 Pro 的 21.99% 和 GPT-6 Astra 的 44.3%;评测表还显示其在自动化与智能体编码等多项基准领先,但在 FrontierSWE v2、Terminal-Bench 4.0 等项落后于对比模型。

  8. X:马东锡 NLP
    Gemini 4 新模型为何取名 Argon?

    马东锡 NLP 提出疑问:Gemini 4 的新模型为什么叫 Argon?推文列出 Gemini 硫、氯、氩、钾、钙等按元素周期表命名的序列,并调侃按元素周期表给模型起名倒是挺简单。

  9. X:fofr
    Gemini 4 Argon 即将发布

    非常激动地分享,Gemini 4 Argon 即将到来。迫不及待想尽快跟大家分享更多内容。

  10. The Verge · AI
    Google 发布 Gemini 4 Argon,初期仅限受信任的网络防御者使用

    Google 发布新一代前沿模型 Gemini 4 Argon,称其在软件工程、法律金融等企业知识工作和网络安全防御方面具有前沿性能。初期仅向一组受信任的网络防御者开放,Google 正参与美国政府预发布模型访问的自愿流程并逐步扩大访问。模型已用于 Google 内部工作流,如大规模代码库迁移;Google 将在更广泛发布前加强防范滥用和提示词注入攻击、监测错位等安全措施。

  11. X:Josh Woodward
    Gemini 4 Argon 发布

    Gemini 4 Argon!

  12. X:Yuchen Jin
    Google 模型全面超越 Astra 与 Opus 5.5

    Google 回来了??? 全面优于 Astra 和 Opus 5.5。 如果这不只是刷榜,我很想看到他们重新加入竞赛。

  13. Ars Technica · AI
    Google 发布 Gemini 4 Argon 模型,暂未开放使用

    Google 发布 Gemini 4 Argon,称其在编码、知识工作和网络安全方面性能领先,但模型仍处有限测试,普通用户暂无法使用。DeepSWE v1.1 达 77.9%,高于 GPT-6 Astra、Fable 5.1 和 Opus 5.5;API 定价为每百万输入 token $2、输出 $10,输出上限提升至 100 万 token(此前为 64,000)。

  14. X:Ammaar Reshi
    Gemini 4 Argon 基准测试预览

    这是 Gemini 4 Argon 基准测试的预览。 今天开始向网络防御者推出,并尽快向所有人开放。 很高兴看到所有这些进展,迫不及待想让你们都用上!

  15. X:Google AI
    Google 发布 Gemini 4 Argon 前沿模型,输出上限扩至 1M tokens

    Google AI 发布新前沿模型 Gemini 4 Argon,面向复杂长程工作流的深度推理,覆盖软件工程、法律与金融等企业知识工作和网络安全防御。输出 token 上限扩大到 1M tokens,目前通过 Fairwind Program 向部分可信网络防御者推送,将尽快更广泛开放。

  16. X:Google DeepMind
    Gemini 4 Argon 前沿模型发布

    推出 Gemini 4 Argon——我们的全新前沿模型。 它专为编码、企业知识工作和网络安全防御等复杂工作流打造——今天起通过我们的 Fairwind Program 向一批受信任的测试者开放。

  17. Google DeepMind精选
    Google DeepMind 发布 Gemini 4 Argon,输出上限扩至 1M tokens

    Google DeepMind 发布前沿模型 Gemini 4 Argon,先向 Fairwind Program 的可信网络防御者开放,后续将面向开发者、企业和消费者推出。

本事件热度走势

当前热度 66·可比范围峰值 84(10月2日 12:00)·近 24 小时可比范围变化 –

025507510010月2日11:0010月2日14:0010月2日17:0010月2日20:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。