Google 发布 Gemini 3.5 Flash,Artificial Analysis 测试显示其 Intelligence Index 为 55 分,比 Gemini 3 Flash 高 9 分,超过 Grok 4.3 和 Claude Sonnet 4.6,输出速度超 280 tokens/s,比上一代快 70%,幻觉率从 92% 降到 61%。
原文用基准与定价的对比说明 Flash 系列的定位变化,读者可据此重新评估轻量模型的成本预期。
特么现在Flash ≠便宜了啊?
仅仅是快了吧~
Google把Gemini 3.5 Flash直接扔出来后,Artificial Analysis测完直接给出了最扎心的结论:
它在Intelligence vs Speed的Pareto前沿上,把整个行业又往前推了一大截。
Intelligence Index拿到55分,比Gemini 3 Flash高9分,直接超过Grok 4.3和Claude Sonnet 4.6。
Agentic任务(GDPval-AA)Elo评分飙到1656,远超前代。
幻觉率从92%暴降到61%。
输出速度超280 tokens/s,比上一代快70%。
多模态也继续领跑,MMMU-Pro 84%。
看起来几乎完美。
但代价是:跑一次Artificial Analysis Intelligence Index的成本,是Gemini 3 Flash的5.5倍,比Gemini 3.1 Pro贵75%。
定价直接3倍($1.5/$9 per 1M input/output)。
“Flash”这个名字,本来代表又快又便宜。
现在它代表:你终于可以用更快的速度,拿到真正旗舰级的智能,但你得为这个组合付更多钱。
Google这次是把顶级智能塞进了Flash系列,还是在用价格重新定义什么叫“轻量”?
完整基准在这里:artificialanalysis.ai/models…
兄弟们! 今天已经可以在ZenMux上免费体验Gemini 3.5 Flash 了! 我第一时间用它跑了那个经典的「AI模型递归二叉树生长测试」. 同一个 Prompt ,不同模型画出的树形态完全不一样。(见视频-Prompt见评论区) Gemini 3.5 Flash 从输入提示词到生成完整 HTML 动画网页(树干慢慢长出、分支递归展开、最后随风摇摆),全程只用了 77.56 秒! 整体效果非常惊艳:树形态自然优雅、生长动画丝滑、视频和内容呈现都顶级! 熟悉的老朋友都知道,ZenMux 每次新模型都是 ZeroDelay 首发. Google I/O 2026 今天刚发布,现在立刻就能通过 API 调用! 还有免费额度可以白嫖~ 速度是真的没话说,还完美保留了旗舰级模型的能力。 专为 Agent 设计,在 MCP Atlas、Toolathlon、Finance Agent 等多项榜单直接拿下第一! 多模态理解也极强:MMMU-Pro 83.6%、CharXiv Reasoning 84.2%,全面超越上一代 Gemini 3.1 Pro。 完全兼容主流 API 格式,无需改动现有工具链。 支持按量计费 + Builder 套餐。 👇 直接体验 正式版 → zenmux.ai/google/gemini-3.5-… 免费试用 → zenmux.ai/google/gemini-3.5-… Video在 X 查看被引用的帖子
来源:@berryxia · x.com