跳到正文

OpenRouter

OpenRouter 模型路由平台动态:新模型上架、用量排行与开发者选型的真实市场信号。

当前仅显示精选新闻

最新精选

第 21–40 条 · 共 85 条
9月12日周六
  1. @OpenRouter72

    OpenRouter 数据显示,DeepSeek V4.1 Flash 上线 24 小时消耗 1T token,按当前速度 48 小时预计达到约 2.8T,有望成为付费模型发布中 48 小时用量最高的一次。其中 90% 的 token 为缓存读取,市场价格约 $0.006/M,比 GLM-5.3 Flash 等同类模型便宜 5 倍。

    推荐理由:OpenRouter 的用量曲线显示 DeepSeek V4.1 Flash 上线 24 小时消耗 1T token,可作为观察付费模型早期采用节奏的横向参照。

9月10日周四
9月9日周三
  1. OpenRouter Announcements62

    OpenRouter 推出美国区域路由,与去年上线的 EU 路由配套保障数据驻留

    OpenRouter 发布美国区域路由 us.openrouter.ai,与去年 10 月上线的 eu.openrouter.ai 配套,请求在区域内解密并只路由到区域内提供商,全程不出区。

    推荐理由:原文区分了推理级与端到端区域路由的差异,并说明区域域名、404 行为和 Guardrails 配置,读者可直接评估合规用法。

9月8日周二
  1. OpenRouter Announcements73

    OpenRouter 推出 Shell 工具、容器与 Files API

    OpenRouter 发布 openrouter:shell 服务端工具、openrouter:bash 工具和 Files API,让平台上任意支持工具调用的模型都能在托管 Linux 容器中执行命令,目前以 beta 提供。

    推荐理由:原文给出了定价、容器网络与文件管理等具体配置细节,可帮助读者评估在现有 Agent 工作流中如何复用这套服务端沙箱。

9月5日周六
9月3日周四
8月28日周五
  1. @OpenRouter76

    GLM-5.3 现已开放权重,并上线 OpenRouter,具备 1M 上下文和可配置的推理力度。该模型由 @Zai_org 发布,面向复杂软件工程、长程智能体和网络安全场景。Zai 称这是其在智能体编程与网络防御方面能力最强的模型,权重可供下载、运行和定制。

    引用@Zai_org@Zai_org

    GLM-5.3 is now open-weight. Our most capable model for agentic coding and cyber defense is now available to download, run, and customize. Weights: https://t.co/v1IbWMXxg4 Tech blog: https://t.co/ekQkO83jCv https://t.co/f8XlJksKyf

    推荐理由:GLM-5.3 以开源权重上线托管平台,1M 上下文与可调推理力度可供开发者直接接入评估。

8月27日周四
  1. 量子位 · 微信公众号81

    智谱发布并开源 GLM-5.3 Flash,为 GLM-5 系列首个原生多模态模型

    智谱发布并开源 GLM-5.3 Flash,这是 GLM-5 系列首个原生多模态模型,总参数 320B、激活参数 18B,能力超过体量 753B 的 GLM-5.2。该模型在 AA 榜单拿到 57 分,与 Claude Opus 4.8 持平,限时折扣价为后者的 1/40,并已接入 ZCode 和开放 API。模型权重已在 Hugging Face 开源,承接线上真实请求的算力来自国产芯片。

    推荐理由:实测呈现了这个 320B 模型在多模态与编码任务上的表现,并交代了低价与国产芯片部署两层背景。

8月26日周三
  1. @AYi_AInotes70

    彭博确认在 OpenRouter 匿名屠榜的 Ox Alpha 是智谱 GLM 系列的新迭代,今晚将直接开源放权重。

    原始视频预览图;未保存可播放视频URL
    引用@AYi_AInotes@AYi_AInotes

    牛来大模型刚被彭博社破案了! 在 OpenRouter 上悄悄屠榜、调用量超过 DeepSeek 一倍的神秘模型 Ox Alpha, 背后竟然是智谱,更绝的是官方确认今晚直接开源权重, 狂刷了数十万亿 token、在真实 Coding 里跑出 80% 峰值,智谱这次是真的要杀疯了, 前阵子大家都在猜这个匿名模型到底是哪家大厂的马甲, 因为它在排位赛上狂刷了数十万亿 token, 开发者用脚投票把它送上了第一, 它真正狠的地方,是把 Flash 级别的速度和成本,做出了中上游前沿模型的实战能力: 1M 超长上下文、原生支持图片和视频多模态, 而且是推理优先的架构,写代码时会先做规划再调工具 社区独立跑测试,在 10 个高难度真实 Coding 任务里拿下了 80% 的过关率, 全量 DeepSWE 跑出 64.6%, 直接咬住了 Claude Opus 4.8 和 Gemini 3.7 Flash 的身位 它不是那种打虚空跑分的绝对 SOTA, 但一个成本极低、速度极快、能看懂视频还能写复杂代码的 Flash 模型, 今晚一旦把权重放出来,无论是本地部署还是第三方 API,生态杀伤力完全不可同日而语 刚发完开源顶流 GLM-5.3,转头就把这个高频 Agent 生产力核弹开源出来, 大模型的竞争,终于从比拼谁的参数更大,彻底转向谁能让开发者用最低成本把活干完了啊

    推荐理由:匿名屠榜模型被确认为智谱 GLM 新迭代并将开源权重,读者可了解它对第三方 API 与本地部署成本的影响。

  2. @AYi_AInotes68

    彭博社报道称,在 OpenRouter 排行榜上登顶的匿名模型 Ox Alpha 由智谱开发,智谱将开源其权重,该模型目前仍免费使用。按帖中说法,它是以推理优先架构设计的编码与智能体模型,原生支持文本、图像和视频输入,社区测试在 10 个高难度真实 Coding 任务中取得 80% 过关率,全量 DeepSWE 为 64.6%。作者还提到智谱此前刚发布开源模型 GLM-5.3。

    推荐理由:彭博社确认匿名模型 Ox Alpha 出自智谱并将在今晚开源权重,读者可了解它的真实来源与开放安排。

  3. IT Home76

    智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20

    智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。其在 Artificial Analysis Intelligence Index 取得 57 分,与 Claude Opus 4.8 持平,自研 Z.ai Code Bench 体感评估中编程表现也与之相当。

    推荐理由:320B 总参数仅激活 18B 的架构设计搭配限时 1/20 定价,可供判断开源前沿模型的成本竞争区间。

8月25日周二
  1. @alibaba_cloud68

    Wan 3.0 已在 OpenRouter 上线,支持从文本、图像或参考素材生成 2–30 秒视频,最高 1080p。OpenRouter 公布的上线定价为 480p、720p、1080p 每秒 $0.05、$0.10、$0.20,全分辨率限时 15% 折扣。阿里云同时给出 Model Studio 与 Qwen Cloud 两个 API 接入入口。

    引用@OpenRouter@OpenRouter

    Alibaba's Wan 3.0 from @Alibaba_Wan and @alibaba_cloud is now live on OpenRouter. Generate 2-30 second videos from text, images, or references at 480p, 720p, or 1080p. Launch pricing: $0.05/$0.10/$0.20 per second, with a limited-time 15% discount across every resolution. https://t.co/yzQNUKAo3o

    推荐理由:官方给出 2–30 秒、最高 1080p 的生成规格与 OpenRouter 接入入口,可据此评估视频生成的调用成本。

  2. OpenRouter Announcements60

    OpenRouter 发布 Video Generation API 代码指南,一个端点调用 Seedance、Veo、Wan

    OpenRouter 发布视频生成 API 教程,通过 POST /api/v1/videos 提交任务、轮询状态、下载 MP4,同一集成可用 Seedance 2.0、Veo 3.1、Wan 2.7,切换模型只需改 model 标识符。

    推荐理由:OpenRouter 官方教程给出完整的异步视频生成集成代码,包括轮询、失败状态处理和换模型时需注意的参数差异,可直接迁移到自己的项目。

  3. OpenRouter Announcements70

    OpenRouter 发布选型教程:如何用 MCP 服务器在编辑器内选最合适的 AI 模型

    OpenRouter 发布模型选型教程,提出六步框架:定义任务、用实时使用数据和第三方基准筛选候选、对比各提供商价格与延迟、用自己的提示词测试、按每次完成任务的成本而非每 token 成本衡量,再决定或改用 openrouter/auto-beta 按请求路由。

    推荐理由:OpenRouter 官方给出以成本每完成任务为核心的选型框架,并用自家 MCP 服务器让整个评测流程在编辑器内完成。

8月24日周一
  1. @OpenRouter65

    OpenRouter 宣布隐身模型 ox-alpha 在其平台上线,单日 token 用量接近 6 万亿。配图显示该模型上线前三日 token 量达 11.6T,是 OpenRouter 历史上规模最大的模型发布,为第二名发布量的 2.6 倍。开发者可通过 ori 在编码智能体中调用,命令为 `ori [your favorite harness] --model stealth/ox-alpha`。

    推荐理由:配图给出该模型与历史发布横向对比的 token 用量,读者可据此判断它的实际调用规模。

8月22日周六
  1. @OpenRouter65

    OpenRouter 说明 Thinking Machines Lab 模型的提示词和输出会被记录并用于改进其模型,会话数据会先与账号解绑,完整条款见各模型页面。开放权重采用 Apache 2.0,通过 API 访问这些免费端点适用单独条款。

    推荐理由:原文说明这些免费端点的提示词与输出会被记录用于改进模型,开放权重为 Apache 2.0,读者可据此判断数据与授权条款。