跳到正文

#产品更新

今日 79 条
9月2日周三
  1. Google Blog: AI53

    Google 推出 Fairwind Program,向政府和企业开放 Gemini 3.8 Flash Cyber 网络防御能力

    Google 发布 Fairwind Program,为政府和可信合作伙伴提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,用于自主发现并修复漏洞,可在组织安全云环境内数分钟生成经验证的补丁。该计划初期面向政府、关键基础设施运营方和核心技术平台开放,已有超过 650 个合作伙伴参与;同时 Google.org 将全球网络安全资金累计提升至超过 1 亿美元。

  2. Runway News46

    Runway 推出 Runway Dev MCP 托管服务器,让编码智能体接管集成全流程

    Runway 发布 Runway Dev MCP,一个将 Runway Dev 账户接入 Claude、ChatGPT、Codex、Cursor 等编码工具的托管 MCP 服务器。智能体可自主查询模型价格与能力、拉取请求 schema、配置 Model Router 并按成本、延迟或质量优化,还能创建 Characters、排查生成失败原因,token 效率更高。添加为自定义连接器即可使用。

  3. Runway News35

    Miro 如何用 Runway 为四地市场制作 Canvas26 主题演讲视频

    Miro 品牌团队完全用 Runway 生成 Canvas26 年度活动开场视频,并针对 4 个城市分别制作本地化版本,所有城市景观、人群和入场镜头均由 Runway 生成,再叠加动效与品牌元素。团队用场馆照片作为 Runway 参考图生成对应地点的电影感入场镜头,并借助 Runway 原生生成非标准宽高比画面,避免 4K 素材裁切损失分辨率。

  4. Google DeepMind68

    Google DeepMind 为 Gemini 推出 agentic video understanding 视频分析功能

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,动态检索视频片段以替代固定帧率处理,token 消耗最多降 88%,成本最多降 66%,准确率最多提升 7%。

    推荐理由:官方给出 token、成本与准确率的具体降幅和开启方式,长视频处理场景下可评估是否切换处理模式。

9月1日周二
8月29日周六
  1. LMSYS Blog60

    SGLang 发布 SSD Expert Pack,在消费级硬件上运行 DeepSeek-V4-Flash 和 Kimi-K3

    SGLang 将 SSD-LLaMA 的核心思路引入 MoE 推理,把放不进 VRAM 和内存的路由专家权重放在 NVMe SSD 上,通过 Expert Pack 连续布局、O_DIRECT 直接 I/O、pinned 暂存和 GPU 缓存,只加载 router 选中的专家。

    推荐理由:原文给出完整机制说明和单卡实测数据,读者可以据此评估 NVMe SSD 承载超大 MoE 模型的可行性。

8月28日周五
8月27日周四
  1. Michael Truell65

    Michael Truell 宣布 Grok Bot 现已向所有标准 Grok 或 Cursor 订阅用户开放,并表示其增长快于他们见过的任何产品。引用内容提到所有 SuperGrok 和 Cursor Pro 订阅者已可用 Grok Bot,且为所有用户重置了每周使用限额。作者称用户把电商运营(支持、广告、库存、财务)、协调客户活动、测试生产软件等任务交给 Grok Bot。

    引用Grok Bot@bot

    All SuperGrok and Cursor Pro subscribers now have access to Grok Bot. We're also resetting weekly usage limits for all users. Enjoy!

    推荐理由:作者列出用户实际交给 Grok Bot 的任务范围,读者可据此判断它在真实工作流中的落地程度。

  2. Lee Robinson39

    我们也没忘了 @Bot…… 现在所有付费用户都可以使用了。每月 $20 就能改变你用电脑工作的方式! 我们已为所有 Bot 用户重置了每周使用限额。试试看吧!

    引用Lee Robinson@leerob

    We just increased the included usage of Grok models in Cursor! Demand has been increasing with the launch of Grok 4.6. We already doubled limits last month with more compute. And now we're raising limits again permanently. Enjoy!

  3. Google DeepMind65

    Google DeepMind 发布语音转写模型 Gemini 3.5 Transcribe

    Google DeepMind 推出语音转文字模型 Gemini 3.5 Transcribe,定位为更精确的实时转写模型,已在 Gemini API(Google AI Studio 和 Gemini Enterprise Agent Platform)开启公开预览。

    推荐理由:官方给出了两个 API 入口、WER 数字和与 Chirp 3 的对比,读者可据此评估其语音转写与语音交互场景的可用性。

  4. Anthropic Newsroom60

    Anthropic 开启 Model Hardware Standard 研究预览,让 AI 智能体安全操控实验与制造设备

    Anthropic 开放 Model Hardware Standard(MHS)研究预览,这是让 AI 智能体安全操作物理设备的标准规范,首批面向科研实验室和先进制造商,可将原本需数周至数月的硬件集成缩短到数小时或数分钟。

    推荐理由:官方介绍 MHS 标准化驱动如何把硬件集成从数周缩到数分钟,并给出多家机构实测用例,对关注智能体操控实体设备的读者有参考。

8月26日周三
  1. Google Developers Blog35

    Google Cloud 在 Cloud TPU 上为 vLLM 带来企业级长上下文多模态嵌入推理

    Google Cloud 将原生 TPU 支持集成进 vLLM,用于在 Cloud TPU 上服务 Qwen3-Embedding 系列嵌入模型,支持 4K+ token 文本与 15K+ token 多模态输入的长上下文。团队针对 TPU 做了词表 padding、懒加载初始化与 StepPool 长上下文等优化,并以余弦相似度验证数值一致性,文本目标阈值 ≥0.999、多模态 ≥0.995。

  2. Claude Blog73

    Claude Cowork 桌面端内置浏览器上线

    Anthropic 在 Claude Cowork 桌面应用中内置浏览器,Claude 可自主导航网页、阅读、点击、填表,本周起向 Pro、Max 和 Team 计划推送,Enterprise 管理员即日起可开启。

    推荐理由:官方说明了内置浏览器与 Claude in Chrome 的分工、登录方式和安全边界,读者可据此判断网页类任务该交给哪条路径。

8月25日周二
  1. Hugging Face Blog69

    Gradio 推出 gr.Workflow:把 AI 管线变成可拖拽、可部署的节点图

    Hugging Face 在 Gradio 中内置 gr.Workflow,将 AI 应用管线描述为带类型的节点图,在同一画布上提供可运行节点、可视化中间结果、REST API 和一键部署到 Hugging Face Spaces。

    推荐理由:官方介绍了 gr.Workflow 的节点图机制和多条可复制的示例工作流,读者可以据此评估它能否替代手工拼装 Python 管线。

8月23日周日
8月22日周六
  1. Z.ai26

    社区已经用 ZCode + GLM-5.3 做出了这么多有趣的项目。 为了感谢大家的支持,我们把 Build Week 变成了一个持续进行的系列活动。 从现在起到 8 月 23 日下午 6 点(太平洋时间),我们将为 50,000 名 ZCode 新用户每人赠送 100M 免费 GLM-5.3 tokens。

    引用ZCode@zcode_ai

    GLM-5.3 × ZCode Weekend Build, Round 2 🚀 New users: log in to ZCode for the first time from Aug 22, 00:00 to Aug 24, 09:00 (UTC+8) and automatically get 100M free GLM-5.3 tokens. 50,000 packs, first come, first served; ZCode only. Unused tokens expire when the event ends. Grab yours: http://zcode.z.ai

8月21日周五
  1. OpenRouter Announcements62

    OpenRouter 上线 Visual Image Benchmarks 覆盖 39 个图像模型

    OpenRouter 发布 Visual Image Benchmarks,帮助用户评估其平台上的 39 个图像模型(截至 2026 年 8 月)。挑战提示词分七类:不太可能的场景、计数、文字、空间关系、否定、编辑和一致性,结果以网格展示并支持按价格和生成时间排序。视频和音频等更多模态的评估即将推出,用户也可通过 OpenRouter API 或 Chat 试用模型。

    推荐理由:原文给出七类挑战提示词和按价格与生成时间排序的结果网格,读者可直接用它对比 39 个图像模型的真实能力。

  2. Hugging Face Blog65

    Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理吞吐最高提升 3.2x

    Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三个模型发布 DSpark 草稿模型 checkpoint,通过投机解码在不改变输出质量的前提下加速推理,GPU 吞吐最高提升 3.18x,端侧最高 2.87x。

    推荐理由:官方为 LFM2.5 三款模型发布 DSpark 草稿模型,给出从 H100 到 MacBook 的实测加速数据和开源接入方式。

8月20日周四
  1. Mistral AI66

    Mistral 发布 Agentic Search,多步检索在 FinanceBench 上将准确率从 26.7% 提升至 86%

    Mistral 发布 Agentic Search,通过 search、open、navigate、read、grep 五个工具让模型多步检索、翻阅并验证复杂文档,可通过 Mistral Search Toolkit 及 Studio 和 Vibe 中的 Libraries 使用,无需微调。

    推荐理由:官方给出多步检索循环的完整工具设计和两个基准的具体数字,读者可据此评估它替代一次性 RAG 的适用场景。