跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

当前仅显示精选新闻
416条精选相关主题模型发布行业动态AI 编码

最新精选

第 121–140 条 · 共 416 条
9月1日周二
  1. Gemini API 更新日志64

    Gemini API 为 Flash 系列模型推出智能体式视频理解

    Google 在 Gemini API 中为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体式视频理解,覆盖 Interactions 和 GenerateContent 两个 API。模型可动态导航视频时间线,按需请求转录文本、帧或音轨,长视频内容相比静态处理的 token 用量最多减少 88%。

    推荐理由:官方更新日志给出按需取用视频素材的机制和 88% token 节省数字,便于评估长视频处理的成本变化。

8月31日周一
  1. MiniMax 稀宇科技 · 微信公众号66

    MiniMax 将 H3 Max 768P 与 480P 接入开放平台,支撑实时 AI 直播

    MiniMax 将 H3 Max 768P 与 H3 Max 480P 接入开放平台和 MiniMax Design。H3 Max 生成 5 秒 768p 音视频不到 3 秒,吞吐量约为 MiniMax H3 的 35 倍;fal 工程师和 Pieter Levels 已基于它搭建 Twitch 实时直播与 24 小时 AI 直播网站。

    推荐理由:官方给出 H3 Max 的生成速度、吞吐量对比和接入入口,读者可以判断实时 AI 直播这类场景是否已经跑得通。

8月30日周日
  1. @testingcatalog67

    OpenAI 再次为 Codex 和 ChatGPT Work 的全部付费用户重置用量额度,并修复多项用量消耗问题,用户整体可用量比此前多出 10% 到 50%。官方公布的修复包括 compaction 阶段遗留旧图片导致重复压缩、后台 memory worker 继承 Stop hooks 无法停止、set /goal 超出停止条件继续运行、自定义 automations 执行频率高于配置、子智能体未经要求调用更强模型,以及 Computer History 重复汇总重叠活动、普通回合触发额外后台请求、MCP 工具结果被重复编码等,并称已做架构调整防止回退。官方还表示正在开发在应用内直接展示用量去向的功能。

    引用@thsottiaux@thsottiaux

    We are reseting usage for all paid users of Codex and ChatGPT Work. Please continue reading for an update on Codex usage limits. The team has been working around the clock, going through thousands of reports and shipping fixes. Depending on how you use Codex, you should see your usage go between 10% and 50% further than before. We really went with a fine comb, with many uncovered small things being longstanding and here is what we found and fixed: - Compaction. We were keeping old images during compaction, sometimes making the context large enough to trigger compaction again. After the fix, usage dropped around 10% for users making heavy use of images. Fixed. - Memory. Background memory workers could inherit Stop hooks and keep running when the hook wouldn’t let them finish. This affected fewer than 1% of users, with the long tail being pretty bad and we saw one example thread check whether it could stop 15,000 times. Fixed. - Goals. In some cases, a set /goal could finish and then keep going past the intended stop condition, or the model would keep retrying broken tools without stopping. We saw examples consume anywhere from 15% to 70% of a weekly allowance. Fixed. - Automations. Some custom schedules could run more frequently than configured. Fixed. - Subagents. Smaller models (e.g. Luna) sometimes picked more capable helpers without being explicitly asked. The same was true where the orchestrating model not running in /fast mode could request sub-agents to run /fast. Fixed. - Computer History. The older implementation could lead to repeatedly summarizing overlapping activity. For some cases we saw it consume up to one fifth of the weekly usage per week. Fixed. - Rolling task summaries. Ordinary turns were triggering extra background requests. These added about 1% to token usage. Small each time, but it adds up. We have disabled this. - MCP. Some tool results could be encoded twice. We also found tool instructions getting cut off and fetched again. Fixed. We’ve also made architectural changes to prevent these from regressing and our teams will get paged if it happens regardless. We are also working on showing you directly in the app where your usage goes so you don’t have to guess. Goes without saying that we’re resetting usage limits and I hope you enjoy a very nice Saturday!

    推荐理由:原文逐项列出八类用量异常的原因与修复结果,读者可据此判断 Codex 付费额度实际能多用多少。

8月29日周六
  1. @AYi_AInotes70

    Grok Bot 更新后接入 Stripe Link 钱包,能根据一句话需求在云端连接电商网站比价、加购物车、填收货地址,再弹出账单请款,用户点批准后生成一次性虚拟卡付款。其真实银行卡号对 Bot 不可见,每笔支出都需用户本人授权,目前已在美区桌面端全量上线。

    原始视频预览图;未保存可播放视频URL

    推荐理由:材料呈现了 Grok Bot 用 Stripe Link 走完比价、加购到一次性虚拟卡付款的流程,可看消费级智能体的支付环节如何设计。

  2. LMSYS Blog60

    SGLang 发布 SSD Expert Pack,在消费级硬件上运行 DeepSeek-V4-Flash 和 Kimi-K3

    SGLang 将 SSD-LLaMA 的核心思路引入 MoE 推理,把放不进 VRAM 和内存的路由专家权重放在 NVMe SSD 上,通过 Expert Pack 连续布局、O_DIRECT 直接 I/O、pinned 暂存和 GPU 缓存,只加载 router 选中的专家。

    推荐理由:原文给出完整机制说明和单卡实测数据,读者可以据此评估 NVMe SSD 承载超大 MoE 模型的可行性。

8月28日周五
8月27日周四
  1. Draco正在VibeCoding · 微信公众号76

    字节官宣豆包工作,实测教程详解 100 个 Skills 与飞书打通

    字节官宣推出豆包工作,作者在 Mac 与 Windows 上实测后发布万字上手教程。该产品提供豆包2.1 Turbo 和豆包2.1 Pro 两个模型,均为 256K 上下文,内置 100 个 Skills、130 多个连接器和 87 个工作伙伴,用飞书账号登录可打通联系人、云盘与文档,注册激活可获 30 天标准版订阅。

    推荐理由:作者以第一手实测梳理了豆包工作的模型选项、100 个 Skills 与飞书打通细节,可据此判断它是否适合接入现有协作流程。

  2. Michael Truell65

    Michael Truell 宣布 Grok Bot 现已向所有标准 Grok 或 Cursor 订阅用户开放,并表示其增长快于他们见过的任何产品。引用内容提到所有 SuperGrok 和 Cursor Pro 订阅者已可用 Grok Bot,且为所有用户重置了每周使用限额。作者称用户把电商运营(支持、广告、库存、财务)、协调客户活动、测试生产软件等任务交给 Grok Bot。

    引用Grok Bot@bot

    All SuperGrok and Cursor Pro subscribers now have access to Grok Bot. We're also resetting weekly usage limits for all users. Enjoy!

    推荐理由:作者列出用户实际交给 Grok Bot 的任务范围,读者可据此判断它在真实工作流中的落地程度。

  3. Anthropic Newsroom60

    Anthropic 开启 Model Hardware Standard 研究预览,让 AI 智能体安全操控实验与制造设备

    Anthropic 开放 Model Hardware Standard(MHS)研究预览,这是让 AI 智能体安全操作物理设备的标准规范,首批面向科研实验室和先进制造商,可将原本需数周至数月的硬件集成缩短到数小时或数分钟。

    推荐理由:官方介绍 MHS 标准化驱动如何把硬件集成从数周缩到数分钟,并给出多家机构实测用例,对关注智能体操控实体设备的读者有参考。

8月26日周三
  1. 量子位 · 微信公众号80

    OpenAI 公开自研芯片小辣椒,SemiAnalysis 实测其能效与时延优于 Blackwell

    OpenAI 在 Hot Chips 2026 大会上公开自研推理芯片小辣椒,SemiAnalysis 受邀到其实验室用 InferenceX 实测,结论是这颗第一代芯片在多个开源模型上击败了能测到的英伟达、AMD 和谷歌芯片。

    推荐理由:文章给出 SemiAnalysis 现场实测的能效与时延数据,并交代了单 token 预测等对比口径的限制。

  2. IT Home76

    OpenAI 自研芯片 Jalapeño 性能数据公布,DeepSeek R1 每瓦吞吐量为 GB300 的 1.7 倍

    OpenAI 于 8 月 25 日发布博文展示其自研 AI 推理芯片 Jalapeño,并用 SemiAnalysis 的 InferenceX 基准测试了 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型。

    推荐理由:官方基准显示 Jalapeño 的推理能效比 GB300 高约 1.5 至 1.7 倍,可据此观察自研 ASIC 对算力成本结构的影响。

  3. @OpenAIDevs67

    OpenAI Developers 宣布 ChatGPT 桌面应用的内置浏览器和 ChatGPT Sites 新增 WebMCP 支持。访问兼容网站时,ChatGPT 或 Codex 可自动调用 WebMCP 完成用户任务。用户更新到最新版 ChatGPT 桌面应用后,可直接让 Codex 创建一个支持 WebMCP 的应用并部署到 Sites。

    原始视频预览图;未保存可播放视频URL

    推荐理由:官方说明了更新方式和调用入口,读者可据此了解网页任务交给 ChatGPT 或 Codex 自动执行的路径。

  4. Claude Blog72

    Claude 记忆功能打通聊天与 Cowork,支持逐条查看和编辑

    Claude 将聊天与 Claude Cowork 的记忆统一为同一份,在网页、桌面和移动端都从已积累的上下文开始工作。记忆改为在对话过程中实时添加,用户可在 Memory 设置的 Topics 列表里逐条查看、编辑或删除,并可随时暂停或重置。

    推荐理由:聊天与 Cowork 共用同一份记忆并支持逐条编辑,读者可了解记忆可控性的具体设计。