跳到正文

全部动态

今日 304 条
6月5日周五
6月4日周四
  1. Sierra Blog61

    Sierra 复盘按结果定价的实践:SaaS 危机与 AI 智能体的商业模型选择

    Sierra 回顾 2024 年 12 月提出按结果(outcome-based)定价以来的经验:自那时起 S&P 500 上涨约 30%,而 SaaS 指标 WCLD 下跌约 15%。文章引用 Madhavan Ramanujam 的 2x2 框架(自主性与结果归因)定位定价模式,认为按结果定价只有在软件高度自主且结果可清晰归因时才可行,并判断最终能存续的是卖结果而非卖访问权的公司。

    推荐理由:Sierra 作者基于自身按结果定价的实践复盘其得失,并用一个 2x2 框架解释为何席位制 SaaS 正承压。

6月3日周三
  1. Microsoft AI News61

    Microsoft 发布 MAI-Voice-2 文本转语音模型

    Microsoft 发布文本转语音模型 MAI-Voice-2,在保真度、语言覆盖、说话人一致性和情感范围上较前代显著提升。支持语言从英语扩展到 15 种,提供情感标签细粒度控制,可用 5-60 秒参考音频零样本创建自定义声音,且生产环境仅允许授权声音合成。

    推荐理由:官方发布给出语言扩展、零样本克隆与偏好测试数据,读者可据此评估该语音模型在生产场景中的可用性。

  2. Suno Blog76

    Suno 完成 4 亿美元 D 轮融资,估值 54 亿美元

    Suno 宣布完成超 4 亿美元 D 轮融资,投后估值 54 亿美元,由 Bond Capital 领投,IVP、Forerunner、Union Square Ventures、Alkeon 和 Quiet 参投,现有投资者 Matrix、Lightspeed、Menlo Ventures 和 Schroders Capital 跟投。

    推荐理由:Suno 官方公布融资规模、估值与投资方,并预告将与音乐行业合作推出首个音乐模型,读者可据此了解其后续方向。

6月2日周二
  1. Microsoft AI News65

    Microsoft MAI-Image-2.5 发布,登 Arena 图像编辑榜第 2

    Microsoft MAI 团队发布图像模型 MAI-Image-2.5 及更快更便宜的 MAI-Image-2.5-Flash,MAI-Image-2.5 在 Arena 图像编辑榜排名第 2(超过 Nano Banana 2),文生图榜排名第 3,较 MAI-Image-2 总分提升 75 分。

    推荐理由:官方公布了 Arena 图像编辑第 2 的排名、与 Flash 双版本定价和 Foundry 入口,读者可据此评估生产图像工作流的选型。

  2. Microsoft AI News60

    Microsoft AI 阐述医疗领域布局:与 Mayo Clinic 合作开发医疗前沿模型并开放 Copilot Health 预览

    Microsoft AI 发文阐述其在医疗领域的产品与研究方向,称旗下消费产品每天处理数千万条健康问题,对 50 万条 Copilot 对话的分析显示用户依赖 AI 做症状解读、检查结果解释和就医导航。

    推荐理由:微软官方阐述其在医疗领域的价值落地,读者可以据此了解 MAI DxO、Mayo Clinic 合作与 Copilot Health 的进展全貌。

  3. Microsoft AI News49

    微软发布 MAI-Transcribe-1.5,新增关键词偏置功能

    微软推出转录模型 MAI-Transcribe-1.5,新增关键词偏置功能,可让用户提供领域特定关键词列表来引导预测,模型会结合上下文判断是否应用偏置而非盲目强制匹配。在 FLEURS 多语言基准上,启用关键词偏置后词错误率(WER)降低 30%,在提升专业词汇识别的同时保持通用语音的准确率。

6月1日周一
  1. Runway News49

    Runway 在伦敦设立欧洲总部,专注通用世界模型研究

    Runway 宣布在伦敦设立欧洲总部及新的通用世界模型研究枢纽,计划未来 18 个月向英国 AI 生态投资 1 亿美元,到 2028 年该数字将翻倍以上。过去十二个月 Runway 欧洲订阅销量增长 50%,超 20% 企业客户位于欧洲,BBC、Fremantle 和 WPP 均为其客户。新总部将招聘研究、产品、工程、销售等岗位,并招募一名 Head of Europe 统筹欧洲业务。

5月29日周五
  1. Sierra Blog68

    Sierra 工程师复盘如何独自用 AI 编码智能体在 4 个月内完成产品本地化

    Sierra 工程师 Stephen Burgess 复盘用 AI 编码智能体独自完成产品本地化,耗时不到 4 个月,而他在 Slack 参与的同类项目需 10 人团队 9 到 12 个月。他经历 IDE 智能体、云端智能体、批量调用 Claude 脚本三轮迭代,并发现技能文档过长会超出上下文窗口反而推高错误率,最终把工作重心从执行迁移转向设计反馈循环。

    推荐理由:作者复盘个人用 AI 编码智能体完成本地化的完整工作流,提炼出批处理脚本、反馈循环与上下文管理等可迁移方法。

5月28日周四
  1. Mistral AI71

    Mistral 发布统一智能体 Vibe,Le Chat 升级为 Work 与 Code 双模式

    Mistral 将 Le Chat 升级为统一智能体 Vibe,一个账号覆盖工作与编码场景,已上线 chat.mistral.ai。Work Mode 面向长时多步任务,支持企业知识搜索、数据分析、文档起草、定时任务和可复用技能;Code Mode 提供远程编码会话并推出 VS Code 扩展,CLI 新增技能命令、会话权限控制和 /teleport 迁移。

    推荐理由:原文是 Mistral 官方发布,完整列出 Work 与 Code 两种模式的能力、集成入口和各档定价,读者可据此评估是否替换现有工作流。

  2. Mistral AI62

    Mistral AI 发布开源搜索框架 Search Toolkit 公测版

    Mistral AI 发布 Search Toolkit 公测版,一个用于构建 AI 应用生产级搜索管道的开源可组合框架,统一了此前分散的数据摄取、检索与评估三个环节。

    推荐理由:官方发布开源搜索框架,把 ingestion、检索和评估整合为统一接口,适合评估它能否减少 RAG 基础设施维护成本。

  3. Linear Now63

    Linear 发布 Diffs,主打快速代码评审

    Linear 发布代码评审产品 Diffs,面向所有套餐开放,目标是让代码评审在不牺牲严谨性的前提下保持快速。评审在 Linear 内打开并关联对应的 issue 和项目,优先级可见;Guided reviews 把大 diff 按工作的推理顺序拆成章节,先展示核心改动,结构化 diff 高亮会剥离格式改动,让 2000 行的 PR 在一次阅读中变得可读。

    推荐理由:Linear 官方解释了 Diffs 针对的评审痛点与具体设计,读者可以对照自己团队被 agent 大量 PR 拖慢的评审流程判断是否适用。

5月27日周三
  1. Mistral AI36

    Mistral 推出物理 AI:面向工业工程加速的基础模型

    Mistral 将 Emmi AI 并入后推出物理 AI,用模型从几何与边界条件直接预测物理场,单次前向传播在单块 GPU 上以秒级完成,替代传统 CFD/FEM 每轮设计动辄数小时至数周的求解流程。该能力面向 ASML、Airbus、Safran、Siemens Energy 等合作伙伴,覆盖产品设计、工装工艺与实时数字孪生三类场景,传统求解器保留用于验证与边缘工况。

  2. Mistral AI51

    Mistral 收购 Emmi AI,加码工业领域 Physics AI 基础研究

    Mistral AI 宣布收购 Emmi AI,并强调将投入面向航空航天、汽车、半导体和能源等行业的基础 Physics AI 研究。文章列举了相关已发表成果,包括 2025 年 12 月发布的约 30,000 样本跨音速 3D 机翼 CFD 仿真数据集,以及 AB-UPT、GyroSwin、UPT、NeuralDEM 等神经代理模型的研究和开源仓库。

5月26日周二
5月23日周六
  1. Mistral AI50

    Mistral AI 宣布收购 Physics AI 公司 Emmi AI

    Mistral AI 宣布与奥地利 Physics AI 公司 Emmi AI 达成最终收购协议,以加强面向工业企业的 AI 转型业务。Emmi AI 团队包括 30 多名研究人员和工程师,将于 5 月加入 Mistral AI 的 Science 和 Applied AI 团队,其大工程模型能力涵盖实时模拟、数字孪生等工程场景,应用于航空航天、汽车和半导体等领域。

  2. AI as Normal Technology65

    AI as Normal Technology 剖析 Google 智能体 916 美元造操作系统宣称的漏洞

    Sayash Kapoor 等人分析 Google 在开发者大会上发布 Gemini 3.5 Flash 和 Antigravity 2.0 时宣称的智能体团队以单一提示词、约 916.92 美元 API 费用和 2.6B tokens 造出操作系统的实验。

    推荐理由:文章逐条拆解 Google 智能体造操作系统的宣称,指出单一提示词等说法缺乏关键细节,并探讨开放世界评测需要的方法规范。

5月22日周五
  1. Mistral AI69

    Mistral 发布 Mistral Medium 3.5 并在 Vibe 和 Le Chat 推出云端远程智能体

    Mistral 发布 Mistral Medium 3.5,一个 128B 稠密开源权重模型(modified MIT 许可),256k 上下文窗口,SWE-Bench Verified 得分 77.6%,τ³-Telecom 得分 91.4,自托管最少只需四块 GPU,API 定价每百万输入 token $1.5、输出 token $7.5。

    推荐理由:官方同步发布模型与云端异步智能体,给出基准分数、定价和开源权重,可对照评估其编码与长程任务能力。

5月21日周四
  1. Runway News62

    Runway 发布 Aleph 2.0 视频编辑模型及 Edit Studio 应用

    Runway 发布视频编辑模型 Aleph 2.0,并同步推出围绕其构建的 Edit Studio 应用。新模型支持编辑最长 30 秒的 1080p 视频,可做仅改动目标区域的局部编辑,用一帧编辑后的图像预览并控制最终效果,还能一次把改动应用到多个镜头。Edit Studio 面向营销团队、影视后期等场景,现已在所有 Runway 付费计划的桌面网页端开放。

    推荐理由:原文给出了模型能力细节和开放范围,读者可以据此判断对现有视频素材二次加工工作流的影响。