跳到正文

#Microsoft

今日 8 条
8月21日周五
8月14日周五
8月13日周四
  1. Microsoft AI News66

    Microsoft AI 发布推理模型 MAI-Thinking-1

    Microsoft AI 发布推理模型 MAI-Thinking-1,为 35B 激活、约 1T 总参数的稀疏 MoE 模型。官方称其在 SWE-Bench Pro 上与 Claude Opus 4.6 相当,AIME 2025 达 97.0%、AIME 2026 达 94.5%,盲测中人类偏好高于 Sonnet 4.6。

    推荐理由:官方公布了模型规格与基准成绩,并说明不蒸馏、自建训练栈的路线,读者可据此评估中型推理模型的部署价值。

  2. Microsoft Research41

    MindTopo:微软推出评估多模态模型拓扑推理能力的新基准

    微软研究院发布 MindTopo 基准,用于评估多模态大语言模型在连通性、封闭、顺序、分离和绳结五类拓扑关系上的推理与规划能力。测试显示,当前专有与开源模型在静态识别上表现明显优于交互式规划,且均远低于人类水平,失败多出现在规划阶段而非感知阶段。图像与视频生成工具仅在单帧内保留结构关系时有用,跨多步操作仍不可靠。

8月12日周三
8月11日周二
8月4日周二
  1. Microsoft Research69

    Microsoft Research 发布开源智能体框架 Orchard

    Microsoft Research 发布开源智能体框架 Orchard,核心是可复用的 Kubernetes 环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 内直接训练智能体。

    推荐理由:原文给出框架设计、训练配方和多项基准数字,读者可以据此评估开放环境层对降低 Agent 研究成本的作用。

7月30日周四
  1. Microsoft AI News61

    Microsoft 阐述按 token 效率优化前沿性能曲线的策略并盘点 MAI Flash 模型成果

    Microsoft 提出行业下一个焦点是 token 效率,主张通过联合优化模型、harness 和 RL 环境为具体产品调校模型,而非所有任务都用前沿通用模型。

    推荐理由:Microsoft 官方阐述 token 效率策略,用多款 MAI Flash 模型的实际成本数据说明如何按任务匹配模型规模。

7月24日周五
7月22日周三
7月9日周四
6月3日周三
  1. Microsoft AI News61

    Microsoft 发布 MAI-Voice-2 文本转语音模型

    Microsoft 发布文本转语音模型 MAI-Voice-2,在保真度、语言覆盖、说话人一致性和情感范围上较前代显著提升。支持语言从英语扩展到 15 种,提供情感标签细粒度控制,可用 5-60 秒参考音频零样本创建自定义声音,且生产环境仅允许授权声音合成。

    推荐理由:官方发布给出语言扩展、零样本克隆与偏好测试数据,读者可据此评估该语音模型在生产场景中的可用性。

6月2日周二
  1. Microsoft AI News65

    Microsoft MAI-Image-2.5 发布,登 Arena 图像编辑榜第 2

    Microsoft MAI 团队发布图像模型 MAI-Image-2.5 及更快更便宜的 MAI-Image-2.5-Flash,MAI-Image-2.5 在 Arena 图像编辑榜排名第 2(超过 Nano Banana 2),文生图榜排名第 3,较 MAI-Image-2 总分提升 75 分。

    推荐理由:官方公布了 Arena 图像编辑第 2 的排名、与 Flash 双版本定价和 Foundry 入口,读者可据此评估生产图像工作流的选型。

  2. Microsoft AI News60

    Microsoft AI 阐述医疗领域布局:与 Mayo Clinic 合作开发医疗前沿模型并开放 Copilot Health 预览

    Microsoft AI 发文阐述其在医疗领域的产品与研究方向,称旗下消费产品每天处理数千万条健康问题,对 50 万条 Copilot 对话的分析显示用户依赖 AI 做症状解读、检查结果解释和就医导航。

    推荐理由:微软官方阐述其在医疗领域的价值落地,读者可以据此了解 MAI DxO、Mayo Clinic 合作与 Copilot Health 的进展全貌。

  3. Microsoft AI News49

    微软发布 MAI-Transcribe-1.5,新增关键词偏置功能

    微软推出转录模型 MAI-Transcribe-1.5,新增关键词偏置功能,可让用户提供领域特定关键词列表来引导预测,模型会结合上下文判断是否应用偏置而非盲目强制匹配。在 FLEURS 多语言基准上,启用关键词偏置后词错误率(WER)降低 30%,在提升专业词汇识别的同时保持通用语音的准确率。

4月14日周二
4月2日周四
3月20日周五
3月12日周四
  1. Microsoft AI News60

    Microsoft 发布 Copilot Health 健康助手

    Microsoft 推出 Copilot Health,这是 Copilot 内的独立安全空间,可整合健康记录、可穿戴设备数据与健康历史并生成个性化健康洞察。

    推荐理由:官方宣布 Copilot Health 上线并给出数据整合规模、隐私隔离措施和分阶段开放方式,读者可以了解其功能边界与使用入口。

3月10日周二
12月10日周三
  1. Microsoft AI News40

    Microsoft AI 发布 Copilot 使用报告 2025:分析 3750 万次对话

    Microsoft AI 发布《Copilot 使用报告 2025》,基于 3750 万次对话的脱敏摘要数据分析了用户的真实使用模式。健康类话题在移动端全年居首,2 月情人节前后关系类对话明显激增,编程与游戏话题在 8 月出现交叉——工作日偏编程、周末偏游戏。报告还发现凌晨时段宗教与哲学类对话排名上升,且用户寻求个人建议的对话占比持续增长。

11月6日周四
  1. Microsoft AI News64

    Microsoft AI 提出 Humanist Superintelligence 理念并组建 MAI Superintelligence Team

    Microsoft AI 发布长文,提出 Humanist Superintelligence(HSI)理念,即面向具体领域、受控服务于人类的超智能,并宣布组建由作者领导的 MAI Superintelligence Team。

    推荐理由:Microsoft AI 提出以人类为中心、领域受限的超智能路线,文中给出医疗诊断等具体方向和 containment 难题的判断。

10月14日周二
  1. Microsoft AI News61

    Microsoft AI 发布首个完全自研图像生成模型 MAI-Image 1,登上 LMArena 文生图前十

    Microsoft AI 于 2025 年 10 月 13 日宣布 MAI-Image 1,这是其首个完全在内部开发的图像生成模型,首日进入 LMArena 文生图模型前十。

    推荐理由:微软首次完全自研的图像生成模型,官方说明了训练重点、擅长场景和后续落地产品,可了解其定位与可用入口。

8月29日周五
7月1日周二
  1. Microsoft AI News68

    Microsoft 发布 MAI-DxO,在 NEJM 病例序列诊断基准上正确率达 85%

    Microsoft AI 发布 MAI-DxO 诊断编排器与 SD Bench 基准,将 304 个 NEJM 病例转化为逐步诊断挑战,MAI-DxO 正确诊断最高达 85%,是同一组有经验医生的四倍以上,且以更低检查成本得出正确诊断。

    推荐理由:原文同时给出诊断准确率、成本对比和研究局限,并说明 SD Bench 尚未公开,读者可据此理解结果边界。

10月1日周二
  1. Microsoft AI News39

    微软 AI 推出 Copilot 应用:为每个人打造的 AI 伴侣

    微软 AI 发布 Copilot 应用,其 discover feed 体验整合了学习、探索与放松功能。微软 AI CEO Mustafa Suleyman 表示,Copilot 能理解用户生活语境,同时保护隐私、数据与安全,并记住最有帮助的细节。它还能提供知识获取,简化日常信息轰炸,并在用户需要时给予支持与鼓励。

4月22日周一