Sierra 在澳大利亚悉尼开设办公室
Sierra 宣布在澳大利亚悉尼开设办公室,此前已扩展至新加坡、东京、马德里、巴黎和伦敦。其平台上的 AI 智能体支持 30 多种语言、全天候无等待服务,覆盖产品发现、注册登录、故障排查和流失管理。Rocket Mortgage 每月贷款量达 $1BN,使用其智能体的购房者完成流程的可能性高出四倍。
媒体报道、公司博客与研究文章
Sierra 宣布在澳大利亚悉尼开设办公室,此前已扩展至新加坡、东京、马德里、巴黎和伦敦。其平台上的 AI 智能体支持 30 多种语言、全天候无等待服务,覆盖产品发现、注册登录、故障排查和流失管理。Rocket Mortgage 每月贷款量达 $1BN,使用其智能体的购房者完成流程的可能性高出四倍。
Mistral AI 发布 4B 参数的文本转语音模型 Voxtral TTS,支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语 9 种语言,API 定价 $0.016 per 1k characters。
推荐理由:官方给出了与 ElevenLabs 对比的人类评测数据和低延迟指标,读者可据此评估其在语音 Agent 场景的可用性。
Replit 发布「Live from HQ」第二期直播回顾,复盘 Agent 4 发布背后的工程与设计。
推荐理由:官方复盘 Agent 4 五位成员的工程与设计决策,读者可以了解并行任务、合并冲突解决和微 VM 分支背后的实现思路。
Gemini API 在 AI Studio 上线 Prepay 和 Postpay 两种计费方案,现有账户可能受到影响,需查阅 Billing 文档了解详情。
Replit 团队在 Agent 4 发布周后于总部直播,展示 Agent 4 如何通过 Infinite Canvas、并行任务和统一构建改变多人协作开发应用的方式。数据科学家 Manny 用它做出集落地页、Web 应用与移动原生版本于一体的品味训练应用,Raymmar 则展示了从 BigQuery 读取数据、每栋建筑对应一名真实用户的实时 3D 城市 Replitopolis。
Replit 发布 Agent 4,对设计、协作、可构建内容和规划流程四方面作出升级。Design Mode 替换为支持所有 Artifact 类型的 Design Canvas 无限画布。
推荐理由:原文逐项对比 Agent 3 到 4 在设计、协作和构建流程上的具体变化,老用户可以据此了解迁移影响。
Microsoft AI 团队发布图像生成模型 MAI-Image-2,称其使 MAI 进入 Arena.ai 榜单前三的文生图实验室行列。
推荐理由:原文给出榜单排名、可用入口和面向创意工作的三大能力重点,读者可据此判断是否试用或接入。
千问 Qwen3.5-Max-Preview 已在 Arena 部署,初步评测表现优异。官方表示将在未来两周内完成最终优化并正式发布,期间邀请社区通过 Arena 体验该模型能力。
Sierra 发布 𝜏³-Bench,在 𝜏-Bench 基础上新增 𝜏-Knowledge 与 𝜏-Voice 两个评测域,并合入社区对原有 airline、retail、telecom 任务的修复。
MiniMax 发布 M2.7 模型,称其为首个深度参与自身演化的 M2 系列模型,让模型构建 skills、更新记忆并改进强化学习实验流程。SWE-Pro 得分 56.22%,VIBE-Pro 55.6%,Terminal Bench 2 57.0%,GDPval-AA ELO 1495 为开源模型最高;MLE Bench Lite 三次运行平均奖牌率 66.6%。
推荐理由:原文给出了自进化工作流细节和多维度基准数据,读者可以对照评估 M2.7 在智能体与工程任务上的实际位置。
Together AI 扩展 Together Fine-Tuning,新增工具调用、推理和视觉语言模型(VLM)微调支持,训练栈升级后最高 6 倍吞吐提升,数据集支持至 100GB,并在训练前后提供成本与完成时间预估。
Google Research 在 The Check Up 活动上展示了多项医疗 AI 进展,包括与 Fitbit 合作研究的 Personal Health Agent(PHA),发现其比单一任务应用更能支持长期健康。
Google Research 与 NHS 合作开展 AIMS 研究,在 Nature Cancer 发表两篇论文评估 AI 乳腺癌检测系统。回溯评估覆盖约 115,973 名女性的乳房 X 光检查,AI 灵敏度显著高于原第一人类读者,癌症检出率从每千人 7.54 升至 9.33,并检出原双重读片漏掉的 25% 间期癌。
推荐理由:研究给出了AI作为乳腺癌筛查第二读者的端到端验证数据,包括检出率和人力节省的具体结果与仲裁误判风险。
Manus 上线 Meta Ads Manager 连接器早期 Beta 版,用户可在 Manus 工作区内直接查询广告数据并获得分析洞察。该连接器通过官方 API 以只读方式访问账户,支持自动生成每日或每周报告、仪表板、幻灯片和信息图表,并可连接多个广告账户。功能正在逐步推出,尚未向所有人开放。
Mistral AI 推出 Forge,一套让企业基于自有专有知识训练前沿级 AI 模型的系统,支持预训练、后训练与强化学习全流程。Forge 同时支持 dense 与 MoE 架构,并可处理多模态输入,模型可在企业自有基础设施内训练与治理。该平台以智能体优先设计,Mistral Vibe 等自主智能体可用其微调模型、寻找最优超参数并生成合成数据。
Gemini API 发布内置工具与函数调用组合功能,可在单次 API 调用中同时使用内置工具和自定义函数调用工具。Grounding with Google Maps 此后支持 Gemini 3 模型。
Manus 上线 Instagram 连接器早期 Beta 版,向所有用户开放,需使用 Instagram 专业账户(创作者或商业)授权。该连接器支持在 Manus 工作区内直接发布帖子、轮播、故事和短视频,并获取浏览量、覆盖率、点赞、评论、分享和收藏等指标数据。
Manus 推出 Manus Connectors 的 Instagram Creator Marketplace 早期 Beta 版本,可搜索和筛选超 200 万名创作者,覆盖 18 个市场。
Together AI 联合 CMU、Princeton、Cartesia 发布状态空间模型 Mamba-3,将设计重心从训练效率转向推理效率,核心改进包括更具表达力的递推公式、复数值状态追踪和提升精度的 MIMO 变体。
Mistral 发布 Mistral Small 4,将 Magistral 的推理、Pixtral 的多模态与 Devstral 的智能体编码能力统一到单一开源模型,采用 Apache 2.0 许可证。
推荐理由:官方公布了架构参数、reasoning_effort 用法和与 GPT-OSS 120B 的效率对比,可据此评估其开源部署价值。
Mistral AI 宣布加入 NVIDIA Nemotron Coalition 并担任创始成员,双方计划结合各自架构与算力共同开发前沿开源模型。联盟首个项目是在 NVIDIA DGX Cloud 上训练的基础模型,将支撑即将推出的 NVIDIA Nemotron 4 系列并开源;Mistral AI 同日发布 Mistral Small 4,此前双方曾合作开发 Mistral Nemo。
Google 与康奈尔大学合作,让 GPT-4o、Perplexity、Claude 3.5、Gemini Advanced Pro 1.5、NotebookLM 和一套自建 RAG 系统回答 67 道高温超导专家级问题,由 12 位国际专家盲评打分。NotebookLM 在多数维度表现突出,自建 RAG 系统紧随其后,两者与 Gemini 在观点平衡性和答案全面性上排名前三。
Miles 开源强化学习框架现已支持 ROCm,可在 AMD Instinct MI300/350 系列 GPU 上原生运行大规模 RL 后训练。该框架基于 SGLang 和 Slime 生态,支持 GRPO/PPO、Ray 编排及 Megatron-LM 集成,并提供预构建容器。
Manus 为 Google Workspace 连接器推出重大升级,基于 Google Workspace 团队开源的 Google Workspace CLI(非 Google 官方支持产品),从创建和读取文件扩展到 Docs 精准文本替换、Sheets 跨表数据交叉引用、Slides 编辑现有演示文稿等精细操作。
推荐理由:官方说明了升级后连接器能做的精细操作和免费开放方式,读者可据此判断是否改变自己的 Workspace 工作流。
Mistral 发布 Leanstral,称其为首个面向 Lean 4 的开源代码智能体,权重以 Apache 2.0 许可开放,采用 120B-A6B 稀疏架构,并可通过 Mistral Vibe 和 labs-leanstral-2603 API 端点使用。
Together AI 在 NVIDIA GTC 2026 上宣布多项进展,包括接入 NVIDIA Dynamo 1.0 推理栈、通过 NVIDIA NemoClaw 提供 OpenShell 运行时,并在模型库上线 NVIDIA Nemotron 3 Super 与 Parakeet TDT 0.6B V3。
Gemini API 于 3 月 16 日推出重新设计的 Usage Tiers 和 Billing Account 支出上限,以改善用户的计费体验。
Manus 发布 Manus 2.0 桌面应用的核心功能 "我的电脑",将此前完全运行在云端的 Manus 带到本地电脑,通过在终端执行命令行指令读写本地文件并控制本地应用。
推荐理由:官方介绍了桌面端让 Manus 通过本地终端操作文件与应用的机制,并保留逐条命令审批的控制设计,可了解其工作流变化。
Replit 推出 Databricks 连接器,让 Replit 应用直接查询 Databricks 中受治理的表、模型和仓库,不复制敏感数据。直播中演示用一条提示词让 Replit Agent 数分钟内搭好 3D 天气地球仪应用,Databricks Genie 作为应用内数据副驾用引用表回答自然语言问题,面向 PM、RevOps 和分析师等业务角色自主搭建数据应用。
伯克利 AI 研究提出 SPEX 与 ProxySPEX 算法,用于在大规模 LLM 中识别驱动模型输出的关键交互。SPEX 利用稀疏性与低阶性将交互搜索转化为稀疏恢复问题,ProxySPEX 进一步借助层级结构,以约 10 倍更少的消融达到 SPEX 的性能。在情感分析任务上,SPEX 在上下文扩展至数千特征时仍保持高忠实度,而 LIME、Banzhaf 等边际方法忠实度明显更低。
Linear 发布视觉界面改版,通过调暗导航侧边栏、压缩顶部标签、减少图标使用并软化边框对比,让主内容区更突出。改版借助内置 dev toolbar 一键切换 feature flags 对比新旧版本,并用 Claude Code 在数小时内构建出可调 hue、chroma、lightness 的颜色工具,其 token 值以 JSON 导入 Figma。
对话式 AI 平台 Sierra 宣布在西班牙马德里开设办公室,并已与多家西班牙大型企业合作构建 AI 客户体验。Sierra 智能体可覆盖产品推荐、注册、账户管理、故障排查、忠诚度计划与流失管理等场景;英国零售商 Next 六周上线,覆盖 83 个国家 48 种语言,Cigna 八周投产并将患者认证时间缩短 80%,Singtel 十周上线,解决率超 70%。
Google Research 宣布在 Flood Hub 上推出城市山洪预报,借助基于 Gemini 的 Groundsource 方法从新闻报告中提取历史山洪数据,用 LSTM 模型提前 24 小时预测城市山洪风险。
推荐理由:原文给出 Flash Flood 预报的技术路线和与 NWS 的对比指标,读者可以了解 AI 预警如何弥补全球南方的预警缺口。
Microsoft 推出 Copilot Health,这是 Copilot 内的独立安全空间,可整合健康记录、可穿戴设备数据与健康历史并生成个性化健康洞察。
推荐理由:官方宣布 Copilot Health 上线并给出数据整合规模、隐私隔离措施和分阶段开放方式,读者可以了解其功能边界与使用入口。
Google 推出 Groundsource 方法,利用 Gemini 从 80 种语言的新闻报道中提取并验证历史洪水事件,构建覆盖 150 多个国家、2000 年至今的 260 万条记录数据集并开放获取。
Runway 发文说明其本周发布的实时视频智能体 API Runway Characters 的安全考量,该产品基于 World Model GWM-1,可从单张图像生成可对话的定制角色。
Together AI 发布面向实时语音智能体的统一解决方案,将 STT、LLM 和 TTS 共置在同一集群内,用户语音结束到首个音频 token 的端到端延迟低于 500ms。
Google Research 与 Beth Israel Deaconess Medical Center 合作完成 AMIE 对话式诊断 AI 的前瞻性单中心可行性研究,100 名成人在初级保健就诊前与 AMIE 对话采集病史,全程由医生实时监督,未发生一次安全中止。
推荐理由:这是 AMIE 首次在真实门诊流程中开展的前瞻性可行性研究,给出安全性、诊断质量和医患体验的具体数据。
Gemini API 为 AI Studio 的计费引入项目级支出上限(project-level spend caps),用于限制单个项目的花费。该功能于 2026 年 3 月 12 日上线。
Manus 发布首封年度信并推出 Manus 2.0,CEO Red 回顾了 Manus 从"AI 不仅应思考、更应行动"的构想出发,一年内已能构建含数据库和 AI 原生功能的全栈 Web 应用乃至移动应用。信中提出下一步目标:让不懂编程的人也能使用,并让 Agent 全天候 24/7 持续运行。