Runway 推出 Runway Fund,初期承诺投入最高 1000 万美元
Runway 正式推出 Runway Fund,专注投资 AI、媒体与世界模拟领域的早期公司,初期承诺投入最高 1000 万美元,单笔投资一般不超过 50 万美元,面向 pre-seed 和种子轮。该基金已低调运作数年,此前投资了 Cartesia、LanceDB 和 Tamarind Bio,重点关注 AI 研究、新应用以及新媒体与内容三大方向。
媒体报道、公司博客与研究文章
Runway 正式推出 Runway Fund,专注投资 AI、媒体与世界模拟领域的早期公司,初期承诺投入最高 1000 万美元,单笔投资一般不超过 50 万美元,面向 pre-seed 和种子轮。该基金已低调运作数年,此前投资了 Cartesia、LanceDB 和 Tamarind Bio,重点关注 AI 研究、新应用以及新媒体与内容三大方向。
Mistral AI 发布面向人类开发者和编码 Agent 的 CLI 工具 Spaces。核心设计包括每个交互式输入都提供等价 flag 和 -y 无头模式、生成 context. 与 AGENTS.md 供 Agent 读取项目上下文、插件化的模块注册表,并将状态显式化以避免 CWD 等隐式假设;文中 Agent 从单个提示词到完成部署耗时不到 10 分钟。
Together AI 开源 Aurora,一个基于 RL 的框架,可从实时推理轨迹中学习并异步更新投机解码器,把静态的一次性配置变成持续自我改进的飞轮。在 Qwen3、Llama3 等模型上,Aurora 相比训练良好但静态的投机器再提速 1.25 倍,并省去大规模激活收集管线。代码已开源。
Gemini API 推出 Veo 3.1 Lite Preview(veo-3.1-lite-generate-preview),这是其最具成本效益的视频生成模型,面向快速迭代和高并发应用场景。同时,gemini-2.5-flash-lite-preview-09-2025 已停用,改用 gemini-3.1-flash-lite-preview。
SGLang 在 NVIDIA GTC 2026 期间举办五场活动,包括黄仁勋 GTC 主题演讲的 NVIDIA AI 生态幻灯片展示、开源 AI 专题讨论、官方训练实验室,以及与 RadixArk 联合举办的 Happy Hour 和 LinkedIn 约 200 人规模的 meetup。
千问发布新一代全模态大模型 Qwen3.5-Omni,支持文本、图像、音频及音视频内容的理解。模型采用 Hybrid-Attention MoE 架构,系列含 Plus、Flash、Light 三个 Instruct 版本,支持 256k 长上下文输入,可处理超过 10 小时的音频。
推荐理由:官方发布新一代全模态模型,列出了尺寸系列与长上下文等配置,读者可据此评估其在多模态场景中的适用性。
Sierra 宣布收购东京企业 AI 初创公司 Opera Tech,其联合创始人 Keita Morikawa 与 Kiyohito Kunii 将一同加入。Sierra 称此举旨在拓展日本市场,并援引 Singtel 10 周上线、解决率超 70%,以及 Rocket Mortgage 月贷款规模达 $1B 等客户案例。
Together AI 基于 ICLR 2026 论文提出分治框架,让 Llama-3-70B、Qwen-72B 等较弱模型在长上下文任务上匹配或超过 GPT-4o 单次全文处理。框架把噪声拆为模型噪声、任务噪声和聚合器噪声,指出调整提示词(如改为返回每块最小的两个数)可降低聚合噪声;方法在 QA、检索、摘要等跨块依赖中等任务上更便宜、更快、易调参,但在高跨块依赖任务上仍需单次全文处理。
Sierra 推出以智能体构建智能体为核心的重构产品 Ghostwriter,用户上传 SOP、客服通话记录、白板草图等素材或用英文描述需求,即可生成支持语音、聊天、邮件和 30 多种语言、自带护栏的生产级智能体。
Gemini 发布 gemini-3.1-flash-live-preview,这是最新的音频到音频(A2A)模型,面向实时对话与语音优先的 AI 应用。开发者可查阅 Live API 文档开始使用。
Suno 发布 v5.5 模型,同时推出三项个性化功能。Voices 让用户采集自己的声音来创作音乐,包含验证流程且默认私密,面向 Pro 和 Premier 订阅者;Custom models 可基于自有曲目调出个性化模型,最多可建三个;My Taste 根据用户偏好学习风格,面向所有用户。官方称这些能力为今年晚些时候与音乐行业合作推出的新一代音乐模型打基础。
推荐理由:原文交代了新功能的具体机制与订阅限制,读者可据此判断如何用自己的声音和风格来创作音乐。
Google 推出 Vibe Coding XR 工作流,通过专门的系统提示词与 XR Blocks 代码模板,让 Gemini 将自然语言在 60 秒内转为可运行的、支持物理感知的 Android XR 应用。
Google Research 发布压缩算法 TurboQuant,可在零精度损失下大幅压缩模型,兼顾 KV cache 压缩与向量搜索,将亮相 ICLR 2026。
Google Research 发布自监督框架 S2Vec,通过 S2 Geometry 分区与特征栅格化,将道路、建筑等建成环境数据转为多层图像,再用掩码自编码(MAE)学习通用嵌入向量。在人口密度、收入等社会经济预测的地理外推任务中,S2Vec 表现优于 SATCLIP、GEOCLIP 等基线,但在树冠覆盖、海拔等环境任务上仍需改进;与图像嵌入的多模态融合通常优于单一模态。
Gemini API 推出 Lyria 3 音乐生成模型,包含 lyria-3-clip-preview(30 秒片段)和 lyria-3-pro-preview(完整歌曲)两个版本。两款模型均支持文本和图像输入,可生成 48kHz 立体声高质量音频。
SGLang 框架集成 Elastic EP,通过解耦专家与 GPU 的固定映射并维护冗余专家,为 DeepSeek MoE 部署提供部分故障容错能力。在 DeepSeek V3.2 的 4 节点 32 GPU 测试中(ep_size=dp_size=32、256 个冗余专家),服务中断控制在 10 秒以内,较完整重启的 2–3 分钟减少 90%。
Sierra 宣布在澳大利亚悉尼开设办公室,此前已扩展至新加坡、东京、马德里、巴黎和伦敦。其平台上的 AI 智能体支持 30 多种语言、全天候无等待服务,覆盖产品发现、注册登录、故障排查和流失管理。Rocket Mortgage 每月贷款量达 $1BN,使用其智能体的购房者完成流程的可能性高出四倍。
Mistral AI 发布 4B 参数的文本转语音模型 Voxtral TTS,支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语 9 种语言,API 定价 $0.016 per 1k characters。
推荐理由:官方给出了与 ElevenLabs 对比的人类评测数据和低延迟指标,读者可据此评估其在语音 Agent 场景的可用性。
Gemini API 在 AI Studio 上线 Prepay 和 Postpay 两种计费方案,现有账户可能受到影响,需查阅 Billing 文档了解详情。
Microsoft AI 团队发布图像生成模型 MAI-Image-2,称其使 MAI 进入 Arena.ai 榜单前三的文生图实验室行列。
推荐理由:原文给出榜单排名、可用入口和面向创意工作的三大能力重点,读者可据此判断是否试用或接入。
千问 Qwen3.5-Max-Preview 已在 Arena 部署,初步评测表现优异。官方表示将在未来两周内完成最终优化并正式发布,期间邀请社区通过 Arena 体验该模型能力。
Sierra 发布 𝜏³-Bench,在 𝜏-Bench 基础上新增 𝜏-Knowledge 与 𝜏-Voice 两个评测域,并合入社区对原有 airline、retail、telecom 任务的修复。
MiniMax 发布 M2.7 模型,称其为首个深度参与自身演化的 M2 系列模型,让模型构建 skills、更新记忆并改进强化学习实验流程。SWE-Pro 得分 56.22%,VIBE-Pro 55.6%,Terminal Bench 2 57.0%,GDPval-AA ELO 1495 为开源模型最高;MLE Bench Lite 三次运行平均奖牌率 66.6%。
推荐理由:原文给出了自进化工作流细节和多维度基准数据,读者可以对照评估 M2.7 在智能体与工程任务上的实际位置。
Together AI 扩展 Together Fine-Tuning,新增工具调用、推理和视觉语言模型(VLM)微调支持,训练栈升级后最高 6 倍吞吐提升,数据集支持至 100GB,并在训练前后提供成本与完成时间预估。
Google Research 在 The Check Up 活动上展示了多项医疗 AI 进展,包括与 Fitbit 合作研究的 Personal Health Agent(PHA),发现其比单一任务应用更能支持长期健康。
Google Research 与 NHS 合作开展 AIMS 研究,在 Nature Cancer 发表两篇论文评估 AI 乳腺癌检测系统。回溯评估覆盖约 115,973 名女性的乳房 X 光检查,AI 灵敏度显著高于原第一人类读者,癌症检出率从每千人 7.54 升至 9.33,并检出原双重读片漏掉的 25% 间期癌。
推荐理由:研究给出了AI作为乳腺癌筛查第二读者的端到端验证数据,包括检出率和人力节省的具体结果与仲裁误判风险。
Manus 上线 Meta Ads Manager 连接器早期 Beta 版,用户可在 Manus 工作区内直接查询广告数据并获得分析洞察。该连接器通过官方 API 以只读方式访问账户,支持自动生成每日或每周报告、仪表板、幻灯片和信息图表,并可连接多个广告账户。功能正在逐步推出,尚未向所有人开放。
Mistral AI 推出 Forge,一套让企业基于自有专有知识训练前沿级 AI 模型的系统,支持预训练、后训练与强化学习全流程。Forge 同时支持 dense 与 MoE 架构,并可处理多模态输入,模型可在企业自有基础设施内训练与治理。该平台以智能体优先设计,Mistral Vibe 等自主智能体可用其微调模型、寻找最优超参数并生成合成数据。
Gemini API 发布内置工具与函数调用组合功能,可在单次 API 调用中同时使用内置工具和自定义函数调用工具。Grounding with Google Maps 此后支持 Gemini 3 模型。
Manus 上线 Instagram 连接器早期 Beta 版,向所有用户开放,需使用 Instagram 专业账户(创作者或商业)授权。该连接器支持在 Manus 工作区内直接发布帖子、轮播、故事和短视频,并获取浏览量、覆盖率、点赞、评论、分享和收藏等指标数据。
Manus 推出 Manus Connectors 的 Instagram Creator Marketplace 早期 Beta 版本,可搜索和筛选超 200 万名创作者,覆盖 18 个市场。
Together AI 联合 CMU、Princeton、Cartesia 发布状态空间模型 Mamba-3,将设计重心从训练效率转向推理效率,核心改进包括更具表达力的递推公式、复数值状态追踪和提升精度的 MIMO 变体。
Mistral 发布 Mistral Small 4,将 Magistral 的推理、Pixtral 的多模态与 Devstral 的智能体编码能力统一到单一开源模型,采用 Apache 2.0 许可证。
推荐理由:官方公布了架构参数、reasoning_effort 用法和与 GPT-OSS 120B 的效率对比,可据此评估其开源部署价值。
Mistral AI 宣布加入 NVIDIA Nemotron Coalition 并担任创始成员,双方计划结合各自架构与算力共同开发前沿开源模型。联盟首个项目是在 NVIDIA DGX Cloud 上训练的基础模型,将支撑即将推出的 NVIDIA Nemotron 4 系列并开源;Mistral AI 同日发布 Mistral Small 4,此前双方曾合作开发 Mistral Nemo。
Google 与康奈尔大学合作,让 GPT-4o、Perplexity、Claude 3.5、Gemini Advanced Pro 1.5、NotebookLM 和一套自建 RAG 系统回答 67 道高温超导专家级问题,由 12 位国际专家盲评打分。NotebookLM 在多数维度表现突出,自建 RAG 系统紧随其后,两者与 Gemini 在观点平衡性和答案全面性上排名前三。
Miles 开源强化学习框架现已支持 ROCm,可在 AMD Instinct MI300/350 系列 GPU 上原生运行大规模 RL 后训练。该框架基于 SGLang 和 Slime 生态,支持 GRPO/PPO、Ray 编排及 Megatron-LM 集成,并提供预构建容器。
Manus 为 Google Workspace 连接器推出重大升级,基于 Google Workspace 团队开源的 Google Workspace CLI(非 Google 官方支持产品),从创建和读取文件扩展到 Docs 精准文本替换、Sheets 跨表数据交叉引用、Slides 编辑现有演示文稿等精细操作。
推荐理由:官方说明了升级后连接器能做的精细操作和免费开放方式,读者可据此判断是否改变自己的 Workspace 工作流。
Mistral 发布 Leanstral,称其为首个面向 Lean 4 的开源代码智能体,权重以 Apache 2.0 许可开放,采用 120B-A6B 稀疏架构,并可通过 Mistral Vibe 和 labs-leanstral-2603 API 端点使用。
Together AI 在 NVIDIA GTC 2026 上宣布多项进展,包括接入 NVIDIA Dynamo 1.0 推理栈、通过 NVIDIA NemoClaw 提供 OpenShell 运行时,并在模型库上线 NVIDIA Nemotron 3 Super 与 Parakeet TDT 0.6B V3。
Gemini API 于 3 月 16 日推出重新设计的 Usage Tiers 和 Billing Account 支出上限,以改善用户的计费体验。