Suno 与 Songs of Love 基金会合作,用 AI 为病患儿童与老人定制歌曲
Suno 与运营近 30 年的非营利组织 Songs of Love Foundation 达成合作,借助其 AI 音乐工具帮助志愿者大规模创作融入受助者姓名、爱好与宠物信息的个性化歌曲。
Suno 与运营近 30 年的非营利组织 Songs of Love Foundation 达成合作,借助其 AI 音乐工具帮助志愿者大规模创作融入受助者姓名、爱好与宠物信息的个性化歌曲。
Mistral AI 为 Le Chat 推出一批新功能,包括 Deep Research 预览模式、基于 Voxtral 的语音模式、由 Magistral 驱动的多语言推理、Projects 项目整理功能,以及与 Black Forest Labs 合作的高级图像编辑。
推荐理由:Mistral 官方一次性列出五项新功能及其支撑模型,读者可以对照了解 Le Chat 在研究和多模态方向的能力变化。
金融科技公司 Mercury 的 staff 工程师 Matt Russell 在访谈中复盘其团队六个月使用 AI 智能体的经验。团队从 3 月内部黑客松起步,通过 Linear for Agents 把 issue 分派给第三方智能体并回收 PR,还用 Linear Asks 模板让 ops 团队自助提交工单、由智能体建 UI 并提交 PR,几乎无差错。
Mistral AI 发布语音理解模型 Voxtral,提供 24B 和 3B 两个版本,均以 Apache 2.0 许可开源并上线 API。
推荐理由:官方给出完整基准对比和定价细节,开源语音模型在准确率与成本上的位置可以直接对比判断。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并推出 Devstral Small 1.1 升级版。
推荐理由:官方给出 SWE-Bench Verified 分数和 API 定价,可比较两款新模型在成本与代码智能体性能上的定位。
Suno 宣布 Paul Sinclair 加入公司担任首席音乐官,负责领导面向行业与艺人的相关工作。Paul 曾任 Atlantic Records 总经理,与 Bruno Mars、Coldplay、Janelle Monae、Missy Elliot 等艺人合作,并曾是音频硬件公司 Audeze 的长期董事会成员。
Mistral AI 推出 AI for Citizens 协作计划,帮助各国政府和公共机构战略性地运用 AI 改造公共服务、推动创新并保障竞争力。该计划提供开放模型与产品组合、自托管或 SaaS 部署选择、数据主权保障及定制化研发,已与法国、卢森堡、新加坡、荷兰、英国、瑞士等国政府及公共部门合作。
Microsoft AI 发布 MAI-DxO 诊断编排器与 SD Bench 基准,将 304 个 NEJM 病例转化为逐步诊断挑战,MAI-DxO 正确诊断最高达 85%,是同一组有经验医生的四倍以上,且以更低检查成本得出正确诊断。
推荐理由:原文同时给出诊断准确率、成本对比和研究局限,并说明 SD Bench 尚未公开,读者可据此理解结果边界。
Suno 宣布收购全浏览器运行的 AI 加速数字音频工作站 WavTool,其编辑技术与核心团队加入 Suno 并担任产品与工程领导职务。WavTool 是首个结合 VST 插件支持、采样级编辑、现场录音与 stem 分离、AI 生成 MIDI、应用内聊天机器人等原生 AI 能力的浏览器 DAW。此前 Suno 本月刚发布包括高级歌曲编辑器、stem 分离和增强音频上传的新编辑界面。
Mistral AI 发布 AI 基础设施服务 Mistral Compute,提供从裸金属服务器到全托管 PaaS 的私有集成技术栈,涵盖 GPU、编排、API、产品和服务。
Mistral AI 发布首个推理模型 Magistral,含 24B 参数开源版 Magistral Small(Apache 2.0)和企业版 Magistral Medium。
推荐理由:官方给出两个版本的基准分数、开源许可和语言能力细节,读者可据此评估它在推理模型中的定位。
Mistral 发布企业级 AI 编码助手 Mistral Code,基于开源项目 Continue,面向 JetBrains IDE 和 VSCode 开放私测,GA 计划近期推出。
Suno 发布一组创作控制功能:升级版 Song Editor 可在波形上逐段重排、改写和重制曲目,并可将曲目拆分为 12 条干净 stems(人声、鼓、贝斯等)预览和下载。音频上传扩展至最长 8 分钟,可从自己的完整曲目或吉他 riff 开始创作,另新增三个创意滑杆控制生成风格,支持导出后在 DAW 中继续编辑。
推荐理由:原文列出了 Song Editor、stems 分离和上传上限等具体能力,读者可以对照自己现有的创作流程判断是否用得上。
Mistral AI 发布代码专用嵌入模型 Codestral Embed,称其在真实代码检索任务上优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 大型嵌入模型。
Linear 创始人发文分析为何质量稀缺,认为每次技术进步都会把行业拉离手艺,而 AI 正试图把制作者的判断和品味也从创作中分离出去。他主张质量本身就是商业策略:Linear 第二年实现盈利,第四年拥有超过 10000 个付费客户且几乎没有营销支出,并分享了以质量为北极星、3-5 人小团队、MVP 仅限内部使用、issue 7 天内修复等实践。
DeepSeek 官方宣布 deepseek-reasoner 模型升级为 DeepSeek-R1-0528,推理能力增强,AIME 2025 Pass@1 从 70.0 升至 87.5,GPQA 从 71.5 升至 81.0,Aider 从 57.0 升至 71.6。
推荐理由:官方更新日志列出各基准的具体分数变化,读者可以直接对比新旧 R1 在推理和幻觉上的差异。
Mistral 发布新的 Agents API,将模型与代码执行、网络搜索、图像生成、Document Library 及 MCP 工具等内置连接器结合,并作为 Chat Completion API 的补充简化 Agent 场景开发。
推荐理由:官方原文给出内置连接器、有状态对话与多智能体编排等核心能力,还附 SimpleQA 数字,读者可据此评估其对企业级 Agent 开发的适用性。
Mistral AI 与 All Hands AI 联合发布面向软件工程任务的智能体模型 Devstral,以 Apache 2.0 许可开源。
推荐理由:官方发布给出 SWE-Bench Verified 成绩、开源许可和部署门槛,读者可据此判断它在本地或企业编码场景中的位置。
Mistral AI 发布 Mistral Medium 3,定位为兼顾 SOTA 性能、成本低约 8 倍和更易部署的新级别模型。
推荐理由:官方给出与 Claude Sonnet 3.7 对比的基准数字和 $0.4/$2 定价,读者可以据此评估它在企业部署中的性价比。
Mistral AI 推出企业级 AI 助手 Le Chat Enterprise,由全新 Mistral Medium 3 模型驱动,提供企业搜索、Agent 构建器、数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。
Suno 发布最新音乐生成模型 v4.5,曲风选项大幅扩充且更贴合描述,人声情感与音域增强,歌曲最长可达 8 分钟。新增提示词增强助手,Covers 与 Personas 可组合使用,生成速度与音频质量也有明显提升。
推荐理由:官方公告列出了 v4.5 在曲风、人声、音质和生成速度上的具体改进,音乐创作工作流的变化可以直接对照查看。
Mistral AI 发布教程,介绍用 LLM As A Judge 评估 RAG 系统的方法。文章讲解 TruLens 提出的 RAG Triad 框架,从上下文相关性。
DeepSeek 官方宣布 deepseek-chat 模型升级为 DeepSeek-V3-0324。基准测试提升明显,MMLU-Pro 75.9 → 81.2,GPQA 59.1 → 68.4,AIME 39.6 → 59.4,LiveCodeBench 39.2 → 49.2。
推荐理由:原文给出各基准测试的具体提升数字和功能变化,读者可据此评估升级对现有应用的影响。
Mistral AI 发布 Mistral Small 3.1,相比 Mistral Small 3 提升文本性能,新增多模态理解,上下文窗口扩展至 128k tokens,推理速度达 150 tokens/秒,官方称超越 Gemma 3 和 GPT-4o Mini 等同级模型。
推荐理由:官方给出了与 Gemma 3 和 GPT-4o Mini 的对比数据、部署门槛和开放下载渠道,可据此评估端侧与低成本部署选择。
Mistral 发布光学字符识别 API Mistral OCR(mistral-ocr-latest),以图像和 PDF 为输入,输出交错的文本与图片,已作为 Le Chat 默认文档理解模型。
推荐理由:官方公布了自评基准对比、定价和部署选项,读者可以据此评估它在文档理解与 RAG 场景中的位置。
Mistral AI 推出 TranscriptToPRDTicket 智能体工作流,由 Mistral Large 2 驱动的 PRDAgent 和 TicketCreationAgent 组成,可将会议转录自动生成 PRD 并转化为结构化开发工单,自动在 Linear / Jira 中创建。
DeepSeek 在 API 中上线 deepseek-reasoner,即新模型 DeepSeek-R1,通过指定 model=deepseek-reasoner 调用。详细更新见 DeepSeek-R1 正式发布说明,调用指南见推理模型文档。
推荐理由:原文说明 deepseek-reasoner 即 DeepSeek-R1,给出了调用方式,方便开发者在 API 中直接使用新推理模型。
deepseek-chat 模型已升级为 DeepSeek-V3,接口不变,仍可通过指定 model=deepseek-chat 调用。详细更新可参考官方 DeepSeek-V3 正式发布说明。
推荐理由:API 接口保持不变,现有用户可无迁移成本地用上 DeepSeek-V3,原文还指向了详细更新说明。
DeepSeek 将 deepseek-chat 模型升级为 DeepSeek-V2.5-1210,数学能力在 MATH-500 基准测试中从 74.8% 提升至 82.8%,代码能力在 LiveCodebench(08.01-12.01)准确率从 29.2% 提升至 34.38%。中文写作与推理能力在内部测试集中也有提升,同时优化了文件上传和网页总结功能的用户体验。
Suno 正式推出 Android 版,这是其首个 Android 版本,用户可通过文本提示词创作音乐、发现创作者社区的新曲目与风格并分享作品。官方表示该版本先上线核心功能,后续将持续迭代,目前已可下载使用。
Suno 发布 v4 音乐生成模型,带来更干净的音频、更清晰的歌词和更有动态的歌曲结构。新功能包括 Remaster 旧曲目升级到 v4 音质、歌词辅助模型 ReMi 和封面生成,Covers 与 Personas 也已由 v4 驱动,目前以 beta 形式向 Pro 和 Premier 订阅开放,可在 suno.com 和 iOS 使用。
推荐理由:官方发布说明列出了音质、歌词、封面和功能升级点,读者可以据此判断是否升级使用。
Scale AI 在产品与工程团队推动下全员迁移到 Linear,此前各团队分散使用多种工具,导致 issue 重新分配、上下文共享和进度追踪困难。迁移后 Scale 的 bug 解决时间缩短 52%,并借此支撑其 AI 数据产品的快速扩张。
Suno 官宣 Jack Brody 加入担任首席产品官,负责产品与设计。Jack 曾在 Snap 工作十年,离职前担任产品负责人,将以全职身份领导 Suno 打造面向更广泛受众的音乐未来。
Suno 发布新功能 Personas,可提取并保存歌曲的人声、风格和氛围,将其应用到新创作中。功能目前以早期测试版向所有 Pro 和 Premier 订阅者开放,附赠 200 首用 Personas 制作的歌曲,之后每首消耗 10 credits;支持设为 Public 供他人使用并链接回创作者主页。
Suno 宣布与 Audible Magic 合作,将后者的内容识别技术直接集成到用户上传流程中,以阻止未经授权的用户上传。该技术服务于 Suno 的 Audio Inputs 与 Covers 功能,用户可上传自己的原创作品或手机上的小样来生成歌曲。Suno 联合创始人兼 CEO Mikey Shulman 称 Audible Magic 是版权合规的可信合作伙伴。
Suno 发布新功能 Suno Scenes,将用户拍摄的照片和视频转化为歌曲,提供视觉叙事的歌曲创作方式。该功能先向 iOS 移动端用户开放,在应用的 Camera 模式下即可使用。
微软 AI 发布 Copilot 应用,其 discover feed 体验整合了学习、探索与放松功能。微软 AI CEO Mustafa Suleyman 表示,Copilot 能理解用户生活语境,同时保护隐私、数据与安全,并记住最有帮助的细节。它还能提供知识获取,简化日常信息轰炸,并在用户需要时给予支持与鼓励。
Suno 推出首个校园大使项目 Sunoversity,招募在校本科生和硕士生担任 University Growth Specialist,申请将于 2024 年 10 月 13 日截止。入选者可免费获得 Suno Premier、优先测试新功能、获得独家周边,并与 Suno 创始人及领导者合作。
Suno 推出早期测试版新功能 Covers,可将语音备忘录或完整曲目转换成不同风格,同时保留原旋律。功能目前面向 Pro 和 Premier 订阅用户开放,每人有 200 次免费额度,之后每次生成消耗 10 credits;beta 阶段可能出现返回原片段未换风格等问题,官方征集用户反馈。
DeepSeek 将 DeepSeek V2 Chat 与 DeepSeek Coder V2 合并升级为 DeepSeek V2.5,API 用户通过 deepseek-coder 或 deepseek-chat 均可访问新模型。
推荐理由:原文来自官方更新日志,给出了合并后的模型名称、API 兼容方式和多项评测分数变化,便于读者对照评估升级效果。