跳到正文

全部动态

今日 68 条
9月24日周四
  1. Apple Machine Learning Research39

    Apple 用潜空间蒸馏压缩流式神经音频编码器,2.8 倍压缩下 WER 仅升 1.9%

    Apple 研究团队提出潜空间蒸馏方法压缩流式神经音频编码器(tokenizer),以教师模型量化前的逐帧潜表示为监督目标,仅训练学生编码器做回归,并用单层仿射层吸收师生宽度差异。在 2.8 倍压缩下,六组师生配对中有五组无需微调即保持在教师 1.9% 相对 WER 以内,并比同容量独立训练编码器相对提升 3.9%。该方法同时适用于独立预训练和与语言模型联合训练的 tokenizer。

  2. Google Developers Blog61

    Google Cloud API Gateway 公测支持将 REST API 直接暴露为 MCP 工具

    Google Cloud API Gateway 进入 Public Preview,可充当远程 MCP 服务器,无需单独搭建 MCP 服务器即可把现有 REST 操作变成智能体可调用的 MCP 工具。

    推荐理由:官方宣布 API Gateway 可直接充当远程 MCP 服务器,复用既有鉴权与配额,无需另建 MCP 服务器,适合评估 Agent 接入现有 API 的路径。

  3. Meta Engineering54

    Meta 将 Private Processing 机密计算扩展到 Meta AI 眼镜

    Meta 宣布把 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,让 AI 在云端 CVM 内处理个人上下文,连 Meta 自己也无法访问数据。系统基于 TEE 硬件隔离,采用匿名凭证加第三方 OHTTP 中继实现不可定向路由,通过 RA-TLS 远程证明核对公开透明账本,持久记忆以用户密钥加密存储在 TEE 内,并扩展 Bug Bounty 供外部研究者审计。

  4. Apple Machine Learning Research26

    Apple 提出半监督联邦 ASR 实用方案:在线伪标签配合服务端更新稳定化

    Apple 研究团队提出半监督联邦 ASR 训练方案,通过在线伪标签教师与服务端标注数据锚定更新两条耦合设计轴,解决伪标签误差跨序列、跨轮次累积导致的训练发散问题。该方案在 11 组对比中 9 组优于此前最强方法,域内平均提升 20.8%、跨域提升 10.0%,缩小了与全监督联邦学习的差距。

  5. Karina31

    当 @jakubzeg 和我在 OpenAI 相遇时,我们反复回到一个共同的困扰:太多 AI 产品都从一个空白的聊天框开始。你几乎可以做任何事,但你必须决定从哪里开始,这让人不知所措。 有了 ACTx486,我们从一段本身已有故事的媒体内容出发,让你在观看的同时与之互动。这也让这项技术更加通用。 我们在这里写了更多关于这一选择的思考:https://www.actx486.com/

    引用Rehan Sheikh@rehan_shei

    interactive media will be huge in the next year or two! this is incredible

  6. Boris Cherny48

    如果你注意到 https://claude.ai 和桌面应用在过去几周变得有多快,这就是我们做到的方法。 博客文章里有很多干货学习和技巧,适合正在为自己的应用提速的工程师。

    引用ClaudeDevs@ClaudeDevs

    We made claude​.ai 3x faster in two weeks. Here’s how we use Claude to measure, debug and improve performance. Prompts and methods included. https://claude.dev/blog/how-we-made-claude-ai-faster/

  7. Claude73

    Anthropic 官方账号宣布 Claude Marketplace 上线,用户可在其中发现工具、智能体和专家伙伴。用途包括添加 Slack、Notion 等连接器和插件,购买 Cursor、CrowdStrike 等公司的智能体和产品,以及通过 Accenture、Deloitte 等服务伙伴扩展规模。

    推荐理由:官方宣布 Claude Marketplace 上线,读者可以据此了解连接器、Agent 产品和服务伙伴三类入口的实际内容。

  8. Claude Code GitHub Releases39

    Claude Code v2.1.281 发布

    Claude Code v2.1.281 为 Claude apps gateway 新增 Bedrock upstream 的 assume_role 与 guardrail 配置,并支持在 settings.json 中设置 "attribution": false 隐藏提交与 PR 署名。该版本还修复了会话恢复时重发历史、提示缓存丢失、代理中断流被误判为完成等多项问题。

  9. GitHub Blog · AI & ML56

    GitHub Copilot app 如何渲染超大 Pull Request

    GitHub Copilot app 重建了 Pull Request 视图,可流畅打开含 2,200 个文件、超过一百万行变更和 400 多条内联评论的超大 PR。核心做法是把高度拆成确定性的代码几何与动态评论块两套独立体系,配合基于身份锚定的滚动校正、先流式返回结构的 pipeline,以及用生产探针和自动巡航跑 change → measure → improve 循环来定位 bug。

  10. Greg Brockman78

    ChatGPT Voice 重大升级,可调用邮件、日历、Slack 等插件,并可由 GPT-6 Astra、Sol 和 Luna 驱动。用户可在网页和移动端的 ChatGPT Work 中仅凭语音创建文档、演示文稿、网站和表格,或通过浏览器完成复杂任务,今日起在全球最新版本应用中推出。

    引用OpenAI@OpenAI

    We heard you loud and clear. ChatGPT Voice can now: - Use plugins like your email, calendar, and Slack. - Be powered by GPT-6 Astra, Sol, and Luna. - Be used in ChatGPT Work on web and mobile, so you can create docs, decks, sites, and spreadsheets or tackle complex tasks in the browser, just by talking. Rolling out globally today in the latest version of the app.

    推荐理由:原文列出了语音可用的插件类型和可用入口,读者可以据此判断日常语音助手工作流会有哪些变化。

  11. Simon Willison25

    用可交互示例讲解 Shadow DOM 的 shadow roots

    一篇用可交互示例讲解 shadow roots 的教程,演示样式封装、继承、slots、parts 以及 JavaScript 访问方式,展示 shadow root 如何创建带私有样式表和元素的隔离 DOM 树,并以受控方式与页面 DOM 交互。该示例由 Fable 5.1 Medium 根据提示词生成。

  12. SiliconFlow36

    并非每次模型调用都需要一个答案。有时,它只需要一个决策。 👏 欢迎 Kev-4B 加入 SiliconFlow。 Kev-4B 是 Jev 的开源社区版,基于 Qwen3.5-4B 构建,用于结构化决策。 路由。排序。批准。升级——无需再生成一段回复。 无需部署或适配。一个 SiliconFlow API key,Kev 就能接入你的工作流。 特别感谢 @jaredpalmer 开源 Kev。❤️ 在 SiliconFlow 上试试 Kev-4B。⚡️

  13. elsewhere articles34

    真格基金让 AI 当主播,与管理合伙人刘元录了一期播客

    真格基金在其播客《此话当真》中让 AI 坐上主播席,与真格管理合伙人刘元对谈约一小时。AI 顺着自己的好奇心提问,聊到能否训练一个「刘元 AI」、AI 能否胜任早期投资,以及人为什么带着缺陷仍一次次相信「这一次会不一样」。节目还讨论了资本不再稀缺后,价值观和品位会成为基金的差异。

  14. Anthropic Research64

    Anthropic Project Swap 实验:Claude 智能体在交易市场代用户换书的表现

    Anthropic 让 201 名员工的 Claude 智能体在六个办公室的去中心化交易楼层代用户交换书籍。5 分钟 intake 对话后,Claude 对书对的排序与本人一致率达 61%,市场效率 0.55(最优 0.89),其中 85% 的差距来自偏好表征不准而非谈判;重跑显示模型选择比指令更影响谈判结果,Opus 楼层效率 0.88 高于 Haiku 的 0.75。

    推荐理由:原文把市场失分的 85% 归因于偏好表征而非谈判能力,并给出模型选择比指令更影响结果的可复现数据。

  15. Claude Blog54

    Claude Tag 支持在 Slack 频道中使用个人连接器

    Anthropic 宣布 Claude Tag(beta)新增个人连接器支持,频道内用户请求时可调用自己账户连接的工具,如个人 Google Drive、日历或 CRM。用户可选择 review 模式在发布前审核回复,或使用 auto 模式自动发布;Enterprise 管理员可强制审核。该功能现正面向 Team 计划推出,Enterprise 随后支持,无人值守任务仍使用频道共享连接器。