OpenRouter 推出美国区域路由,与去年上线的 EU 路由配套保障数据驻留
OpenRouter 发布美国区域路由 us.openrouter.ai,与去年 10 月上线的 eu.openrouter.ai 配套,请求在区域内解密并只路由到区域内提供商,全程不出区。
推荐理由:原文区分了推理级与端到端区域路由的差异,并说明区域域名、404 行为和 Guardrails 配置,读者可直接评估合规用法。
OpenRouter 发布美国区域路由 us.openrouter.ai,与去年 10 月上线的 eu.openrouter.ai 配套,请求在区域内解密并只路由到区域内提供商,全程不出区。
推荐理由:原文区分了推理级与端到端区域路由的差异,并说明区域域名、404 行为和 Guardrails 配置,读者可直接评估合规用法。
Introducing Muse, your personal AI agent from Meta that gets things done across every part of life. Download the Muse app and get started: https://Muse.ai
Muse Spark 1.3 现已支持 max reasoning,可在 Muse Code 和 Meta Model API 上使用 👇
1/ we just publicly released Muse Spark 1.3 max! we see significantly stronger coding and agentic performance on muse spark 1.3 max, so would strongly recommend trying it out even if you've already tried muse spark 1.3 high or muse spark 1.3 xhigh.
Meta 推出 ZGateway,作为统一 ZippyDB 客户端流量的无状态代理层,可承载超过 10 亿次/秒的操作,目前承担约 40% 的 ZippyDB 流量,预计将增长至 60% 以上,平均用例仅增加约 6% 计算开销。
Meta 工程团队构建了一个作为组织第二大脑的 AI 智能体,通过结构化知识体系、可组合 recipes 推理层和自动自我改进循环,把专家反馈编译为无需模型重训练的验证更新。系统将 200+ 知识文件按密度与使用频率划分、以 YAML 依赖图组织,六周内把单项评估时间从数天降到数分钟,每轮次 token 消耗减少约 80%,改进周期零回归。
Meta 发布为 AI 工作负载在商用以太网上全新设计的 RDMA 传输协议 MetaRoCE,将通过 OCP 开放规范、参考软件实现和合规测试套件,并计划在 2026 OCP Global Summit 上发布。
Meta 发布自研训练加速器 MTIA 300,专为排序与推荐模型训练优化,是 MTIA 家族首款训练芯片。
Nathan Lambert 撰文分析开源 AI 的经济结构,区分附带完整训练配方的开源语言模型与仅含权重和使用代码的开放权重模型,指出 Nvidia 投入 260 亿美元打造近开源 Nemotron 模型意在让更多人自建模型、扩大其芯片需求。
WhatsApp 推出可选功能 Scam Alert,在设备端用机器学习模型对非联系人消息做诈骗分类,消息内容不上传、不自动上报。模型版本经 Cloudflare 签名并发布到第三方 append-only 透明账本,遥测经基于 TEE 的机密联邦分析管线以差分隐私聚合方式回传,用户可在应用内查看 Scam Alert Activity 日志,功能正在 Beta 小范围推送。
推荐理由:原文给出了 Scam Alert 的端侧架构与可验证机制细节,安全研究者可以据此评估其在端到端加密下的实现。
Meta 发布从 Muse 蒸馏而来的 30B 多模态模型 Muse Glimmer,采用 Apache 2.0 许可,面向本地隐私场景的智能体用途。模型由 2B ViT 视觉编码器和 28B 文本解码器组成,支持图像、视频、多模态工具调用和目标检测,并附带基于 DFlash 的可选投机解码。
推荐理由:原文给出架构组成、基准对比和各推理框架的 day-0 用法,读者可以据此评估本地部署的可行路径。
Meta 工程博客介绍其广告排序的多阶段序列建模架构与论文 LLaTTE:离线用户模型异步处理数千长度序列并缓存嵌入,在线排序模型结合实时信号完成打分。
Institute for Law & AI 提出“激进可选择性”监管思路,主张政府短期避免过度监管,同时提前建设信息收集、举报人保护、评估与模型权重安全等能力。Meta 与 KAIST 的论文提出 Neural Computer,将计算、内存与 I/O 统一在学习到的运行时状态中。
SGLang 推出 Encoder-Prefill-Decode(EPD)分离架构,将视觉编码从语言处理中拆出,编码器服务器可独立横向扩展,并兼容现有 PD 分离形成三层架构。