Reka 发布 19B 全模态推理模型 Rho-1,单一网络理解生成视频并输出机器人动作
Reka 发布研究预览版 Rho-1,一个 19B 全模态推理模型,可理解并生成文本、图像和视频,并输出机器人动作。模型在每层用两条专家权重流共享注意力与同一 KV cache,视频生成中位数 0.79 倍实时,蒸馏版把去噪从 99 步减到 8 步,约 1 秒产出 5.3 秒视频片段。
marktechpost.com · 网站与博客
Reka 发布研究预览版 Rho-1,一个 19B 全模态推理模型,可理解并生成文本、图像和视频,并输出机器人动作。模型在每层用两条专家权重流共享注意力与同一 KV cache,视频生成中位数 0.79 倍实时,蒸馏版把去噪从 99 步减到 8 步,约 1 秒产出 5.3 秒视频片段。
PhAI Labs、CUHK、复旦、斯坦福、牛津与普林斯顿的研究者发布 JEPA-Anything,一个用同一套学习配方跨领域构建世界模型的框架,通过 Orthogonal Predictive Factorization(OPF)把 JEPA 的单一目标嵌入拆成 K 个正交子空间并各配独立预测器。
Together AI 发布 beta 版免费 MIT 协议 CLI 工具 Together Link,通过一条命令把 Claude Code、Claude Desktop、Codex、ChatGPT Desktop、OpenCode 2 和 Pi 等编码 Agent 连到 Together 托管的开源模型。
本教程围绕 NVIDIA Cosmos3-DROID 数据集搭建端到端流式机器人学习流水线,无需下载 707 GB 仓库,通过 HTTP byte-range 与 PyArrow 按需读取 Parquet 行组和列。
Reflection AI 发布其首个开源权重模型 Beam,为 501B 总参数、每 token 23B 激活的稀疏 MoE 模型,仅支持文本,有效上下文 1M tokens,面向企业编码、推理与智能体工作负载。
Yandex 发布生成式推荐模型 Sona,将候选生成与排序合并为一个共享用户表征的 Transformer 系统,替代 15 个以上候选生成器及预排序、排序阶段。
这篇文章按时间线梳理了 Qwen 从 2023 年 4 月通义千问邀请码内测,到 2026 年 8 月开源 2.4 万亿参数 Qwen3.8-2.4T-A95B 的完整发布史。
Cantina Security 联合 Yeta Labs 发布开源权重模型 apex-flash-1,基于 GLM-5.3-Flash 用 GRPO 微调,321.3B 总参数、18B 激活参数,MIT 许可。