稀宇科技发布 MiniMax H3 全模态生成模型,最高支持 15 秒 2K 分辨率
MiniMax H3 全模态生成模型正式发布:最高支持 15 秒 2K 分辨率,超分方案革新
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
稀宇科技推出 MiniMax H3 全模态生成模型,可统一理解文本、图像、视频、声音组成的多模态上下文,并输出原生双声道音视频,最高支持 15s 2K 分辨率。其 2K 视频输出没有使用常规超分模块,而是由 H3 基础模型对自身低分辨率结果做 in-context 重新生成;处理素材大部分需消耗 100K Token 推理,最终得到平均约 4K Token,模型权重将于未来几天内开放。
来源:IT Home · ithome.com