腾讯 UniRL:统一多模态 RL 框架的 2.4X 端到端性能优化实践|AICon 深圳
UniRL:统一多模态 RL 框架的 2.4X 端到端性能优化实践|AICon 深圳
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
腾讯多模态 RL Infra 负责人朱文熙将在 AICon 深圳站分享 UniRL 统一多模态 RL 框架,通过 Role/Worker 分离架构、Bitwise 训推一致性和自研 FalconGEMM 算子实现端到端性能优化。
来源:InfoQ · 微信公众号 · mp.weixin.qq.com