谷歌 GKE Labs 推出 OpenRL:面向 LLM 后训练微调的自托管 API
Google OpenRL 是一个用于大型语言模型(LLM)后训练微调的实验性自托管 API
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
谷歌 GKE Labs 推出开源项目 OpenRL,为在标准 Kubernetes 集群上对 LLM 进行后训练和微调提供自托管 API。它通过并行运行多个强化学习任务提高 GPU 利用率,并支持在 Mac 上运行强化学习循环、指向 Kubernetes 集群或虚拟机上的训练 API。
来源:InfoQ · 微信公众号 · mp.weixin.qq.com