贾扬清创立 Intent Lab,Fleet 生成 GLM-5.2 推理引擎提速 6.3 倍
贾扬清离开英伟达再创业!GLM-5.2速度飙6.3倍,一句话造的推理引擎
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
贾扬清离开英伟达后再创业,成立 Intent Lab,推出定位为把意图转化为生产级软件的自主智能体系统 Fleet,首批公布三项成果。其中 GPU 推理引擎由一句话意图生成,在 TensorRT-LLM 上完成内核、运行时、通信和投机解码四类优化,在两台 Grace Blackwell 节点上把输出速度从 102 tokens/s 提升到 647 tokens/s。
来源:量子位 · 微信公众号 · mp.weixin.qq.com