Liquid AI 发布 LFM2.5-VL-3B 端侧视觉语言模型
Liquid AI Releases LFM2.5-VL-3B: A 3B Vision-Language Model That Reads Screens, Grounds Objects, and Calls Tools On-Device
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Liquid AI 发布 LFM2.5-VL-3B,一个 3.1B 参数的端侧视觉语言模型,可读取移动、网页与桌面屏幕,将物体定位到坐标,解析文档和图表,并从文本或图像输入调用工具。
来源:MarkTechPost · marktechpost.com