inclusionAI 发布 VISTA-4B:基于 Qwen3.5 4B 的 GUI 定位视觉语言模型
inclusionAI/VISTA-4B
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
inclusionAI 发布 GUI 定位视觉语言模型 VISTA-4B,基于 Qwen3.5 4B 骨干,采用视图一致性 GRPO 训练与自验证跨视图锚定,将截图和自然语言指令映射为 0-1000 归一化坐标。
来源:inclusionAI Hugging Face models · huggingface.co