inclusionAI Ling-3.0-flash-GGUF 发布,支持 llama.cpp / vLLM / Ollama 本地部署
inclusionAI/Ling-3.0-flash-GGUF
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
inclusionAI 发布 Ling-3.0-flash-GGUF 量化模型,提供 Q4_K_M 版本,可通过 llama.cpp、vLLM、Ollama、Docker Model Runner、LM Studio 等工具在本地运行。
来源:inclusionAI Hugging Face models · huggingface.co