跳到正文
huggingface.co(经 Hacker News)·· 2026-06-27AI 评分24

Apex-1-flash:在 RTX 5070 上微调的 4B 推理模型

Show HN: Apex-1-flash, 4B LLM finetuned on RTX 5070

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

Apex-1-flash 是一个基于 Qwen3:4B 微调的 4B 小模型,目标是在消费级硬件上运行推理任务。它使用 Unsloth 在 RTX 5070 上完成微调,技术栈为 cu128、PyTorch 和 Hugging Face Transformers,训练数据为 Open-CoT-Reasoning-Mini,以提升链式推理(CoT)能力。

来源:huggingface.co(经 Hacker News) · huggingface.co