跳到正文
原文
Hugging Face Blog·· 2026-06-25精选AI 评分65

NVIDIA NeMo AutoModel 开源库发布,MoE 微调吞吐提升 3.4 至 3.7 倍

Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel

AI 导读

NVIDIA 发布 NeMo AutoModel 开源库,基于 Transformers v5,在 Qwen3-30B-A3B 和 Nemotron 3 Nano 30B A3B 微调中实现 3.4 至 3.7 倍训练吞吐提升与 29% 至 32% 显存下降,只需改动一行 import。

推荐理由

只需改动一行 import,MoE 微调吞吐即可提升 3.4 至 3.7 倍、显存降低 29% 至 32%,读者可据此判断迁移成本。

来源:Hugging Face Blog · huggingface.co