跳到正文
原文
Hugging Face Blog·· 2026-06-25精选AI 评分62

NVIDIA NeMo AutoModel 加速 Transformers MoE 微调

Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel

AI 导读

NVIDIA 发布开源库 NeMo AutoModel,在 HuggingFace Transformers v5 之上加入 Expert Parallelism、DeepEP 融合 all-to-all 调度和 TransformerEngine 内核,微调 MoE 模型时训练吞吐提升 3.4-3.7 倍、GPU 显存减少 29-32%,且只需改动一行 import。

推荐理由

原文给出同一 from_pretrained() 接口下的吞吐与显存对比数据,读者可据此判断 MoE 微调的迁移成本。

来源:Hugging Face Blog · huggingface.co