Hugging Face Blog·· 2026-06-25精选AI 评分62
NVIDIA NeMo AutoModel 加速 Transformers MoE 微调
Accelerating Transformers Fine-Tuning with NVIDIA NeMo AutoModel
AI 导读
NVIDIA 发布开源库 NeMo AutoModel,在 HuggingFace Transformers v5 之上加入 Expert Parallelism、DeepEP 融合 all-to-all 调度和 TransformerEngine 内核,微调 MoE 模型时训练吞吐提升 3.4-3.7 倍、GPU 显存减少 29-32%,且只需改动一行 import。
推荐理由
原文给出同一 from_pretrained() 接口下的吞吐与显存对比数据,读者可据此判断 MoE 微调的迁移成本。
来源:Hugging Face Blog · huggingface.co