跳到正文
原文
Hugging Face Blog·· 2026-07-23精选AI 评分62

Hugging Face 将 Nunchaku 4-bit 扩散推理接入 Diffusers

Bringing Nunchaku 4-bit Diffusion Inference to Diffusers

AI 导读

Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 4-bit 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。

推荐理由

原文给出 Nunchaku Lite 在 Diffusers 中的加载方式与实测数据,读者可据此判断 4-bit 扩散推理的显存与速度取舍。

来源:Hugging Face Blog · huggingface.co