跳到正文
原文
Hugging Face Blog·· 2026-07-23精选AI 评分66

Diffusers 原生支持 Nunchaku 4-bit 扩散推理

Bringing Nunchaku 4-bit Diffusion Inference to Diffusers

AI 导读

Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 SVDQuant 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。

推荐理由

原文给出 Nunchaku Lite 在 Diffusers 中的原生加载方式和显存与延迟对比,读者可据此判断是否替换现有量化后端。

来源:Hugging Face Blog · huggingface.co