Hugging Face Blog·· 2026-07-23精选AI 评分66
Diffusers 原生支持 Nunchaku 4-bit 扩散推理
Bringing Nunchaku 4-bit Diffusion Inference to Diffusers
AI 导读
Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 SVDQuant 量化检查点,无需自定义 pipeline 或本地 CUDA 编译。
推荐理由
原文给出 Nunchaku Lite 在 Diffusers 中的原生加载方式和显存与延迟对比,读者可据此判断是否替换现有量化后端。
来源:Hugging Face Blog · huggingface.co