AI资讯文章2026-7-25Diffusers 迎来 Nunchaku 4-bit 推理:显存减半且生成提速的扩散模型量化新方案Hugging Face Diffusers 正式集成 Nunchaku Lite,引入基于 SVDQuant 技术的 W4A4(4位权重与激活)量化推理。消费级显卡用户现在不仅能大幅降低大型扩散模型的显存占用,还能获得约30%的推理速度提升,让高精度 AI 绘图更加平民化。
Diffusers 迎来 Nunchaku 4-bit 推理:显存减半且生成提速的扩散模型量化新方案
Hugging Face Diffusers 正式集成 Nunchaku Lite,引入基于 SVDQuant 技术的 W4A4(4位权重与激活)量化推理。消费级显卡用户现在不仅能大幅降低大型扩散模型的显存占用,还能获得约30%的推理速度提升,让高精度 AI 绘图更加平民化。