Model Compression Toolbox for Large Language Models and Diffusion Models
Model Compression Toolbox for Large Language Models and Diffusion Models
DeepCompressor2: a fork built so an agent can bring up a new model — multi-GPU calibration, disk-backed weights, faster search
如何设置rank为128正常出图
How to quantize flux.1-fill-dev
Regarding quantization parameter adjustment
Diffusion example evaluation
Batch sizes for 24gb gpu
[BUG]in MJHQ dataset, the format of feature is different in function _info and _generate_examples
Quantization of Diffusion Model with W4A16 Setting
Qwen-Image/Edit quantization code open source
convert svdq failed