quantized_distillation

PyTorch实现的量化蒸馏框架,通过可微分量化将神经网络压缩至2-4 bit,同时保持精度

Stars335
Forks76
主语言Python
分类模型部署与推理
作者antspy
License

加载项目详情…