论文10:16NeuralZip:可复用设置加速模型权重无损压缩这篇论文搞了个无损压缩模型权重的方法,压缩后比基线快最多 21 倍,还能省 27.5% 显存,做部署的可以看看。#NeuralZip#无损压缩#模型权重#GPU优化aarXiv cs.LG@Martín Bravo 等 4 人原文稍后读已读值得跟进有用关注 NeuralZip