At @NeurIPSConf
, we introduced Sparse Pre-training and Dense Fine-tuning to reduce the computational FLOPs of training GPT models using weight sparsity without significant loss in downstream task metrics Read more here: https://
hubs.li/Q01twKNt0 #NeurIPS2022 #sparsity #ai #ml
Sparse Pre-training Dense Fine-tuning Reduces GPT Training FLOPs
By
–