Tired of LLMs maxing out memory even on powerful supernode architectures? Shanghai Jiao Tong University and Huawei Technologies Co., Ltd. introduce HyperOffload! This new compiler-assisted framework intelligently plans data movement for large language models. By treating
HyperOffload: Compiler Framework Optimizes LLM Memory Management
By
–
