AI Dynamics

Global AI News Aggregator

About

LLM Catastrophic Forgetting in Reinforcement Learning Fine-Tuning

Is your LLM truly ready for reinforcement learning, or is it forgetting its roots? Xinran Li and team from HKUST, Alibaba, and Xiamen University discovered that standard supervised fine-tuning (SFT) often causes LLMs to 'forget' foundational knowledge, hindering subsequent

→ View original post on X — @jiqizhixin