SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution SWE-RL is a reinforcement learning (RL) approach that enhances LLM reasoning for software engineering by learning from open-source software evolution data. It trains Llama3-SWE-RL-70B on GitHub
SWE-RL: Enhancing LLM Reasoning Through Software Evolution
By
–
