Large language models (LLMs) are trained on human-generated text, but additional methods are needed to align an LLM with human values and preferences. To align models with human values and individual RLHF is a highly recommended solution
Aligning Large Language Models with Human Values via RLHF
By
–
