Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback, by @StephenLCasper @alxndrdavies @causalclaudia @sociotiose @jeremy_scheurer @javirandor @FreedmanRach @tomekkorbak @davlindner @5kovt @CRSegerie @MicahCarroll
, et al.
Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback
By
–