RLHF

Turkish equivalent: İnsan geri bildirimiyle pekiştirmeli öğrenmeDomain: Machine Learning

Reinforcement Learning from Human Feedback, a model-alignment approach that uses human preference signals to optimize model behavior through a reward-driven training stage.

  • DPO
  • Instruction Tuning
  • Preference Model
  • Reward Model