AI · Medium
What is RLHF? Why do interviewers ask about it?
AILLM Basics
Answer preview
RLHF (Reinforcement Learning from Human Feedback): After pre-training, humans rate model outputs → train a reward model → fine-tune LLM to prefer helpful, safe responses.…