PromptHub
Large Language Models Featured 28 views

RLHF

Quick Definition

Aligning LLMs with human preferences using reinforcement learning

Full Definition

Reinforcement Learning from Human Feedback aligning language models with human preferences.

Examples

ChatGPT alignment, preference learning, safety tuning

Related Terms

reinforcement-learning reward-model alignment

More Large Language Models Terms