Large Language Models
129 views
Reward Model
Quick Definition
Model scoring LLM outputs based on human preferences
Full Definition
A model trained to score LLM outputs based on human preference data for RLHF training pipelines.
Examples
RLHF pipeline, preference ranking, reward shaping
Related Terms
rlhf
reward-modeling
ai-alignment
More Large Language Models Terms
Vector Database
Specialized database for high-dimensional embedding queries
Training LLM
Adjusting parameters on large datasets to learn language
Tokenizer Vocabulary
Complete set of tokens a language model can process
Scaling Laws
Relationships between model size, data, compute, and performance
Structured Output
Generating LLM responses in predefined machine-readable formats
Prompt Caching
Storing key-value states for repeated prompt prefixes