Large Language Models
145 views
Multi-Head Attention
Quick Definition
Parallel attention operations concatenated for richer representations
Full Definition
A transformer mechanism running multiple attention operations in parallel and concatenating their outputs.
Examples
transformer layers, contextual learning, multi-perspective analysis
Related Terms
attention-mechanism
self-attention
transformer
More Large Language Models Terms
Temperature
Parameter controlling randomness in text generation
Structured Output
Generating LLM responses in predefined machine-readable formats
Vector Database
Specialized database for high-dimensional embedding queries
Context Window
Maximum tokens a language model can process at once
Prompt Template
Reusable structured format with dynamic input placeholders
Grounded Generation
Generating outputs faithful to provided source documents