Large Language Models
143 views
Jailbreaking
Quick Definition
Circumventing AI safety restrictions through prompt techniques
Full Definition
Circumventing AI safety guardrails and content restrictions through clever prompt engineering.
Examples
DAN prompts, roleplay exploits, instruction override
Related Terms
prompt-injection
ai-safety
guardrails-llm
More Large Language Models Terms
Large Language Model
Massive AI model trained on text for language understanding and generation
Alignment Tax
Performance cost of aligning AI with human preferences
RAG
Enhancing LLMs by retrieving relevant external knowledge
System Prompt
Special prompt defining AI assistant behavior and constraints
PEFT
Fine-tuning methods updating only small parameter subsets
Positional Encoding
Incorporating token position information into transformers