QLoRA
term_id: qlora
Category: training_techniques
Definition
QLoRA combineert Low-Rank Adaptation (LoRA) met 4-bits kwantisatie om de geheugenruimte die nodig is voor het fine-tunen van enorme modellen aanzienlijk te verminderen. Door gewichten op te slaan in 4-bits formaat en tr…
Summary
Quantized Low-Rank Adaptation, een methode voor efficiënte fine-tuning van grote taalmodellen met behulp van 4-bits kwantisatie en laag-rang adapters.
Key Concepts
- Low-Rank Adaptation
- 4-bits kwantisatie
- Geheugenefficiëntie
- Fine-tuning
Use Cases
- Fine-tuning op consumenten-GPU’s
- Omgevingen met beperkte middelen
- Snelle modeliteratie
Code Example
| |