Multi-Head Attention
term_id: multi_head_attention
Category: basic_concepts
Definition
Multi-Head Attention breidt het standaard attention-mechanisme uit door deze meerdere keren parallel uit te voeren met verschillende geleerde lineaire projecties. Dit stelt het model in staat gezamenlijk informatie te benaderen uit verschillende representatieruimtes.
Summary
Een mechanisme in transformermodellen dat het model in staat stelt gelijktijdig informatie uit verschillende representatiesubruimten te benaderen.
Key Concepts
- Self-Attention (Zelfattention)
- Lineaire Projecties
- Concatenatie
Use Cases
- Natural Language Processing (NLP)
- Machinevertaling
- Afbeeldingsclassificatie met Vision Transformers
Code Example
| |