Multi-Head Attention
term_id: multi_head_attention
Category: basic_concepts
Definition
Multi-Head Attention erweitert den Standard-Aufmerksamkeitsmechanismus, indem er mehrere Male parallel mit unterschiedlichen gelernten linearen Projektionen ausgeführt wird. Dies ermöglicht es dem Modell, Informationen aus verschiedenen Perspektiven gemeinsam zu berücksichtigen.
Summary
Ein Mechanismus in Transformer-Modellen, der es dem Modell ermöglicht, gleichzeitig Informationen aus verschiedenen Repräsentations-Subräumen zu beachten.
Key Concepts
- Selbst-Aufmerksamkeit
- Lineare Projektionen
- Verkettung
Use Cases
- Natural Language Processing (NLP)
- Maschinelle Übersetzung
- Bildklassifizierung mit Vision Transformern
Code Example
| |