Multi-Head Attention
term_id: multi_head_attention
Category: basic_concepts
Definition
Multi-Head Attention utvider den vanlige oppmerksomhetsmekanismen ved å kjøre den flere ganger parallelt med ulike lærte lineære projeksjoner. Dette gjør det mulig for modellen å samtidig fokusere på informasjon fra forskjellige posisjoner i inputsekvensen.
Summary
En mekanisme i transformer-modeller som lar modellen fokusere på informasjon fra ulike representasjonsundersrom samtidig.
Key Concepts
- Selvoppmerksomhet
- Lineære projeksjoner
- Konkatenering
Use Cases
- Naturlig språkbehandling (NLP)
- Maskinomsetning
- Bildklassifisering med Vision Transformers
Code Example
| |