Multi-Head Attention
term_id: multi_head_attention
Category: basic_concepts
Definition
Multi-Head Attention memperluas mekanisme perhatian standar dengan menjalankannya beberapa kali secara paralel menggunakan proyeksi linear yang berbeda. Hal ini memungkinkan model untuk secara bersama-sama memperhatikan informasi dari berbagai perspektif.
Summary
Mekanisme dalam model transformer yang memungkinkan model memperhatikan informasi dari berbagai subruang representasi secara bersamaan.
Key Concepts
- Self-Attention (Perhatian Diri)
- Proyeksi Linear
- Penggabungan (Concatenation)
Use Cases
- Pemrosesan Bahasa Alamiah (NLP)
- Terjemahan Mesin
- Klasifikasi Gambar dengan Vision Transformers
Code Example
| |