Mixtral
term_id: mixtral
Category: basic_concepts
Definition
Mixtral ist ein wegweisendes Open-Weight-LLM, das eine Architektur mit sparsamer Mischung von Experten (Sparse MoE) nutzt. Im Gegensatz zu dichten Modellen, bei denen alle Parameter für jeden Token verwendet werden, leitet Mixtral jeden Token durch
Summary
Ein Großsprachmodell (LLM) mit sparsamer Mischung von Experten (MoE) von Mistral AI, das pro Token nur eine Teilmenge der Parameter aktiviert.
Key Concepts
- Sparse MoE
- Experten
- Routing
- Effizienz
Use Cases
- Inferenz mit hohem Durchsatz
- Aufgaben mit komplexer Logik
- Kostenbewusste Produktionsbereitstellungen