Mixtral

term_id: mixtral

Category: basic_concepts

Definition

Mixtral ist ein wegweisendes Open-Weight-LLM, das eine Architektur mit sparsamer Mischung von Experten (Sparse MoE) nutzt. Im Gegensatz zu dichten Modellen, bei denen alle Parameter für jeden Token verwendet werden, leitet Mixtral jeden Token durch

Summary

Ein Großsprachmodell (LLM) mit sparsamer Mischung von Experten (MoE) von Mistral AI, das pro Token nur eine Teilmenge der Parameter aktiviert.

Key Concepts

  • Sparse MoE
  • Experten
  • Routing
  • Effizienz

Use Cases

  • Inferenz mit hohem Durchsatz
  • Aufgaben mit komplexer Logik
  • Kostenbewusste Produktionsbereitstellungen