Mixtral
term_id: mixtral
Category: basic_concepts
Definition
Mixtral è un pionieristico LLM open-weight che utilizza un’architettura Sparse Mixture of Experts (MoE). A differenza dei modelli densi in cui tutti i parametri sono utilizzati per ogni token, Mixtral instrada ogni token attraverso
Summary
Un grande modello linguistico (LLM) Sparse Mixture of Experts (MoE) di Mistral AI che attiva solo un sottoinsieme di parametri per ogni token.
Key Concepts
- MoE sparso
- Esperti
- Instradamento
- Efficienza
Use Cases
- Inferenza ad alta throughput
- Compiti di ragionamento complesso
- Diployment produttivi sensibili ai costi