Mixtral

term_id: mixtral

Category: basic_concepts

Definition

Mixtral è un pionieristico LLM open-weight che utilizza un’architettura Sparse Mixture of Experts (MoE). A differenza dei modelli densi in cui tutti i parametri sono utilizzati per ogni token, Mixtral instrada ogni token attraverso

Summary

Un grande modello linguistico (LLM) Sparse Mixture of Experts (MoE) di Mistral AI che attiva solo un sottoinsieme di parametri per ogni token.

Key Concepts

  • MoE sparso
  • Esperti
  • Instradamento
  • Efficienza

Use Cases

  • Inferenza ad alta throughput
  • Compiti di ragionamento complesso
  • Diployment produttivi sensibili ai costi