Token maxxing
term_id: token_maxxing
Category: basic_concepts
Definition
Token maxxing zahrnuje pečlivé tvoření vstupních dat tak, aby využívaly plnou kapacitu kontextového okna modelu nebo aby optimalizovaly sémantickou hustotu tokenů pro lepší výkon. Praktici mohou doplňovat prompty (padding) nebo naopak omezovat zbytečné informace, aby dosáhli optimálního poměru mezi délkou vstupu a kvalitou generované odpovědi. Cílem je často snížit náklady na volání API nebo zlepšit přesnost modelu tím, že se mu poskytne co nejhustší a nejrelevantnější kontext.
Summary
Optimalizační strategie v prompt engineeringu zaměřená na maximalizaci užitečnosti nebo kvality výstupu při specifickém počtu tokenů u velkých jazykových modelů.
Key Concepts
- Prompt engineering
- Kontextové okno
- Sémantická hustota
- Optimalizace
Use Cases
- Maximalizace schopností logického uvažování LLM
- Snížení nákladů na používání API
- Testování hranic modelu
Related Terms
- Délka kontextu (Context Length - maximální počet tokenů, které model dokáže zpracovat)
- Injection promptu (Prompt Injection - útok, který se snaží přepsat instrukce modelu)
- Tokenizace (Tokenization - proces rozdělování textu na menší jednotky)
- Ladění efektivity (Efficiency Tuning - úprava parametrů pro lepší výkon za nižší cenu)