Duży Model Językowy
term_id: llm
Category: basic_concepts
Definition
Duże Modele Językowe (LLM) to zaawansowane systemy sztucznej inteligencji oparte na architekturze transformera, trenowane na masowych zbiorach danych zawierających tekst i kod. Uczą się one statystycznych wzorców występujących w języku
Summary
Model uczenia głębokiego trenowany na ogromnych korpusach tekstowych w celu zrozumienia i generowania języka przypominającego ludzki.
Key Concepts
- Architektura Transformera
- Prognozowanie Tokenów
- Wstępne Trenowanie
- Prawo Skali
Use Cases
- Boty czatowe i Wirtualni Asystenci
- Generowanie Treści
- Uzupełnianie Kodu