Duży Model Językowy

term_id: llm

Category: basic_concepts

Definition

Duże Modele Językowe (LLM) to zaawansowane systemy sztucznej inteligencji oparte na architekturze transformera, trenowane na masowych zbiorach danych zawierających tekst i kod. Uczą się one statystycznych wzorców występujących w języku

Summary

Model uczenia głębokiego trenowany na ogromnych korpusach tekstowych w celu zrozumienia i generowania języka przypominającego ludzki.

Key Concepts

  • Architektura Transformera
  • Prognozowanie Tokenów
  • Wstępne Trenowanie
  • Prawo Skali

Use Cases

  • Boty czatowe i Wirtualni Asystenci
  • Generowanie Treści
  • Uzupełnianie Kodu