Vinner-tar-alt i handlingsvalg
Definition
Vinner-tar-alt (WTA) er en konkurranseprosess brukt i neurale nettverk og …
Terms tagged with RL
Vinner-tar-alt (WTA) er en konkurranseprosess brukt i neurale nettverk og …
Trefaktorlæring er en spesifikk tilnærming innen forsterkningslæring som deler …
Robotlæring innebærer å trene robotagenter til å utføre oppgaver autonomt ved å utnytte …
Sannsynlighetstilpasning er et atferdsmønster som ofte observeres i forsterkningslæring …
Prediktive tilstandsrepresentasjoner (PSR) utvider tradisjonelle delvis observerbare …
Multi-armed bandit-problemet illustrerer dilemmaet en agent står overfor når den avgjør …
Fjellbilproblemet er en standard benchmark innen forskning på forsterkningslæring. Målet …
Innenfor forsterkningslæring driver indre motivasjon en agent til å utforske miljøet sitt …
I beslutningsprosesser står agenter overfor en avveining: de kan utnytte nåværende …
On-policy-algoritmer krever at agenten lærer direkte fra handlingene tatt av sin …
Lang-horisont problemer involverer sekvenser av handlinger der effekten av tidlige …
En tilstand representerer all relevant informasjon som trengs for å bestemme fremtidig …
Begrepet ‘politikk’ har to betydninger avhengig av kontekst. I generell …
Hierarkiske AI-systemer organiserer informasjon eller kontroll i en tre-lignende struktur …
Innen kunstig intelligens og robotikk refererer en handling til et bestemt steg eller en …