Automatisk talegjenkjenning
term_id: automatic_speech_recognition
Category: application_paradigms
Definition
Automatisk talegjenkjenning (ASR), også kjent som tale-til-tekst, er et underfelt av talebehandling som utnytter kunstig intelligens til å transkribere lydsignaler til skriftlig tekst. Moderne ASR-systemer bruker dype nevrale nettverk for å analysere akustiske trekk og sammenligne dem med språklige modeller for høy nøyaktighet.
Summary
En teknologi som konverterer talt språk til tekst ved hjelp av dype læringsmodeller.
Key Concepts
- Akustisk modellering
- Språkmodellering
- Dyp læring
- Transkripsjon
Use Cases
- Stemmeassistenter (Siri, Alexa)
- Direkte undertekster for videoer
- Dikterprogramvare for profesjonelle