Automatisk taligenkänning
term_id: automatic_speech_recognition
Category: application_paradigms
Definition
Automatisk taligenkänning (ASR), även känd som tal-till-text, är ett delområde inom talbehandling som utnyttjar artificiell intelligens för att transkribera ljudsignaler till skriven text. Moderna ASR-system erbjuder hög noggrannhet även vid bakgrundsljud.
Summary
En teknologi som omvandlar talat språk till text med hjälp av djupinlärningsmodeller.
Key Concepts
- Akustisk modellering
- Språkmodellering
- Djupinlärning
- Transkribering
Use Cases
- Röstassistenter (Siri, Alexa)
- Direktexttextning för videor
- Dikteringsprogram för yrkesverksamma