Automatisk taligenkänning

term_id: automatic_speech_recognition

Category: application_paradigms

Definition

Automatisk taligenkänning (ASR), även känd som tal-till-text, är ett delområde inom talbehandling som utnyttjar artificiell intelligens för att transkribera ljudsignaler till skriven text. Moderna ASR-system erbjuder hög noggrannhet även vid bakgrundsljud.

Summary

En teknologi som omvandlar talat språk till text med hjälp av djupinlärningsmodeller.

Key Concepts

  • Akustisk modellering
  • Språkmodellering
  • Djupinlärning
  • Transkribering

Use Cases

  • Röstassistenter (Siri, Alexa)
  • Direktexttextning för videor
  • Dikteringsprogram för yrkesverksamma