Automatisk talegjenkjenning

term_id: automatic_speech_recognition

Category: application_paradigms

Definition

Automatisk talegjenkjenning (ASR), også kjent som tale-til-tekst, er et underfelt av talebehandling som utnytter kunstig intelligens til å transkribere lydsignaler til skriftlig tekst. Moderne ASR-systemer bruker dype nevrale nettverk for å analysere akustiske trekk og sammenligne dem med språklige modeller for høy nøyaktighet.

Summary

En teknologi som konverterer talt språk til tekst ved hjelp av dype læringsmodeller.

Key Concepts

  • Akustisk modellering
  • Språkmodellering
  • Dyp læring
  • Transkripsjon

Use Cases

  • Stemmeassistenter (Siri, Alexa)
  • Direkte undertekster for videoer
  • Dikterprogramvare for profesjonelle