Riconoscimento automatico del parlato

term_id: automatic_speech_recognition

Category: application_paradigms

Definition

Il Riconoscimento Automatico del Parolato (ASR), noto anche come da voce a testo, è un sottocampo dell’elaborazione del parlato che sfrutta l’intelligenza artificiale per trascrivere segnali audio in testo scritto. I moderni sistemi ASR utilizzano reti neurali profonde per migliorare l’accuratezza e la velocità di trascrizione.

Summary

Una tecnologia che converte il linguaggio parlato in testo utilizzando modelli di deep learning.

Key Concepts

  • Modellazione acustica
  • Modellazione linguistica
  • Deep learning
  • Trascrizione

Use Cases

  • Assistenti vocali (Siri, Alexa)
  • Sottotitolazione in diretta per video
  • Software di dettatura per professionisti