Riconoscimento automatico del parlato
term_id: automatic_speech_recognition
Category: application_paradigms
Definition
Il Riconoscimento Automatico del Parolato (ASR), noto anche come da voce a testo, è un sottocampo dell’elaborazione del parlato che sfrutta l’intelligenza artificiale per trascrivere segnali audio in testo scritto. I moderni sistemi ASR utilizzano reti neurali profonde per migliorare l’accuratezza e la velocità di trascrizione.
Summary
Una tecnologia che converte il linguaggio parlato in testo utilizzando modelli di deep learning.
Key Concepts
- Modellazione acustica
- Modellazione linguistica
- Deep learning
- Trascrizione
Use Cases
- Assistenti vocali (Siri, Alexa)
- Sottotitolazione in diretta per video
- Software di dettatura per professionisti