Recunoaștere automată a vorbirii
term_id: automatic_speech_recognition
Category: application_paradigms
Definition
Recunoașterea automată a vorbirii (ASR), cunoscută și ca conversia vorbirii în text, este un subdomeniu al procesării semnalului vocal care utilizează inteligența artificială pentru a transcrie semnale audio în text scris. Sistemele moderne ASR se bazează pe rețele neuronale profunde pentru o precizie ridicată.
Summary
O tehnologie care convertește limbajul vorbit în text folosind modele de învățare profundă.
Key Concepts
- Modelare acustică
- Modelare lingvistică
- Învățare profundă
- Transcriere
Use Cases
- Asistenți vocali (Siri, Alexa)
- Subtitrări live pentru videoclipuri
- Software de dictare pentru profesioniști