Recunoaștere automată a vorbirii

term_id: automatic_speech_recognition

Category: application_paradigms

Definition

Recunoașterea automată a vorbirii (ASR), cunoscută și ca conversia vorbirii în text, este un subdomeniu al procesării semnalului vocal care utilizează inteligența artificială pentru a transcrie semnale audio în text scris. Sistemele moderne ASR se bazează pe rețele neuronale profunde pentru o precizie ridicată.

Summary

O tehnologie care convertește limbajul vorbit în text folosind modele de învățare profundă.

Key Concepts

  • Modelare acustică
  • Modelare lingvistică
  • Învățare profundă
  • Transcriere

Use Cases

  • Asistenți vocali (Siri, Alexa)
  • Subtitrări live pentru videoclipuri
  • Software de dictare pentru profesioniști