自动语音识别

term_id: automatic_speech_recognition

Category: application_paradigms

Definition

自动语音识别(ASR),也称为语音转文字,是语音处理的一个子领域,它利用人工智能将音频信号转录为书面文本。现代ASR系统能够处理各种口音、背景噪音和连续语音,广泛应用于人机交互领域。

Summary

一种利用深度学习模型将口语转换为文本的技术。

Key Concepts

  • 声学建模
  • 语言建模
  • 深度学习
  • 转录

Use Cases

  • 语音助手(如Siri、Alexa)
  • 视频实时字幕生成
  • 专业人士的听写软件