Whisper

term_id: whisper

Category: basic_concepts

Definition

Whisper est un modèle de reconnaissance vocale polyvalent conçu pour gérer diverses langues, dialectes et accents. Il est entraîné sur des centaines de milliers d’heures de données audio multilingues et multitâches supervisées, ce qui lui confère une grande robustesse face au bruit et aux variations linguistiques.

Summary

Un système de reconnaissance automatique de la parole (ASR) développé par OpenAI, entraîné sur un vaste ensemble de données audio diversifié.

Key Concepts

  • Reconnaissance automatique de la parole
  • Support multilingue
  • Robustesse au bruit
  • Architecture Transformer

Use Cases

  • Génération de sous-titres et légendes vidéo
  • Transcription de réunions ou de conférences
  • Traitement des commandes vocales

Code Example

1
2
3
4
import whisper
model = whisper.load_model("base")
result = model.transcribe("audio.mp3")
print(result["text"])