Buckets:

hf-doc-build/doc-dev / audio-course /pr_245 /fr /chapter7 /supplemental_reading.md
HuggingFaceDocBuilder's picture
|
download
raw
2.23 kB

Lectures et ressources complémentaires

Cette unité a rassemblé de nombreux éléments des unités précédentes, en introduisant les tâches de traduction vocale (audio à audio), les assistants vocaux et séparation des locuteurs. Le matériel de lecture supplémentaire est donc divisé en ces trois nouvelles tâches :

Traduction vocale (audio à audio) :

Assistant vocal :

Transcriptions de réunions :

  • pyannote.audio Technical Report par Hervé Bredin : ce rapport décrit les principes fondamentaux du pipeline de séparation des locuteurs pyannote.audio.
  • Whisper X par Max Bain et al. : une approche supérieure pour calculer les horodatages au niveau des mots en utilisant le modèle Whisper.

Xet Storage Details

Size:
2.23 kB
·
Xet hash:
41ff4da4f9c2190c746524877b7ca23454a8922c812bc5609fbbb1fae9fa3695

Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.