Voice Activity Detection
NeMo
Safetensors
GGUF
Transformers
nemotron3_diarization
audio-frame-classification
speaker-diarization
streaming-sortformer
speaker-tagging
Instructions to use ldov/Nemotron-3-Diarization with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- NeMo
How to use ldov/Nemotron-3-Diarization with NeMo:
# tag did not correspond to a valid NeMo domain.
- Transformers
How to use ldov/Nemotron-3-Diarization with Transformers:
# pip install -U transformers accelerate # Load model directly from transformers import AutoProcessor, AutoModelForAudioFrameClassification processor = AutoProcessor.from_pretrained("ldov/Nemotron-3-Diarization") model = AutoModelForAudioFrameClassification.from_pretrained("ldov/Nemotron-3-Diarization", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Download nemotron3_tts_8_open_voices.mp4 from ldov/Nemotron-3-Diarization: direct link, hf CLI and curl.
- Browser
- Download file 2.45 MB
-
https://huggingface.co/ldov/Nemotron-3-Diarization/resolve/main/nemotron3_tts_8_open_voices.mp4
- Command line
-
hf download hf://ldov/Nemotron-3-Diarization/nemotron3_tts_8_open_voices.mp4
-
curl -L -o nemotron3_tts_8_open_voices.mp4 https://huggingface.co/ldov/Nemotron-3-Diarization/resolve/main/nemotron3_tts_8_open_voices.mp4
2.45 MB
- Xet hash:
- d0db3e34f3aac12c2c6cac5bb2345442d3bba365c88af241a50f089a86f79056
- Size of remote file:
- 2.45 MB
- SHA256:
- 292668a8679eb27f039f7afb0ed938165b399762d2cd3ecef017b600e82457e7
·
Xet efficiently stores Large Files inside Git, intelligently splitting files into unique chunks and accelerating uploads and downloads. More info.