Audio
finetuned-hindi-punjabi-denoised
Multilingual Speaker Diarization Dataset This dataset contains synthetic multilingual speaker diarization data with Hindi, English, and Punjabi audio…
Multilingual Speaker Diarization Dataset This dataset contains synthetic multilingual speaker diarization data with Hindi, English, and Punjabi audio samples. Dataset Structure ├── audio/ WAV audio files (16kHz) – 627 files ├── csv/ Individual CSV annotations – 627 files ├── rttm/ RTTM format files for diarization – 627 files ├── all samples combined.csv Complete dataset annotations └── all samples combined.rttm Complete RTTM… See the full description on the dataset page:
Source: Hugging Face Hub (noty7gian/finetuned-hindi-punjabi-denoised). Metadata imported from the dataset’s Hub tags.