Datasets
Dataset
IndicSynth
by vdivyasharma
IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…
CC-BY-NC-4.0audio-classification 2240 121M < n < 10M rows
published 6 Jun 2025
Preview
First 5 rows of Odia / train, from the Hugging Face dataset viewer.
| audio | Generative Model | Source Speaker_ID | Target Speaker ID | Gender | Source Reference Audio | Target Reference Audio | TTS Transcript |
|---|---|---|---|---|---|---|---|
| [{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/0/audio/audio.wav?Expires=1788233504&Signature=ExfSMKGvKZ7rkX~YlH9vzB3fzl7WW0R9J3hhaEv9egoA565xkyXaW3Oq-T~q9umEPE1Hhvd2LSdJh0q0LdVhtfeSOIdtgTkgHZhwqXb29S9HOSPZBnv… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930544036-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/1/audio/audio.wav?Expires=1788233504&Signature=J09PSo7WAAXuXlNB7L~UyonCXGRKgJ3x6btqPj7e~AVy2CcGkHr1kSHqJAhskZX2sLgpxNTuWpmu8lYFb~w035LrAslReAr7w-~GHJrGXX9ELKZrBYg… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930664138-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/2/audio/audio.wav?Expires=1788233504&Signature=IO3e5ZnZ8keGCdV82wHYUU0iuZTJb0eFphPv7aR6htfHBfVlPiQyfLSo1OS9x76Q3yf-vj8R54qKAVkTHCCly1gPVmVY3krczqDllHMPFG6hVaoyKdq… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930634063-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/3/audio/audio.wav?Expires=1788233504&Signature=DFTGqAOKnvxVMfk1LWrLbxOOEYyqqRH7ynzJKH6nZKaEZfoRF6FxsJaLAuQIakV7~54gqzu8rb3oduoqmIFze0ugqcUb2PHbt0v1eNQ1l~vSYTi~WSn… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930508097-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/4/audio/audio.wav?Expires=1788233504&Signature=uSuYzQqpfMSVvxl8PKh6~Ll3veRpCvJ1SoKaPccGsAxEZEVbiRThaFoCbtpQTiwz-HM1pXiURwVOZytE3Y-EbFx2aJby1awmVF4Nr1IgoefjKB~MLS9… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930738142-1178-f.wav |
Cite this
CC-BY-NC-4.0audiotextCite
Tags
task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:mlcroissantlibrary:polarsregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech