Datasets

Dataset

IndicSynth

by vdivyasharma

IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…

CC-BY-NC-4.0audio-classification 2240 121M < n < 10M rows

published 6 Jun 2025

Preview

First 5 rows of Odia / train, from the Hugging Face dataset viewer.

audioGenerative ModelSource Speaker_IDTarget Speaker IDGenderSource Reference AudioTarget Reference AudioTTS Transcript
[{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/0/audio/audio.wav?Expires=1788233504&Signature=ExfSMKGvKZ7rkX~YlH9vzB3fzl7WW0R9J3hhaEv9egoA565xkyXaW3Oq-T~q9umEPE1Hhvd2LSdJh0q0LdVhtfeSOIdtgTkgHZhwqXb29S9HOSPZBnv…freevc2410451178Female844424930332551-1045-f.wav844424930544036-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/1/audio/audio.wav?Expires=1788233504&Signature=J09PSo7WAAXuXlNB7L~UyonCXGRKgJ3x6btqPj7e~AVy2CcGkHr1kSHqJAhskZX2sLgpxNTuWpmu8lYFb~w035LrAslReAr7w-~GHJrGXX9ELKZrBYg…freevc2410451178Female844424930332551-1045-f.wav844424930664138-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/2/audio/audio.wav?Expires=1788233504&Signature=IO3e5ZnZ8keGCdV82wHYUU0iuZTJb0eFphPv7aR6htfHBfVlPiQyfLSo1OS9x76Q3yf-vj8R54qKAVkTHCCly1gPVmVY3krczqDllHMPFG6hVaoyKdq…freevc2410451178Female844424930332551-1045-f.wav844424930634063-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/3/audio/audio.wav?Expires=1788233504&Signature=DFTGqAOKnvxVMfk1LWrLbxOOEYyqqRH7ynzJKH6nZKaEZfoRF6FxsJaLAuQIakV7~54gqzu8rb3oduoqmIFze0ugqcUb2PHbt0v1eNQ1l~vSYTi~WSn…freevc2410451178Female844424930332551-1045-f.wav844424930508097-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/vdivyasharma/IndicSynth/--/c0a10386b723717aff682f757bd67f72983f269f/--/Odia/train/4/audio/audio.wav?Expires=1788233504&Signature=uSuYzQqpfMSVvxl8PKh6~Ll3veRpCvJ1SoKaPccGsAxEZEVbiRThaFoCbtpQTiwz-HM1pXiURwVOZytE3Y-EbFx2aJby1awmVF4Nr1IgoefjKB~MLS9…freevc2410451178Female844424930332551-1045-f.wav844424930738142-1178-f.wav

Cite this

CC-BY-NC-4.0audiotextCite

Tags

task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:mlcroissantlibrary:polarsregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech