Datasets

Dataset

IndicSynth

by mrunmai18

IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…

CC-BY-NC-4.0audio-classification 964 01M < n < 10M rows

published 10 Aug 2026

Preview

First 5 rows of Odia / train, from the Hugging Face dataset viewer.

audioGenerative ModelSource Speaker_IDTarget Speaker IDGenderSource Reference AudioTarget Reference AudioTTS Transcript
[{"src":"https://datasets-server.huggingface.co/assets/mrunmai18/IndicSynth/--/6e0d85a5cd8adba4766770187f205a83742c4a53/--/Odia/train/0/audio/audio.wav?Expires=1788203902&Signature=NEVMA~w3kBgN-ly4fXOeGP9fndH5o0v95HcpXvP-Usc-7~bpqsR0WvyoCmb7gaYrKcmriLq86iBSOOEn~EZ6ybxRI94bjhF22R9AUXq5jDaCck4sVdAAUy…freevc2410451178Female844424930332551-1045-f.wav844424930544036-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/mrunmai18/IndicSynth/--/6e0d85a5cd8adba4766770187f205a83742c4a53/--/Odia/train/1/audio/audio.wav?Expires=1788203902&Signature=mCqDL7LAxWRSqSUtX6mbZnQmZAqY26p5mJEd6yyri8wd53uX5eP3sXj2QhQ6NNdZX6hUJdAn4s8BLn5uuFWtwWgX2viD~5pjcDfU1jLHiJbZzCwdljcuo2…freevc2410451178Female844424930332551-1045-f.wav844424930664138-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/mrunmai18/IndicSynth/--/6e0d85a5cd8adba4766770187f205a83742c4a53/--/Odia/train/2/audio/audio.wav?Expires=1788203902&Signature=ggIjl87BOoWlfXrYYpl3bnatsQApu6DRiFK55w2hcq0dIfDIMz9qZxSFowDVGY-ylBGF4JNo3p7gwb-tXvibneYnjHMnw5XK63TMDhUz5arwl8F2vytAA0…freevc2410451178Female844424930332551-1045-f.wav844424930634063-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/mrunmai18/IndicSynth/--/6e0d85a5cd8adba4766770187f205a83742c4a53/--/Odia/train/3/audio/audio.wav?Expires=1788203902&Signature=ohTMQ8iwCHgQrUz-~fSNkMVYqaclH04JzAfAFRO3CvS1TG1w06Rn8MqP148m-aNA-8YOtDXtD~tcdodW6QIuEkfAVd~GK~QYIRU05xUU6ZepHfyIhT29Ru…freevc2410451178Female844424930332551-1045-f.wav844424930508097-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/mrunmai18/IndicSynth/--/6e0d85a5cd8adba4766770187f205a83742c4a53/--/Odia/train/4/audio/audio.wav?Expires=1788203902&Signature=GN1eFEIxdr0wqTX9XN4knoO9H9GuqmB4Ydq2GhYrJ2wJxjp9Y3GzqJ-xGY4WokduVSAbiLktHUj699PFu-btjg-muMTh1dSJVHC1UJTD8TnRLwOMv1hKW9…freevc2410451178Female844424930332551-1045-f.wav844424930738142-1178-f.wav

Cite this

CC-BY-NC-4.0audiotextCite

Tags

task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:polarslibrary:mlcroissantregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech