Datasets

Dataset

IndicSynth

by Pranav123123

IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…

CC-BY-NC-4.0audio-classification 0 01M < n < 10M rows

published 2 Oct 2026

Preview

First 5 rows of Odia / train, from the Hugging Face dataset viewer.

audioGenerative ModelSource Speaker_IDTarget Speaker IDGenderSource Reference AudioTarget Reference AudioTTS Transcript
[{"src":"https://datasets-server.huggingface.co/assets/Pranav123123/IndicSynth/--/27e0f7a2b5db64255c63add1c4bce4583bf70a3f/--/Odia/train/0/audio/audio.wav?Expires=1790958561&Signature=apWdka~abw3wDH7KvfdnM-c-KnrBTBtJcpIJAfzzDGq~GZ53gzzJ-FQGlCMC-iKMVFHseaCUpraiaFSKhG4DJpN0cxnm70wS3LWUBeZBIdhAgnqrvSy…freevc2410451178Female844424930332551-1045-f.wav844424930544036-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/Pranav123123/IndicSynth/--/27e0f7a2b5db64255c63add1c4bce4583bf70a3f/--/Odia/train/1/audio/audio.wav?Expires=1790958562&Signature=N6ItO4Wm2~KdETizF9EoXs2LVTfisIakz~4qitUlAFm2HVy9~qx9kjBDqJdo9ivJFlOHWvlbZjNpn-D1jG3px0wK4r9fMCN-clIyJA8mSkmNbaMC1ic…freevc2410451178Female844424930332551-1045-f.wav844424930664138-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/Pranav123123/IndicSynth/--/27e0f7a2b5db64255c63add1c4bce4583bf70a3f/--/Odia/train/2/audio/audio.wav?Expires=1790958562&Signature=Gc7qyVUTcmILKb8BlVVyDwzRNh-LxcoKKF2-Gk~REBOVlkbEdklL4oXQZ9wXHDHWBk5MOdyJQQPDHu8wM2afL5vab9ma2Du9LtnA6U9UdhikKXsXwVD…freevc2410451178Female844424930332551-1045-f.wav844424930634063-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/Pranav123123/IndicSynth/--/27e0f7a2b5db64255c63add1c4bce4583bf70a3f/--/Odia/train/3/audio/audio.wav?Expires=1790958562&Signature=BRNieWXpysfoEsGXMI8vqUBE1hiRInjaGQMIXK0e08hXjPOMp0kiayq57EnIbpyUnGsDJ24aDd693Qg7Y9mcnLeVA9Ict3hEb4ICg-p8i2yvps1FWDW…freevc2410451178Female844424930332551-1045-f.wav844424930508097-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/Pranav123123/IndicSynth/--/27e0f7a2b5db64255c63add1c4bce4583bf70a3f/--/Odia/train/4/audio/audio.wav?Expires=1790958562&Signature=FBFZzCB7lWwQXHYHZGydiG0bbYx-G-nmzPoVg64Jxhpja03NcNJi0GlzSQiCIg4gK6OC4UqA1h3UBFyBq6ZahwGevkV5MvO52S0u3opoReOC4mANuC5…freevc2410451178Female844424930332551-1045-f.wav844424930738142-1178-f.wav

Cite this

CC-BY-NC-4.0audiotextCite

Tags

task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:polarslibrary:mlcroissantregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech