Datasets
Dataset
IndicSynth
by ksmashhero
IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…
CC-BY-NC-4.0audio-classification 0 01M < n < 10M rows
published 9 Sept 2026
Preview
First 5 rows of Odia / train, from the Hugging Face dataset viewer.
| audio | Generative Model | Source Speaker_ID | Target Speaker ID | Gender | Source Reference Audio | Target Reference Audio | TTS Transcript |
|---|---|---|---|---|---|---|---|
| [{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/0/audio/audio.wav?Expires=1789005601&Signature=LOBojIRLnEqZTkrRCX~uNVi4r2cBzdVjRy7GpsNzjzXcoLTdGb-unBQDVakoJX9-X3rO1Th5nKN5I0xVRhU6HYrN47guAFil20dm-uLZKUbkGufL8osj2… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930544036-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/1/audio/audio.wav?Expires=1789005601&Signature=aJfBCVtZHh3kPHKZot-EXp1eblA6z2L446mybNlfBREaFfiH73xzwe2-so0FfDL1o1bKUC~MWVQ9s7xpnUfT1nCcZHBoPcxGqsyONwE22ovHRM5Tov1JM… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930664138-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/2/audio/audio.wav?Expires=1789005601&Signature=QkG8x0v6N5ZhNonSbu~NwYVPWwo0SzxbcWmW-bpmKMMXOG02TqXOAph9MIAhto02-5LEDEY1h7G64Qc2rtmQTtmN445~xdkeGL4cuLaL5dIG1ClQ0VOyz… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930634063-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/3/audio/audio.wav?Expires=1789005601&Signature=nCCDYvc2qX1J8Dsm0r890G-2lOrXhX3jYkzaox7NXNk1fuzJjoNS2bWHLtxwsPWYhGPxkUe1xqbnYnPP82C31vBSX8nYKCfBtYGV43MazC2kPQfqlW~WT… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930508097-1178-f.wav | |
| [{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/4/audio/audio.wav?Expires=1789005601&Signature=aRvRwzsDq5rHCPVTfWuuaXkdnx4YVtPMeRsCdzuoAfOvkGANr4j5EdtBflVsOitoUk5zHJRsfwrXXzbA-TXnlKasQVB6TLgZ3e~GclEsIx6QvMdDBL6UK… | freevc24 | 1045 | 1178 | Female | 844424930332551-1045-f.wav | 844424930738142-1178-f.wav |
Cite this
CC-BY-NC-4.0audiotextCite
Tags
task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:polarslibrary:mlcroissantregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech