Datasets

Dataset

IndicSynth

by ksmashhero

IndicSynth: Indian Multilingual Audio Deepfake Detection & Anti-Spoofing Dataset A Large-Scale Multilingual Synthetic Speech Dataset for Low-Resource Indian Languages to facilitate audio deepfake detection and anti-spoofing research 🏆 Outstanding Paper Awa…

CC-BY-NC-4.0audio-classification 0 01M < n < 10M rows

published 9 Sept 2026

Preview

First 5 rows of Odia / train, from the Hugging Face dataset viewer.

audioGenerative ModelSource Speaker_IDTarget Speaker IDGenderSource Reference AudioTarget Reference AudioTTS Transcript
[{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/0/audio/audio.wav?Expires=1789005601&Signature=LOBojIRLnEqZTkrRCX~uNVi4r2cBzdVjRy7GpsNzjzXcoLTdGb-unBQDVakoJX9-X3rO1Th5nKN5I0xVRhU6HYrN47guAFil20dm-uLZKUbkGufL8osj2…freevc2410451178Female844424930332551-1045-f.wav844424930544036-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/1/audio/audio.wav?Expires=1789005601&Signature=aJfBCVtZHh3kPHKZot-EXp1eblA6z2L446mybNlfBREaFfiH73xzwe2-so0FfDL1o1bKUC~MWVQ9s7xpnUfT1nCcZHBoPcxGqsyONwE22ovHRM5Tov1JM…freevc2410451178Female844424930332551-1045-f.wav844424930664138-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/2/audio/audio.wav?Expires=1789005601&Signature=QkG8x0v6N5ZhNonSbu~NwYVPWwo0SzxbcWmW-bpmKMMXOG02TqXOAph9MIAhto02-5LEDEY1h7G64Qc2rtmQTtmN445~xdkeGL4cuLaL5dIG1ClQ0VOyz…freevc2410451178Female844424930332551-1045-f.wav844424930634063-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/3/audio/audio.wav?Expires=1789005601&Signature=nCCDYvc2qX1J8Dsm0r890G-2lOrXhX3jYkzaox7NXNk1fuzJjoNS2bWHLtxwsPWYhGPxkUe1xqbnYnPP82C31vBSX8nYKCfBtYGV43MazC2kPQfqlW~WT…freevc2410451178Female844424930332551-1045-f.wav844424930508097-1178-f.wav
[{"src":"https://datasets-server.huggingface.co/assets/ksmashhero/IndicSynth/--/63ae4765c4ecdb330e9caabc41995d89118b3f4c/--/Odia/train/4/audio/audio.wav?Expires=1789005601&Signature=aRvRwzsDq5rHCPVTfWuuaXkdnx4YVtPMeRsCdzuoAfOvkGANr4j5EdtBflVsOitoUk5zHJRsfwrXXzbA-TXnlKasQVB6TLgZ3e~GclEsIx6QvMdDBL6UK…freevc2410451178Female844424930332551-1045-f.wav844424930738142-1178-f.wav

Cite this

CC-BY-NC-4.0audiotextCite

Tags

task_categories:audio-classificationtask_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:salanguage:talanguage:telanguage:urlicense:cc-by-nc-4.0size_categories:1M<n<10Mformat:parquetmodality:audiomodality:textlibrary:datasetslibrary:dasklibrary:polarslibrary:mlcroissantregion:usindian speechindian languagessynthetic speechdeepfakeaudio deepfake detectionindian deepfake detectionanti-spoofingtext-to-speechttsvoice cloningvoice conversionvcaddfakespeech