Datasets

Dataset

Processed_TTS_Multilingual_Data

by PalakEngineerMaster

Processed TTS Multilingual Data Validated and quality-checked multilingual speech datasets for TTS training, covering 12+ Indian languages. Datasets Included Subset Samples Hours Description indicvoicesr 239,684 548.

CC-BY-4.0text-to-speech 38 0100K < n < 1M rows

published 20 Feb 2026

Preview

First 5 rows of default / train, from the Hugging Face dataset viewer.

file_nametextlangspeaker_iddurationsourceemotiondomainsnr_dbsilence_ratioclipping_ratio
audio/as/indictts_as_female_train_assamesefem_04699.wavআমাৰ সংবিধান প্ৰণেতাসকলৰ দূৰদৰ্শীতাকে সূচাইছে .asindictts_as_female4.509indictts_iitmneutral
audio/as/indictts_as_female_train_assamesefem_06153.wavআছে বুলি জৰাটো নিছিঙি তাৰপৰা আহি .asindictts_as_female4.128indictts_iitmneutral
audio/as/indictts_as_female_train_assamesefem_06635.wavতাৰ নাম মাখি বুলি কৈছিল .asindictts_as_female2.447indictts_iitmneutral
audio/as/indictts_as_female_train_assamesefem_01250.wavমই জপনামুখত থিয় হৈ আছো .asindictts_as_female3.674indictts_iitmneutral
audio/as/indictts_as_female_train_assamesefem_02447.wavতেওঁ বিজেপিক শক্তিশালী কৰাৰ স্বাৰ্থত কাম কৰি আহিছে .asindictts_as_female4.451indictts_iitmneutral

Cite this

CC-BY-4.0tabulartextCite

Tags

task_categories:text-to-speechtask_categories:automatic-speech-recognitionlanguage:aslanguage:bnlanguage:enlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:nelanguage:orlanguage:palanguage:talanguage:telicense:cc-by-4.0size_categories:100K<n<1Mformat:csvmodality:tabularmodality:textlibrary:datasetslibrary:pandaslibrary:polarslibrary:mlcroissantregion:usindicmultilingualttsspeech