Datasets

Dataset

Chaashini

by kapturecx

Chaashini (चाशनी) Chaashini — Hindi/Urdu for sugar syrup — is a continuously growing corpus of clean, single-speaker, studio-grade Indian-language speech built for training speech models (text-to-speech, speech recognition, speech language models). Every cl…

Apache-2.0text-to-speech 0 010K < n < 100K rows

published 4 Sept 2026

Preview

The dataset does not exist, or is not accessible without authentication (private or gated). Please check the spelling of the dataset name or retry with authentication.

Cite this

Apache-2.0Cite

Tags

task_categories:text-to-speechtask_categories:automatic-speech-recognitiontask_categories:audio-classificationmultilinguality:multilinguallanguage:hilanguage:enlanguage:telanguage:mrlanguage:bnlanguage:mllanguage:palanguage:talanguage:orlanguage:nelanguage:aslanguage:mnilanguage:knlanguage:satlanguage:koklanguage:gulanguage:brxlanguage:luslicense:apache-2.0size_categories:10K<n<100Kregion:usspeechindicindian-languagesttsmultilingualclean-speech