Datasets

Dataset

commonvoice22_sidon

by sarulab-speech

CV22-Sidon Overview This dataset hosts a release of Mozilla Common Voice 22 restored with the Sidon speech restoration model. Source: Mozilla Common Voice 22.

CC0-1.0text-to-speech 151 3010M < n < 100M rows

published 5 Oct 2025

Preview

The dataset does not exist, or is not accessible without authentication (private or gated). Please check the spelling of the dataset name or retry with authentication.

Cite this

CC0-1.0audiotextCite

Tags

task_categories:text-to-speechlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:davlanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:fylanguage:galanguage:gllanguage:gnlanguage:halanguage:he