Datasets

Dataset

common_voice_22_0

by fsicoli

Dataset Card for Common Voice Corpus 22. 0 This dataset is an unofficial version of the Mozilla Common Voice Corpus 22.

CC0-1.0automatic-speech-recognition 24435 19100B < n < 1T rows

published 27 Jun 2025

Preview

Cannot get the config names for the dataset.

Cite this

CC0-1.0Cite

Tags

task_categories:automatic-speech-recognitionlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:gllanguage:gnlanguage:halanguage:helanguage:hilanguage:hsblanguage:hu