Datasets
Dataset
common_voice_17_0
by Snagy22000
Dataset Card for Common Voice Corpus 17. 0 This dataset is an unofficial version of the Mozilla Common Voice Corpus 17.
CC0-1.0automatic-speech-recognition 875 0100B < n < 1T rows
published 13 Apr 2026
Preview
Cannot get the config names for the dataset.
Cite this
CC0-1.0Cite
Tags
task_categories:automatic-speech-recognitionlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:gllanguage:gnlanguage:halanguage:helanguage:hilanguage:hsblanguage:hu