Datasets

Dataset

common_voice_17_0

by 0x3

Dataset Card for Common Voice Corpus 17. 0 This dataset is an unofficial version of the Mozilla Common Voice Corpus 17.

CC0-1.0automatic-speech-recognition 353 0100B < n < 1T rows

published 27 May 2026

Preview

Cannot get the config names for the dataset.

Cite this

CC0-1.0Cite

Tags

task_categories:automatic-speech-recognitionlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:gllanguage:gnlanguage:halanguage:helanguage:hilanguage:hsblanguage:hu