Datasets

Dataset

common_voice_16_0

by fsicoli

Dataset Card for Common Voice Corpus 16. 0 This dataset is an unofficial version of the Mozilla Common Voice Corpus 16.

CC0-1.0automatic-speech-recognition 5164 4100B < n < 1T rows

published 19 Dec 2023

Preview

The dataset viewer doesn't support this dataset because it runs arbitrary Python code. You can convert it to a Parquet data-only dataset by using the convert_to_parquet CLI from the datasets library. See: https://huggingface.co/docs/datasets/main/en/cli#convert-to-parquet

Cite this

CC0-1.0Cite

Tags

task_categories:automatic-speech-recognitionlanguage:ablanguage:aflanguage:amlanguage:arlanguage:aslanguage:astlanguage:azlanguage:balanguage:baslanguage:belanguage:bglanguage:bnlanguage:brlanguage:calanguage:ckblanguage:cnhlanguage:cslanguage:cvlanguage:cylanguage:dalanguage:delanguage:dvlanguage:dyulanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:gllanguage:gnlanguage:halanguage:helanguage:hilanguage:hsblanguage:hu