Datasets

Dataset

2M-Belebele

by facebook

2M-Belebele Highly-Multilingual Speech and American Sign Language Comprehension Dataset We introduce 2M-Belebele as the first highly multilingual speech and American Sign Language (ASL) comprehension dataset. Our dataset, which is an extension of the existi…

CC-BY-SA-4.0question-answering 827 1310K < n < 100K rows

published 16 Dec 2024

Preview

Rows from parquet row groups are too big to be read: 1.22 GiB (max=286.10 MiB)

Cite this

CC-BY-SA-4.0tabulartextaudioCite

Tags

task_categories:question-answeringtask_categories:automatic-speech-recognitionlanguage:bglanguage:palanguage:enlanguage:hulanguage:svlanguage:aflanguage:calanguage:kalanguage:sklanguage:jvlanguage:bnlanguage:trlanguage:srlanguage:rolanguage:tglanguage:falanguage:wolanguage:filanguage:hylanguage:vilanguage:kealanguage:aslanguage:jalanguage:nllanguage:nelanguage:lglanguage:hilanguage:xhlanguage:kklanguage:mnlanguage:yolanguage:kmlanguage:halanguage:rulanguage:swlanguage:pslanguage:kolanguage:cs