Datasets
Dataset
2M-Belebele
by facebook
2M-Belebele Highly-Multilingual Speech and American Sign Language Comprehension Dataset We introduce 2M-Belebele as the first highly multilingual speech and American Sign Language (ASL) comprehension dataset. Our dataset, which is an extension of the existi…
CC-BY-SA-4.0question-answering 827 1310K < n < 100K rows
published 16 Dec 2024
Preview
Rows from parquet row groups are too big to be read: 1.22 GiB (max=286.10 MiB)
Cite this
CC-BY-SA-4.0tabulartextaudioCite
Tags
task_categories:question-answeringtask_categories:automatic-speech-recognitionlanguage:bglanguage:palanguage:enlanguage:hulanguage:svlanguage:aflanguage:calanguage:kalanguage:sklanguage:jvlanguage:bnlanguage:trlanguage:srlanguage:rolanguage:tglanguage:falanguage:wolanguage:filanguage:hylanguage:vilanguage:kealanguage:aslanguage:jalanguage:nllanguage:nelanguage:lglanguage:hilanguage:xhlanguage:kklanguage:mnlanguage:yolanguage:kmlanguage:halanguage:rulanguage:swlanguage:pslanguage:kolanguage:cs