Datasets

Dataset

flores_101

by jeffbrian

One of the biggest challenges hindering progress in low-resource and multilingual machine translation is the lack of good evaluation benchmarks. Current evaluation benchmarks either lack good coverage of low-resource languages, consider only restricted doma…

CC-BY-SA-4.0text-generation 66 0

published 22 Dec 2025

Preview

Cannot get the config names for the dataset.

Cite this

CC-BY-SA-4.0Cite

Tags

task_categories:text-generationtask_categories:translationannotations_creators:foundlanguage_creators:expert-generatedmultilinguality:multilingualmultilinguality:translationsource_datasets:extended|floreslanguage:aflanguage:amlanguage:arlanguage:hylanguage:aslanguage:astlanguage:azlanguage:belanguage:bnlanguage:bslanguage:bglanguage:mylanguage:calanguage:ceblanguage:zholanguage:hrlanguage:cslanguage:dalanguage:nllanguage:enlanguage:etlanguage:tllanguage:filanguage:frlanguage:fflanguage:gllanguage:lglanguage:kalanguage:delanguage:ellanguage:gulanguage:halanguage:he