Datasets
Dataset
opus-100
by Helsinki-NLP
Dataset Card for OPUS-100 Dataset Summary OPUS-100 is an English-centric multilingual corpus covering 100 languages. OPUS-100 is English-centric, meaning that all training pairs include English on either the source or target side.
No licensetranslation 17888 24310M < n < 100M rows
published 2 Mar 2022
Preview
First 5 rows of en-or / train, from the Hugging Face dataset viewer.
| translation |
|---|
| {"en":"Cannot create folder \"{0}\".","or":"ଫୋଲଡର \"{0}\"କୁ ସୃଷ୍ଟି କରିପାରିବେ ନାହିଁ।"} |
| {"en":"Hold %1, then push %2","or":"% 1 କୁ ଧରନ୍ତୁ, ତାପରେ% 2 କୁ ଠେଲନ୍ତୁ@ action"} |
| {"en":"_Update","or":"ଅଦ୍ଯତନ (_U)"} |
| {"en":"Unknown error","or":"ଅଜଣା ତ୍ରୁଟି"} |
| {"en":"Theme Author","or":"ପ୍ରସଙ୍ଗ ଲେଖକ"} |
Cite this
No licensetextCite
Tags
task_categories:translationannotations_creators:no-annotationlanguage_creators:foundmultilinguality:translationsource_datasets:extendedlanguage:aflanguage:amlanguage:anlanguage:arlanguage:aslanguage:azlanguage:belanguage:bglanguage:bnlanguage:brlanguage:bslanguage:calanguage:cslanguage:cylanguage:dalanguage:delanguage:dzlanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:fylanguage:galanguage:gdlanguage:gllanguage:gulanguage:halanguage:helanguage:hilanguage:hr