Datasets

Dataset

opus-100

by ds123DDD

Dataset Card for OPUS-100 Dataset Summary OPUS-100 is an English-centric multilingual corpus covering 100 languages. OPUS-100 is English-centric, meaning that all training pairs include English on either the source or target side.

No licensetranslation 418 010M < n < 100M rows

published 28 Jun 2026

Preview

First 5 rows of en-or / train, from the Hugging Face dataset viewer.

translation
{"en":"Cannot create folder \"{0}\".","or":"ଫୋଲଡର \"{0}\"କୁ ସୃଷ୍ଟି କରିପାରିବେ ନାହିଁ।"}
{"en":"Hold %1, then push %2","or":"% 1 କୁ ଧରନ୍ତୁ, ତାପରେ% 2 କୁ ଠେଲନ୍ତୁ@ action"}
{"en":"_Update","or":"ଅଦ୍ଯତନ (_U)"}
{"en":"Unknown error","or":"ଅଜଣା ତ୍ରୁଟି"}
{"en":"Theme Author","or":"ପ୍ରସଙ୍ଗ ଲେଖକ"}

Cite this

No licensetextCite

Tags

task_categories:translationannotations_creators:no-annotationlanguage_creators:foundmultilinguality:translationsource_datasets:extendedlanguage:aflanguage:amlanguage:anlanguage:arlanguage:aslanguage:azlanguage:belanguage:bglanguage:bnlanguage:brlanguage:bslanguage:calanguage:cslanguage:cylanguage:dalanguage:delanguage:dzlanguage:ellanguage:enlanguage:eolanguage:eslanguage:etlanguage:eulanguage:falanguage:filanguage:frlanguage:fylanguage:galanguage:gdlanguage:gllanguage:gulanguage:halanguage:helanguage:hilanguage:hr