Datasets
Dataset
IN22-Conv
by ai4bharat
IN22-Conv IN-22 is a newly created comprehensive benchmark for evaluating machine translation performance in multi-domain, n-way parallel contexts across 22 Indic languages. IN22-Conv is the conversation domain subset of IN22.
CC-BY-4.0translation 336 101K < n < 10K rows
published 9 Sept 2023
Preview
The dataset does not exist, or is not accessible without authentication (private or gated). Please check the spelling of the dataset name or retry with authentication.
Cite this
CC-BY-4.0tabulartextCite
Tags
task_categories:translationlanguage_creators:expert-generatedmultilinguality:multilingualmultilinguality:translationlanguage:aslanguage:bnlanguage:brxlanguage:doilanguage:enlanguage:gomlanguage:gulanguage:hilanguage:knlanguage:kslanguage:mailanguage:mllanguage:mrlanguage:mnilanguage:nelanguage:orlanguage:palanguage:salanguage:satlanguage:sdlanguage:talanguage:telanguage:urlicense:cc-by-4.0size_categories:1K<n<10Kformat:parquetmodality:tabularmodality:textlibrary:datasetslibrary:pandaslibrary:mlcroissantlibrary:polarsarxiv:2305.16307region:us