Datasets

Dataset

IN22-Conv

by ai4bharat

IN22-Conv IN-22 is a newly created comprehensive benchmark for evaluating machine translation performance in multi-domain, n-way parallel contexts across 22 Indic languages. IN22-Conv is the conversation domain subset of IN22.

CC-BY-4.0translation 336 101K < n < 10K rows

published 9 Sept 2023

Preview

The dataset does not exist, or is not accessible without authentication (private or gated). Please check the spelling of the dataset name or retry with authentication.

Cite this

CC-BY-4.0tabulartextCite

Tags

task_categories:translationlanguage_creators:expert-generatedmultilinguality:multilingualmultilinguality:translationlanguage:aslanguage:bnlanguage:brxlanguage:doilanguage:enlanguage:gomlanguage:gulanguage:hilanguage:knlanguage:kslanguage:mailanguage:mllanguage:mrlanguage:mnilanguage:nelanguage:orlanguage:palanguage:salanguage:satlanguage:sdlanguage:talanguage:telanguage:urlicense:cc-by-4.0size_categories:1K<n<10Kformat:parquetmodality:tabularmodality:textlibrary:datasetslibrary:pandaslibrary:mlcroissantlibrary:polarsarxiv:2305.16307region:us