Datasets

Dataset

naamapadam

by ai4bharat

\

CC0-1.0token-classification 743 111M < n < 10M rows

published 19 Jan 2023

Preview

First 5 rows of or / train, from the Hugging Face dataset viewer.

tokensner_tags
["ଅଥଚ","ବଡ଼ଚଣାର","କଂଗ୍ରେସ","ପ୍ରାର୍ଥୀ","ଆଜି","ପର୍ଯ୍ୟନ୍ତ","ଘୋଷଣା","କରାଯାଇପାରି","ନାହିଁ","।"][0,0,0,0,0,0,0,0,0,0]
["ମୋଦିଙ୍କୁ","ଆକ୍ଷେପ","କରି","ଗଡକରି","ଏହା","କହିଛନ୍ତି","।"][0,1,0,0,0,0,0]
["ଛାତ୍ରୀ","ମୃତୁ୍ୟକୁ","ନେଇ","ତୀବ୍ର","ଉତ୍ତେଜନା"][0,0,0,0,0]
["ତାଙ୍କର","ଧର୍ମ","ସମ୍ବନ୍ଧରେ","କୌଣସି","ଜ୍ଞାନ","ନାହିଁ","।"][0,0,0,0,0,0,0]
["ମିର୍ଜାପୁର","ବ୍ଲକ","ଶିକ୍ଷା","ଅଧିକାରୀ","ଜଣଙ୍କ","ଏବେ","ସାମ୍ବାଦିକ","ପୱନ","ଜୈଶୱାଲ","ଏବଂ","ଗାଁ","ମୁଖିଆ","ରାଜକୁମାର","ପଲଙ୍କ","ନାଁରେ","ପୁଲିସ୍","ନିକଟରେ","ଅଭିଯୋଗ","କରିଛନ୍ତି","।"][0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0]

Cite this

CC0-1.0textCite

Tags

task_categories:token-classificationtask_ids:named-entity-recognitionannotations_creators:machine-generatedlanguage_creators:machine-generatedmultilinguality:multilingualsource_datasets:originallanguage:aslanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:talanguage:telicense:cc0-1.0size_categories:1M<n<10Mmodality:textlibrary:datasetslibrary:mlcroissantarxiv:2212.10168region:us