Datasets
Dataset
naamapadam
by ai4bharat
\
CC0-1.0token-classification 743 111M < n < 10M rows
published 19 Jan 2023
Preview
First 5 rows of or / train, from the Hugging Face dataset viewer.
| tokens | ner_tags |
|---|---|
| ["ଅଥଚ","ବଡ଼ଚଣାର","କଂଗ୍ରେସ","ପ୍ରାର୍ଥୀ","ଆଜି","ପର୍ଯ୍ୟନ୍ତ","ଘୋଷଣା","କରାଯାଇପାରି","ନାହିଁ","।"] | [0,0,0,0,0,0,0,0,0,0] |
| ["ମୋଦିଙ୍କୁ","ଆକ୍ଷେପ","କରି","ଗଡକରି","ଏହା","କହିଛନ୍ତି","।"] | [0,1,0,0,0,0,0] |
| ["ଛାତ୍ରୀ","ମୃତୁ୍ୟକୁ","ନେଇ","ତୀବ୍ର","ଉତ୍ତେଜନା"] | [0,0,0,0,0] |
| ["ତାଙ୍କର","ଧର୍ମ","ସମ୍ବନ୍ଧରେ","କୌଣସି","ଜ୍ଞାନ","ନାହିଁ","।"] | [0,0,0,0,0,0,0] |
| ["ମିର୍ଜାପୁର","ବ୍ଲକ","ଶିକ୍ଷା","ଅଧିକାରୀ","ଜଣଙ୍କ","ଏବେ","ସାମ୍ବାଦିକ","ପୱନ","ଜୈଶୱାଲ","ଏବଂ","ଗାଁ","ମୁଖିଆ","ରାଜକୁମାର","ପଲଙ୍କ","ନାଁରେ","ପୁଲିସ୍","ନିକଟରେ","ଅଭିଯୋଗ","କରିଛନ୍ତି","।"] | [0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0,0] |
Cite this
CC0-1.0textCite
Tags
task_categories:token-classificationtask_ids:named-entity-recognitionannotations_creators:machine-generatedlanguage_creators:machine-generatedmultilinguality:multilingualsource_datasets:originallanguage:aslanguage:bnlanguage:gulanguage:hilanguage:knlanguage:mllanguage:mrlanguage:orlanguage:palanguage:talanguage:telicense:cc0-1.0size_categories:1M<n<10Mmodality:textlibrary:datasetslibrary:mlcroissantarxiv:2212.10168region:us