Datasets
Dataset
lsd_all_scripts_finetuning_subset
by blue-machines
blue-machines/lsdallscriptsfinetuningsubset Language-switch detection finetuning subset (lsddatawithlanguage. csv).
No licensetext-classification 30 0100K < n < 1M rows
published 27 Jul 2026
Preview
First 5 rows of default / train, from the Hugging Face dataset viewer.
| language_switch | text | script_type | language |
|---|---|---|---|
| Bengali | Bengali তে উত্তর দাও. | mixed | Bengali |
| Bengali | Bengali তে কথা বলা যায়? | mixed | Bengali |
| Bengali | Bengali তে কথা বলুন. | mixed | Bengali |
| Bengali | Bengali তে কথোপকথন করুন. | mixed | Bengali |
| Bengali | Bengali তে বলো না. | mixed | Bengali |
Cite this
No licensetextCite
Tags
task_categories:text-classificationlanguage:enlanguage:hilanguage:bnlanguage:gulanguage:knlanguage:mllanguage:mrlanguage:orlanguage:talanguage:telicense:othersize_categories:100K<n<1Mformat:parquetmodality:textlibrary:datasetslibrary:pandaslibrary:polarslibrary:mlcroissantregion:uslanguage-switch-detectionlanguage-identificationindicfinetuningcode-mixedromanized