Datasets

Dataset

Multilingual-Eu14-allergens

by omerfsahan

Adisyonist Multilingual EU-14 Allergen Dataset A multilingual dataset for predicting the 14 EU food allergens from restaurant menu item text. The dataset contains approximately 294,500 examples consisting of menu item names and, where available, short menu …

MITtext-classification 0 0100K < n < 1M rows

published 17 Sept 2026

Preview

First 5 rows of default / train, from the Hugging Face dataset viewer.

idtextallergens
BASE95::TR-0001Adana Kebap[]
BASE95::TR-0002Urfa Kebap[]
BASE95::TR-0003İskender Kebap["gluten","milk"]
BASE95::TR-1437Alinazik["milk"]
BASE95::TR-0005Hünkar Beğendi["gluten","milk"]

Cite this

MITtextCite

Tags

task_categories:text-classificationlanguage:amlanguage:arlanguage:bnlanguage:calanguage:cslanguage:dalanguage:delanguage:ellanguage:enlanguage:eslanguage:falanguage:filanguage:frlanguage:gulanguage:helanguage:hilanguage:hrlanguage:hulanguage:idlanguage:itlanguage:jalanguage:kalanguage:knlanguage:kolanguage:mllanguage:mrlanguage:mslanguage:nblanguage:nllanguage:orlanguage:palanguage:pllanguage:ptlanguage:rolanguage:rulanguage:sklanguage:sllanguage:srlanguage:sv