Обидві дипломні роботи в університеті — бакалаврську та магістерську —  я писала про обсценну лексику (простими словами —  лайку) у єгипетському діалекті арабської мови.
Пам'ятаю, як виступала із доповіддю на цю тему на конференції у Франції, у залі тоді було багато носіїв мови, а мені фактично потрібно було розповідати їм, як можна лаятися арабською та звідки ці вирази походять ;)
Цікавий досвід, хоч і було трішки незручно.
Минулого року вирішила продовжити дослідження на цю тему, але вже у поєднанні з машинним навчанням.
У якості свого pet project займалася питанням автоматичного визначення нецензурної мови у постах українською в Twitter — така функція може бути, наприклад, корисною для ідентифікації та фільтрування публікацій, що містять таку лексику.
Це був мій перший досвід роботи з моделями машинного навчання, тому не все вдалося на 100%, але я однозначно багато чого навчилась.
