Обидві дипломні роботи в університеті — бакалаврську та магістерську — я писала про обсценну лексику ( простими словами — лайку ) у єгипетському діалекті арабської мови .
Пам'ятаю , як виступала із доповіддю на цю тему на конференції у Франції , у залі тоді було багато носіїв мови , а мені фактично потрібно було розповідати їм , як можна лаятися арабською та звідки ці вирази походять ;)
Цікавий досвід , хоч і було трішки незручно .
Минулого року вирішила продовжити дослідження на цю тему , але вже у поєднанні з машинним навчанням .
Як свій pet project вивчала питання автоматичного визначення нецензурної мови у постах українською в Twitter — така функція може бути , наприклад , корисною для ідентифікації та фільтрування публікацій , що містять таку лексику .
Це був мій перший досвід роботи з моделями машинного навчання , тому не все вдалося на 100 % , але я однозначно багато чого навчилась .
