Смиш, ОлегТретяк, Єлизавета2026-08-032026-08-032026https://ekmair.ukma.edu.ua/handle/123456789/40697Розвиток кіноіндустрії формує значущі масиви даних, що надають нові можливості для комплексного аналізу медіаконтенту. Проте наразі спостерігається дефіцит інструментів, котрі здатні забезпечити повний цикл опрацювання: від автоматизованого видобування тексту діалогів до формування підсумкових аналітичних показників. Метою кваліфікаційної роботи є впровадження комплексного конвеєра для цифрової трансформації медіадосліджень через автоматизацію вичленення реплік мовців, ідентифікацію їхньої статі та лінгвістичний аналіз діалогів українських фільмів. У роботі застосовано підхід, що поєднує акустичний аналіз (діаризація мовців та розпізнавання мовлення) з методами обробки природної мови (правилозалежні та ML-підходи для аналізу тексту). Спроєктовано систему з графічним інтерфейсом користувача для отримання та візуалізації статистичних даних кіноконтенту. Створена система дає змогу об'єктивно оцінювати структуру мовленнєвої активності та особливості гендерної репрезентації в українськомовних фільмах. Отримано такі результати в процесі проведених досліджень: ● запропоновано метод автоматизованого видобування реплік персонажів в українськомовному кіноконтенті та мультимодальний підхід визначення статі мовців; ● розроблено комплексний конвеєр для опрацювання медіаданих, який поєднує процеси діаризації, автоматичного розпізнавання мовлення та лінгвістичного аналізу в єдину систему для отримання статистичних показників кінотвору; ● проведено аналіз сформованого корпусу зі 135 українських фільмів. Запропоноване рішення характеризується можливістю адаптації до аналізу іншомовного кіноконтенту.ukобробка природної мовидіаризація мовцівавтоматичне розпізнавання мовленнямультимодальний аналізцифрова трансформація ідентифікація статі мовцівукраїнські кінофільмиавтоматизована системаінформаційні технологіїконвеєр опрацювання даниханаліз данихбакалаврська роботаNLP: аналіз діалогів українських кінофільмів,Other