Будь ласка, використовуйте цей ідентифікатор, щоб цитувати або посилатися на цей матеріал: http://hdl.handle.net/123456789/26000
Назва: Досвід застосування штучного інтелекту в роботі з середньовічними манускриптами
Автори: Волощук, Максим
Зарембовська, Богдана
Ключові слова: палеографія
штучний інтелект
комп’ютерний зір
розпізнавання рукописного тексту
машинне навчання
Дата публікації: 6-тра-2025
Видавництво: Карпатський національний університет імені Василя Стефаника
Бібліографічний опис: М. Волощук, Б. Зарембовська, "Досвід застосування штучного інтелекту в роботі з середньовічними манускриптами," Науковий і культурно-просвітній краєзнавчий часопис Галичина, т. 39, С. 171-179, 06 травня 2025, doi: 10.15330/gal.39.171-179
Короткий огляд (реферат): У цій роботі наведено принципи та підходи застосування штучного інтелекту (ШІ) у роботі з рукописними історичними документами. З розвитком методів машинного навчання та комп’ютерного зору використання автоматизованих систем для аналізу, структурування та розпізнавання текстів зі сканованих документів набуває все більшого поширення, що підтверджується значною кількістю сучасних наукових досліджень у цій галузі. Використання подібних механізмів стає стандартом для великих архівних проєктів. Однак, попри значну кількість наявних інструментів, більшість з вже готових рішень орієнтовані переважно на обробку документів доби модерну, тоді як проблематика автоматизованої обробки середньовічних манускриптів залишається недостатньо дослідженою через варіативність письма та фізичні пошкодження матеріалів. У статті ми проаналізували сучасні підходи застосування машинного навчання у роботі з розпізнаванням рукописних історичних текстів, зокрема методи детекції та сегментації структурних елементів документів, а також запропонували власне рішення комп’ютерної системи, здатне обробляти латино-мовні документи епохи Каролінгів та Оттонів IX–XI ст. Особлива складність роботи з документами цього періоду зумовлена специфікою каролінзького мінускула: наявність численних лігатур, виносних елементів та специфічних середньовічних скорочень – створює серйозні перешкоди для стандартних алгоритмів OCR. Водночас документи каролінзької доби мають високу джерельну цінність для історичних і палеографічних досліджень, оскільки фіксують ранні форми адміністративної, правової та писемної практики Західної Європи, а також відображають етапи становлення середньовічної документальної традиції. Запропонована у цій роботі нами система є модульною та складається з чотирьох взаємопов’язаних моделей машинного навчання, кожна з яких виконує власну роль в загальному процесі обробки документа. Система забезпечує поетапне виявлення текстових рядків і слів, а також їх розпізнавання із застосуванням поєднання різних моделей для пошуку візуально й синтаксично подібних слів. Такий підхід дозволяє підвищити стійкість розпізнавання в умовах обмеженого навчального набору даних і забезпечує кращу адаптацію до особливостей середньовічного письма.
URI (Уніфікований ідентифікатор ресурсу): https://journals.pnu.edu.ua/index.php/istgal/article/view/10592
http://hdl.handle.net/123456789/26000
ISSN: 2312-1165
3083-6670
Розташовується у зібраннях:Наукові роботи студентів, магістрантів, аспірантів (ФМІ)

Файли цього матеріалу:
Файл Опис РозмірФормат 
Voloshchuk.pdf791.38 kBAdobe PDFПереглянути/Відкрити


Усі матеріали в архіві електронних ресурсів захищені авторським правом, всі права збережені.