Будь ласка, використовуйте цей ідентифікатор, щоб цитувати або посилатися на цей матеріал:
http://hdl.handle.net/123456789/26000| Назва: | Досвід застосування штучного інтелекту в роботі з середньовічними манускриптами |
| Автори: | Волощук, Максим Зарембовська, Богдана |
| Ключові слова: | палеографія штучний інтелект комп’ютерний зір розпізнавання рукописного тексту машинне навчання |
| Дата публікації: | 6-тра-2025 |
| Видавництво: | Карпатський національний університет імені Василя Стефаника |
| Бібліографічний опис: | М. Волощук, Б. Зарембовська, "Досвід застосування штучного інтелекту в роботі з середньовічними манускриптами," Науковий і культурно-просвітній краєзнавчий часопис Галичина, т. 39, С. 171-179, 06 травня 2025, doi: 10.15330/gal.39.171-179 |
| Короткий огляд (реферат): | У цій роботі наведено принципи та підходи застосування штучного інтелекту (ШІ) у роботі з рукописними історичними документами. З розвитком методів машинного навчання та комп’ютерного зору використання автоматизованих систем для аналізу, структурування та розпізнавання текстів зі сканованих документів набуває все більшого поширення, що підтверджується значною кількістю сучасних наукових досліджень у цій галузі. Використання подібних механізмів стає стандартом для великих архівних проєктів. Однак, попри значну кількість наявних інструментів, більшість з вже готових рішень орієнтовані переважно на обробку документів доби модерну, тоді як проблематика автоматизованої обробки середньовічних манускриптів залишається недостатньо дослідженою через варіативність письма та фізичні пошкодження матеріалів. У статті ми проаналізували сучасні підходи застосування машинного навчання у роботі з розпізнаванням рукописних історичних текстів, зокрема методи детекції та сегментації структурних елементів документів, а також запропонували власне рішення комп’ютерної системи, здатне обробляти латино-мовні документи епохи Каролінгів та Оттонів IX–XI ст. Особлива складність роботи з документами цього періоду зумовлена специфікою каролінзького мінускула: наявність численних лігатур, виносних елементів та специфічних середньовічних скорочень – створює серйозні перешкоди для стандартних алгоритмів OCR. Водночас документи каролінзької доби мають високу джерельну цінність для історичних і палеографічних досліджень, оскільки фіксують ранні форми адміністративної, правової та писемної практики Західної Європи, а також відображають етапи становлення середньовічної документальної традиції. Запропонована у цій роботі нами система є модульною та складається з чотирьох взаємопов’язаних моделей машинного навчання, кожна з яких виконує власну роль в загальному процесі обробки документа. Система забезпечує поетапне виявлення текстових рядків і слів, а також їх розпізнавання із застосуванням поєднання різних моделей для пошуку візуально й синтаксично подібних слів. Такий підхід дозволяє підвищити стійкість розпізнавання в умовах обмеженого навчального набору даних і забезпечує кращу адаптацію до особливостей середньовічного письма. |
| URI (Уніфікований ідентифікатор ресурсу): | https://journals.pnu.edu.ua/index.php/istgal/article/view/10592 http://hdl.handle.net/123456789/26000 |
| ISSN: | 2312-1165 3083-6670 |
| Розташовується у зібраннях: | Наукові роботи студентів, магістрантів, аспірантів (ФМІ) |
Файли цього матеріалу:
| Файл | Опис | Розмір | Формат | |
|---|---|---|---|---|
| Voloshchuk.pdf | 791.38 kB | Adobe PDF | Переглянути/Відкрити |
Усі матеріали в архіві електронних ресурсів захищені авторським правом, всі права збережені.