Модели и платформы ИИ
Машиностроительное обучение используется для раскрытия секретов свитков Помпеи

Команда ученых из Университета Кентукки, которая смогла, как пишет The Guardian, найденная в святом ковчеге синагоги в Эн-Геди в Израиле, и которая содержала текст из библейской книги Левита, теперь участвует в еще более сложной и трудной задаче – чтении карбонизированных свитков, оставшихся после извержения вулкана Везувий в 79 году н.э. в итальянском городе Помпеи.
Хотя команда под руководством профессора Брента Силса смогла прочитать пергамент, найденный в синагоге в Эн-Геди, Израиль, с помощью «просто» высокоэнергетических рентгеновских лучей, на этот раз, из-за того, как были сделаны и написаны свитки Помпеи, им придется использовать машинное обучение, чтобы попытаться раскрыть тайны, скрытые в этих свитках.
Они будут тестировать свои цены на двух неоткрытых свитках, принадлежащих Институту Франции в Париже и являющихся частью коллекции из примерно 1 800 свитков, которая была впервые обнаружена в 1752 году во время раскопок Геркуланума. Как отмечает The Guardian, они составляют единственную известную целую библиотеку из древности, а большинство коллекции сейчас сохраняется в музее Неаполя.
Профессор Силс объяснил проблему, с которой сталкивается его команда – «хотя на каждой фрагменте папируса видно, что есть написанный текст, чтобы открыть его, потребуется, чтобы папирус был действительно гибким и податливым – и он уже не такой». Проблема также заключается в том, что «хотя свиток из Эн-Геди содержал металлическую чернила, которая видна на рентгеновских данных, чернила, использованные на свитках Геркуланума, как полагают, являются углеродными, сделанными с помощью угля или сажи, что означает, что нет явного контраста между написанным текстом и папирусом на рентгеновских снимках».
Чтобы решить эту проблему, команда решила использовать как высокоэнергетические рентгеновские лучи, так и искусственный интеллект. Метод, который они используют, включает в себя фотографии фрагментов свитков с видимым для глаза текстом. Затем эти изображения подвергаются обработке с помощью «обучения алгоритмов машинного обучения, где ожидается наличие чернил в рентгеновских снимках этих фрагментов, собранных с помощью различных методов».
Команда руководствуется концепцией, что «система будет выявлять и учиться на тонких различиях между чернилами и пустыми областями в рентгеновских снимках, таких как различия в структуре волокон папируса». После того, как система будет обучена на этих фрагментах, идея состоит в том, чтобы применить ее к данным, полученным от целых свитков, и, возможно, это откроет текст, содержащийся в свитках.
Силс добавил, что команда завершила сбор рентгеновских данных и сейчас находится в процессе обучения назначенных алгоритмов, которые затем будут применены к свиткам в ближайшие месяцы. «Первое, что мы надеемся сделать, – это усовершенствовать технологию, чтобы мы могли просто повторить ее на всех 900 оставшихся [неоткрытых] свитках».
Говоря об важности возможных открытий, доктор Дирк Оббинк, папиролог и классик из Университета Оксфорда, также участвующий в проекте, сказал, что существует возможность, что текст может быть на латыни. Он добавил, что «новая историческая работа Сенеки Старшего была обнаружена среди неопознанных геркуланумских папирусов только в прошлом году, что показывает, какие неожиданные редкости остаются для открытия там».












