Моделі та платформи ШІ
Використання машинного навчання для розшифрування секретів свитків Помпеї

Команда вчених з Університету Кентуккі, яка, як повідомляє The Guardian, знайшла в святому ковчезі синагоги в Ен-Геді в Ізраїлі і яка містила текст з біблійної книги Левита, тепер зайнята ще більш складним завданням – читанням вуглефікованих свитків, що залишилися після виверження вулкану Везувій в 79 році н.е. в італійському місті Помпеї.
Хоча команда під керівництвом професора Брента Сіалса змогла прочитати пергамент, знайдений у синагозі в Ен-Геді, Ізраїль, за допомогою високоенергетичних рентгенівських променів, цього разу їм доведеться використовувати машинне навчання, щоб спробувати розгадати загадки, що ховаються в цих свитках.
Вони будуть тестувати свої ціни на двох не відкритих свитках, які належать Інституту Франції в Парижі і є частиною колекції з близько 1 800 свитків, які були вперше виявлені в 1752 році під час розкопок Геркуланума. Як зазначає The Guardian, вони складають єдину відому цілу бібліотеку з античності, а більшість колекції зараз зберігається в музеї в Неаполі.
Професор Сіалс пояснив проблему, з якою стикається його команда – “хоча ви можете побачити на кожній пластині папірусу, що там є напис, щоб відкрити її, потрібно, щоб папірус був досить гнучким – і він вже не такий”. Проблема також полягає в тому, що “хоча в свитку Ен-Геді містився металевий чорнил, який видно на рентгенівських знімках, чорнила, використані на свитках Геркуланума, як вважають, вуглецеві, виготовлені з вугілля або сажі, що означає, що немає явної різниці між написом і папірусом на рентгенівських знімках”.
Щоб вирішити проблему, команда вирішила використовувати як високоенергетичні рентгенівські промені, так і штучний інтелект. Метод, який вони використовують, полягає у фотознімках фрагментів свитків з написами, видимими неозброєному оку. Потім ці фотознімки подаються для “навчання алгоритмів машинного навчання, де очікується чорнил у рентгенівських знімках цих фрагментів, зібраних за допомогою кількох методів”.
Команда керується концепцією, що “система виділить і навчиться тонким відмінностям між чорнилом і порожніми ділянками на рентгенівських знімках, такими як відмінності в структурі волокон папірусу”. Після того, як система буде навчена на цих фрагментах, ідея полягає в застосуванні її до даних з цілих свитків і, можливо, це відкриє текст, який міститься в цих свитках.
Сіалс додав, що команда завершила збір даних рентгенівських променів і зараз зайнята навчанням призначених алгоритмів, які потім будуть застосовані до свитків у найближчі місяці. “Перше, що ми сподіваємося зробити, – це вдосконалити технологію, щоб ми могли просто повторити її на всіх 900 свитках, які залишилися [не розгорнутими]”.
Говорячи про важливість можливих відкриттів, доктор Дірк Оббінк, папіролог і класик з Університету Оксфорда, також залучений до проекту, сказав, що є можливість, що текст може бути латиною. Він додав, що “нова історична робота Сенеки Старшого була виявлена серед невизначених папірусів Геркуланума лише минулого року, що показує, які непередбачувані рідкісності залишаються для відкриття там”.












