Mô hình và nền tảng AI
Máy Học Máy Được Sử Dụng Để Phát Hiển Bí Mật Của Cuộn Giấy Papyrus Pompeii

Một nhóm các nhà khoa học tại Đại học Kentucky đã có thể, như The Guardian cho biết, tìm thấy trong hòm thánh của một ngôi đền ở En-Gedi ở Israel, và chứa văn bản từ sách Leviticus của Kinh Thánh, hiện đang tham gia vào một nhiệm vụ khó khăn và phức tạp hơn – đọc các cuộn giấy papyrus bị carbon hóa còn lại sau vụ phun trào của núi Vesuvius vào năm 79 sau Công nguyên ở thành phố Pompeii của Ý.
Trong khi nhóm nghiên cứu do Giáo sư Brent Seales dẫn đầu đã có thể đọc được bản thảo tìm thấy trong một ngôi đền ở En-Gedi, Israel với ‘chỉ’ tia X năng lượng cao, thì lần này, do cách các cuộn giấy papyrus của Pompeii được tạo ra và viết, họ sẽ phải sử dụng máy học để cố gắng giải quyết những bí ẩn ẩn trong các cuộn giấy này.
Họ sẽ thử nghiệm các giá cả của họ trên hai cuộn giấy chưa được mở, thuộc về Institut de France ở Paris và là một phần của bộ sưu tập khoảng 1.800 cuộn giấy được phát hiện lần đầu tiên vào năm 1752 trong quá trình khai quật Herculaneum. Như The Guardian chỉ ra, chúng tạo thành thư viện hoàn chỉnh duy nhất còn tồn tại từ thời cổ đại, với phần lớn bộ sưu tập hiện được bảo tồn trong một bảo tàng ở Naples.
Giáo sư Seales giải thích vấn đề mà nhóm của ông phải đối mặt – “mặc dù bạn có thể thấy trên từng mảnh giấy papyrus rằng có viết, để mở nó ra sẽ đòi hỏi giấy papyrus phải thật linh hoạt và dẻo – và nó không còn như vậy nữa.” Vấn đề cũng nằm ở việc “trong khi cuộn giấy En-Gedi chứa một loại mực dựa trên kim loại có thể hiển thị trong dữ liệu tia X, thì loại mực sử dụng trên các cuộn giấy Herculaneum được cho là dựa trên carbon, được tạo ra bằng than hoặc muội than, có nghĩa là không có sự tương phản rõ ràng giữa văn bản và giấy papyrus trong các bản quét tia X.”
Để có thể giải quyết vấn đề, nhóm đã quyết định sử dụng cả tia X năng lượng cao và trí tuệ nhân tạo. Phương pháp họ sử dụng bao gồm chụp ảnh các mảnh cuộn giấy có văn bản nhìn thấy được bằng mắt thường. Sau đó, những hình ảnh này sẽ được sử dụng để “dạy cho các thuật toán học máy nơi mực được dự kiến sẽ xuất hiện trong các bản quét tia X của cùng các mảnh này, thu thập bằng một số kỹ thuật.”
Nhóm được hướng dẫn bởi khái niệm rằng “hệ thống sẽ chọn ra và học các sự khác biệt tinh tế giữa các khu vực có mực và không có mực trong các bản quét tia X, chẳng hạn như sự khác biệt trong cấu trúc của các sợi giấy papyrus.” Sau khi hệ thống được đào tạo trên các mảnh này, ý tưởng là áp dụng nó vào dữ liệu từ các cuộn giấy hoàn chỉnh và hy vọng rằng sẽ tiết lộ văn bản chứa trong các cuộn giấy.
Seals thêm rằng nhóm đã hoàn thành việc thu thập dữ liệu tia X và hiện đang trong quá trình đào tạo các thuật toán được chỉ định, sau đó sẽ được áp dụng cho các cuộn giấy trong những tháng tới. “Điều đầu tiên chúng tôi hy vọng là hoàn thiện công nghệ để chúng tôi có thể đơn giản lặp lại nó trên tất cả 900 cuộn giấy còn lại [chưa được mở].”
Khi nói về tầm quan trọng của những khám phá có thể, Tiến sĩ Dirk Obbink, một nhà nghiên cứu giấy papyrus và cổ điển tại Đại học Oxford, cũng tham gia vào dự án cho biết có khả năng văn bản có thể là tiếng Latin. Ông thêm rằng “một tác phẩm lịch sử mới của Seneca the Elder đã được phát hiện trong số các giấy papyrus Herculaneum chưa được xác định chỉ vào năm ngoái, cho thấy những điều kỳ lạ chưa được nghĩ đến vẫn còn được khám phá ở đó.”












