Aller au contenu

Les anciens mots d’Herculanum émergent grâce à l’intelligence artificielle

Les rouleaux d’Herculanum (Naples, Italie), enterrés par l’éruption du Vésuve il y a 2 000 ans, sont restés dans un état de mystère pendant plus de 250 ans.

Par

Mis à jour le 3 min de lecture

Les anciens mots d’Herculanum émergent grâce à l’intelligence artificielle

Les rouleaux d’Herculanum (Naples, Italie), enterrés par l’éruption du Vésuve il y a 2 000 ans, sont restés dans un état de mystère pendant plus de 250 ans. Cependant, une avancée sans précédent a permis de déchiffrer les premiers mots de ces anciens textes grâce à la combinaison de l’intelligence artificielle et de l’expertise de chercheurs. Bien qu’il reste encore un long chemin à parcourir, cette découverte marque une étape importante dans l’étude de la littérature ancienne.

Les découvertes remontent à la décennie de 1750, lorsque des centaines de rouleaux de papyrus ont été trouvés dans les vestiges d’une villa romaine luxueuse. La bibliothèque de la Villa des Papiers a le potentiel d’offrir un aperçu inestimable de la pensée de la Rome antique, mais jusqu’à présent, ces documents étaient condamnés à rester comme de fragiles blocs carbonisés.

La bibliothèque en question, située à la Bibliothèque Nationale de Naples, a été l’objet d’études par des universitaires et des scientifiques pendant des siècles. Mais le défi réside dans le fait que les rouleaux sont enroulés et se désintègrent lorsqu’on essaie de les dérouler physiquement, ce qui a compliqué leur analyse.

Quand l’IA rencontre l’histoire ancienne

En 2023, le concours « Défi Vésuve » a été lancé par des dirigeants technologiques pour inciter à l’utilisation de techniques de l’apprentissage automatique et de vision par ordinateur pour déchiffrer ces anciens textes. Récemment, une avancée significative a été annoncée : la génération de la première image de l’intérieur de l’un des trois rouleaux qui se trouvent à la Bibliothèque Bodléienne de l’Université d’Oxford.

Brent Seales, informaticien à l’Université du Kentucky et cofondateur du défi, a exprimé son enthousiasme après le scan réussi, affirmant que le rouleau contient plus de texte récupérable que tout autre scanné précédemment d’Herculanum.

Comment fonctionne cette technologie ?

Le scan a été réalisé par Diamond Light Source, un laboratoire qui utilise un synchrotron pour générer des rayons X de haute intensité. Les scientifiques ont utilisé l’intelligence artificielle pour fusionner les images, localiser l’encre et améliorer la lisibilité du texte, créant ainsi une représentation 3D du rouleau et permettant un déroulement virtuel.

Malgré les avancées, l’IA a des limites. Jusqu’à présent, il a été possible de distinguer à peine quelques mots, « dégoût » étant l’un des rares. Cependant, la communauté académique est invitée à participer à cet effort collaboratif pour compléter le texte.

Peter Toth, conservateur de la Bodléienne, a commenté la nécessité d’améliorer les images et a exprimé son optimisme quant au potentiel de la technologie pour faciliter le processus. Avec des milliers de rouleaux encore à déchiffrer, l’avenir de l’étude de la littérature ancienne semble plus brillant que jamais.

Informaticien depuis 2002 : systèmes, ingénierie, développement web et SEO. Je fais des affaires avec l’IA depuis février 2023, quand ChatGPT a pu s’acheter en Espagne.

Plus sur moi Comment je teste les outils

Une question après la lecture ? Posez-la-moi

C’est moi, Miguel Ángel, qui vous réponds, ici même. Et si quelque chose n’est plus à jour, dites-le-moi et je corrige.

Écrire ma question

Ce que vous voulez me demander ou me raconter. Pas de liens.

Celui que vous voulez voir publié. Pas d’e-mail.

Ce que je garde : votre nom affiché, votre texte et la date, pour les publier après relecture. Je ne vous demande pas d’e-mail. Contre le spam, Cloudflare Turnstile vérifie que vous êtes humain et je garde pendant 30 jours une empreinte de votre connexion calculée avec une clé, impossible à inverser (jamais l’IP en clair). Ce qui n’est pas publié est supprimé 30 jours après relecture ; ce qui est publié reste tant que la page existe ou jusqu’à ce que vous me demandiez de le retirer. Base légale : votre consentement, retirable à tout moment. Politique de confidentialité.

Je les lis tous avant publication. Pas de liens ni d’insultes.