Tag Archives: encoding

EPIWEN I (June 15, 2026)

The launch meeting of the EPIWEN series was held online on June 15, 2026, with Claudia Wenzel (Heidelberg – Stonesutras), Cui Yixiong (Heidelberg – Stonesutras), Laurent Van Cutsem (UGent), Wu Luchun 吳廬春 (UGent), Xue Lei (University of Oregon), Michael Hatch (Trinity College), Yan Weitian (Indiana University), Yeh Shun-Yu (KULeuven – Infralives), and, from the Altergraphy project, Francesca Berdin (Inalco/IFRAE), Paula Suméra (Inalco/IFRAE), and Zhang Rui (ENS Lyon – Altergraphy). On the occasion of this meeting, we have redacted an outline of the project:

The Epiwen series aims to build a community of scholars working on Chinese epigraphy, to convene regularly to share their conceptual concerns, and to test methods in digital epigraphy together. Activities include comparing available transcription tools, publishing a shared corpus of transcriptions, and presenting it as a representative sample of Chinese epigraphy. Participants will co-author a data paper or practical manual that addresses methodological challenges and explains editorial decisions. The series will also produce and maintain an online glossary, gradually updated on Opentheso.

As an introduction to the discussion, Manuel reviewed the genesis of this initiative, from the 2023 AAS-in-Asia panel on documenting inscriptions to our participation in the 10th Epigraphy.info workshop in March 2026. He introduced the Epidoc initiative and provided a few slides comparing the TEI-derived Stonesutras encoding scheme and the Epidoc scheme. He highlighted overlaps and differences, for example, in the description of the “writing support” (where Stonesutras added specifics such as grid, frame, etc). Some convergences are obvious between the Stonesutras fields and the recently published FAIR Epigraphy vocabularies (such as the description of V-shaped, U-shaped and rectangular U-shaped grooves, the description of the “execution technique”).

Lia completed this introduction with a summary of the EPIWEN series’ outcomes, resources and workload, reflecting on the involvement of the meeting participants. Individual contributors are asked to present and work on one or more inscriptions and to participate in conceptual discussions about the transcription process. Participants may use their preferred tools or those they feel most comfortable with. Finally, we have agreed on the need for assistance in formalizing the discussions and publishing a related job ad. We are seeking one or more persons to assist the organizers in harmonizing edited transcriptions and managing publication of the Epiwen series. The role requires attending meetings to track discussions through to publication. The tasks fall into two bundles corresponding to distinct stages of the project; a single candidate may cover both bundles if they have the required skills.

The participants then each proposed a first choice of inscription, series of inscriptions, type of inscription or document reproducing an inscription:

(1) Wu Luchun would work on inscribed slabs originally from the Leifeng pagoda in Hangzhou, part of her PhD project. The series of stones with the Huayanjing was originally inserted into the walls of the pagoda, recovered after its collapse in the early 20th century, now partly preserved in the Zhejiang Museum. The set is incomplete, and the transcription would have to address the fragmentary nature of the stone slabs as well as their architectural setting. Laurent van Cutsem, who spoke on her behalf, raised the obvious similarity to the encoding practices of manuscripts, where the unit of encoding is the manuscript, with often completely unrelated recto and verso in one TEI file, and added milestones to differentiate between distinct texts inscribed on the same object or surface.

(2) Xue Lei would propose the transcription of a calligraphic model engraved on stone (fatie), the focus of his current book project. He noted that the geographic location of the work might be difficult to pin down in some cases, since the slabs are mobile. While textual content would not be central, his transcription would have to address the multiple versions of a single calligraphic work, as well as the gap between the inscription on stone and the circulating rubbings. He even raised the question that in his case, the stones are not even considered as the final product but only the intermediary step to reproduce  which should be considered the end product. Such a transcription might also markup stylistic elements (calligraphic variation) or recarving events (chongke).

(3) Michael Hatch would propose the transcription of an inscription in the format of an album enriched with colophons. He also presented different versions of the same inscription rendered with different techniques (rubbing & tracing copies or double-outline copies). He raised the question of the limits or ambitions of the Epiwen project, which, if it does not define its goals precisely around the question of texts engraved on stone (versus the “life of the rubbing”), would have to address the whole realm of calligraphy and painting. He also raised the problem of how to codify the vocabulary, using modern or historical terms or both. Further concerns were the complicated hybrid identities of the objects that might completely change historically. How to deal with the fact that, for example, a Qing literati inscription is was carved on a Han dynasty building brick transformed into an ink stone.

(4) Yan Weitian presented photographs of an “Yi Bingshou”-inscribed inkstone. He raised the question of authorship when the inscribed object displays the calligraphic style of Yi Bingshou, or contains an actual poem composed and signed by the artist, but was most likely engraved by an anonymous craftsman, and may exist in several exemplars. He addressed the complexity of encoding geographical information of different types of traveling objects. He wondered whether we should also include calligraphic adaptations written in ink on paper in the style of certain inscriptions, and how to describe their relationship to the “original” inscription.

(5) Yeh Shun-Yu presented a tentative classification of standard stele shapes based on a corpus of rubbings from different online databases that she is analyzing within her internship at the Infralives project. She proposed considering questions of format and layout, and it was raised whether the description would be based solely on rubbings.

(6) Cui Yixiong presented one example of an octagonal dharani pillar, addressing the question of how to describe multiple, sometimes “nested,” inscriptions that are distributed over the same writing support. He also raised the question of how to encode different calligraphic styles and the occurrence of related inscriptions on other media at the same site or even on the same object.

(7) Francesca Berdin proposed to adapt her transcription of the 6th-century Tang Yong stele, a rock-cut stele from the Xiangtangshan grotto ensemble, as well as one 6th-century epitaph, which she both analyzed for her MA Thesis in 2024-2025. Her transcription would include the several hundred graphic variants she has listed and classified.

Zhang Rui and Paula Suméra were not present at this first meeting but had declared their interest prior to it. The former is currently proofreading the transcriptions of the Altergraphy corpus, and the latter will propose a transcription of the Xizhou bronze pillar (940 CE) located in Furong district, Yongshun county, Hunan province.

Manuel and Lia will be working on several inscriptions of the Stonesutras and Altergraphy project, which are planned to be mapped from their respective databases onto the new Epiwen scheme.

About five additional online meetings are planned (with options for one-to-one or small-group meetings on specific issues), followed by a final in-person gathering in Paris between June 15 and 30, 2027. The next meeting will focus on the first two sections of an Epidoc edition: the headers and physical description. Participants are asked to bring one or several photographs of the inscription (including contextual photographs if needed), a rubbing if necessary and available, to look for existing transcriptions in order for us to compare the editions and the publication conventions across versions, and to think about the conceptual issues and challenges encountered when filling in the “headers” and “physical description” fields.

We are looking forward to welcoming contributions to additional participants, please express your interest by writing at [email protected] or [email protected]

Élaborer un corpus numérique de paysages inscrits : conseils d’intervenants et apports pour le projet (septembre-octobre 2023)

Les mois de septembre-octobre sont marqués par les premiers pas et le lancement officiel du projet de recherche ANR Altergraphy, qui nous occupera jusqu’en 2027. Ces dernières semaines ont été fructueuses quant à l’élaboration du projet. Depuis le mois de septembre, des séances de discussions hebdomadaires entre les membres de l’équipe de recherche ont permis de poser les premiers jalons du travail à effectuer pour ces prochaines années. Ces premières réunions ont été ponctuées par la rencontre avec des invités qui ont partagé leur expérience et leurs conseils au sujet de la construction d’un corpus numérique en sciences humaines.

Au début du mois de septembre 2023, Emmanuelle Morlock, ingénieure de recherche en humanités numériques au CNRS, et rattachée au Laboratoire HiSoMA (Histoire et sources des mondes antiques) a rencontré Lia Wei, coordinatrice du projet Altergraphy, en quête de conseils quant à la manière d’aborder l’encodage des textes dans cette première phase du projet. Emmanuelle Morlock propose de diviser le travail en étapes. La première tâche à effectuer est celle, en amont de l’encodage, de la sélection des informations dans les inscriptions qu’il faudra baliser. Il s’agit ici d’identifier les phénomènes d’intérêt sur lesquels portent les questions de recherche ‒par exemple, la présence de variantes graphiques et la définition progressive d’une typologie pour ces variantes, qui s’écartent de la norme d’écriture pour des raisons diverses. La seconde étape est celle de l’encodage en lui-même, dont l’objet est double. Il s’agit en effet à la fois de traiter les métadonnées des inscriptions portant sur leur contexte physique et leur matérialité, mais également de proposer un traitement systématique lié au contenu textuel des inscriptions (transcriptions, traductions, informations émises par le texte, etc.). Enfin, la dernière étape est celle de la visualisation de ces fichiers d’encodage via leur publication web. Il convient de prendre en considération cette dernière étape dès le départ. Se questionner sur ce que l’on veut rendre visible aux futurs utilisateurs de cette base de données est nécessaire pour déterminer les balises à créer lors de la première étape du travail. Ainsi, la question de l’encodage doit être abordée « par les deux bouts », le travail conceptuel advenant en amont et en aval de l’étape d’encodage, même si celle-ci sera effectivement le moment de tester ce qu’il est possible d’encoder et ce qui demeure au-delà de nos capacités de description.

Une seconde rencontre le 4 octobre 2023 avec Adeline Levivier a permis aux membres de l’équipe de préciser la démarche à suivre pour la structuration de la base de données. Adeline est responsable des données visuelles du projet ERC Dharma, qui vise à l’élaboration d’un corpus numérique combinant inscriptions et estampages provenant de toute l’Asie du Sud et de l’Est ‒du Tamil Nadu à l’Indonésie. Ayant travaillé auparavant sur le projet e-stampages, qui assemblait dans une même base de données artefacts et estampages des mondes grecs antiques, Adeline a une longue expérience dans la manipulation des estampages, leur reproduction, et leur organisation sous forme de corpus accessible en ligne. Elle nous a proposé des modèles d’organisation de l’information en fichiers tableur partagés sous forme de Google sheets à même de répondre aux besoins et spécificités de notre corpus, où l’information relative aux sites, au contexte immédiat des inscriptions, aux textes, aux estampages, et aux photographies est séparée en onglets liés les uns aux autres grâce aux identifiants assignés à chaque objet ou entité. Les champs à renseigner sur ces entités doivent être adaptés à la spécificité du corpus. Les sites montagneux de nos inscriptions sur falaises, par exemple, gagnent à être pensés à des échelles variées, classées par ordre décroissant. De même, les champs descriptifs dédiés aux inscriptions doivent partir du plus grand pour aller vers le plus petit, de ce qu’Adeline appelle la « mise en pierre », jusqu’à la lettre ‒dans notre cas, le caractère, ou même le trait, à la racine de l’expression calligraphique. Des choix concertés doivent être faits pour décrire le style des inscriptions. Une description de l’image par zones peut être envisagée, elle est possible avec les standards IIIF (International Image Interoperability Framework). Nous avons également abordé la question des tableaux ou listes d’autorités à penser, c’est-à-dire les références de temps, lieux et personnes. Adeline a partagé avec nous ses techniques de reproduction d’estampages, depuis la prise de vue jusqu’au travail de retouche et redressement des photogrammétries. Elle nous a d’emblée conseillé de demander un espace de stockage plus important sur Sharedocs, pour supporter des formats d’image RAW. Enfin, elle nous a proposé des solutions au regard de la publication web des données et de l’entretien durable du site qui les hébergerait.

Ces deux entretiens ont apporté des éclaircissements quant à l’utilisation des outils numériques à notre disposition. En ce qui concerne les images et leurs métadonnées, la plateforme du CNRS Huma-num permettra de stocker de manière pérenne toutes les données de notre corpus sur la plateforme d’hébergement Nakala, à partir d’un premier moment de travail effectué grâce à l’outil Sharedocs d’Huma-Num. D’autre part, les fichiers d’encodage des inscriptions, qui seront liés aux identifiants des estampages et des images correspondants, seront placés le temps de l’encodage sur la plate-forme GitHub, un drive dédié au travail collaboratif sur fichiers XML. Ces fichiers d’encodage devront être stockés et publiés sous une forme statique pour nécessiter un minimum d’entretien. Il reste encore à explorer les différents outils de publication web disponibles. Le portail Omeka, par exemple, une bibliothèque en ligne hébergée par Huma-Num, serait une possibilité, si un module TEI-Epidoc qui peut afficher les textes encodés peut lui être intégré, ainsi que des visualiseurs liés aux images hébergées sur Nakala.

Nourrie de ces deux rencontres, l’équipe de recherche a d’ores et déjà entamé la première étape du travail. Un « échantillon témoin », composé de quinze inscriptions du corpus qui paraissent, par leur variété, porter toutes les particularités que l’on pourrait rencontrer lors du traitement des données, a été proposé par Lia Wei. À partir de cet échantillonnage type, une première esquisse de tableur, avec un onglet pour chaque type de donnée (sites, inscriptions, textes, estampages, photographies), et avec chaque onglet présentant les différents types d’information et champs à renseigner pour baliser les données (identifiant, date, provenance, dimensions, etc.) a été effectuée. Nos premières discussions ont déjà permis d’identifier les particularités du corpus à organiser. Dans les paysages inscrits étudiés, le contenu textuel est aussi important que la forme calligraphique, cette dernière étant conditionnée par les conditions physiques de la gravure, qui déterminent à leur tour les possibilités d’estampage. Les dimensions de ces conditions demeurent à hiérarchiser et à mettre en relation (spatialisation des inscriptions, qualités de la surface rocheuse, matérialité des estampages, etc.).

Publiés régulièrement sur le carnet Hypothèses de l’ANR, ces billets de blog ont pour vocation de rendre compte des différentes étapes et démarches adoptées au sein du projet de recherche Altergraphy. Ils permettront aux lecteurs de se familiariser avec les différents rouages d’une recherche collaborative en construction. Nous avons le plaisir de vous présenter ici les différentes activités relatives au projet Altergraphy.

Paula Suméra

Formations et rencontres préliminaires : retour sur les débuts du projet (printemps-été 2023)

Avant le lancement officiel du projet ANR Altergraphy, plusieurs activités scientifiques et rencontres entre la coordinatrice du projet, Lia Wei, et des membres de la communauté scientifique, ont permis de mettre sur pied un cadre préliminaire à l’établissement de pistes de travail pour le projet.

Après une phase exploratoire au cours de la préparation de l’exposition “Pratique de l’estampage en Chine: images et objets inscrits”, co-organisée par Lia Wei et Michela Bussotti en mars 2023, avec les collections d’estampages de l’EFEO et de la BULAC, la réflexion s’est portée sur la description des qualités physiques de l’estampage en articulation avec son contenu textuel. La table ronde de la journée d’étude « Pratique de l’estampage en Chine : matérialité, transmission, réception » a rassemblé autour de cette thématique plusieurs chercheurs invités, Jean-Pierre Drège, Zhang Qiang, Olivier Venture, Lyce Jankowski, Manuel Sassmann, Michael Hatch, Pauline Chassaing, et des participants à la table ronde Éric Lefebvre et Alice Bianchi. Les remarques des divers intervenants ont porté sur plusieurs points : la complexité des documents étudiés, les modes de référencement possible de l’estampage à l’original (ce dernier ayant parfois disparu, ou n’ayant jamais existé, comme dans le cas des « estampages sans contact » ou « estampages composites »), l’opportunité de développer un langage descriptif standardisé pour des documents pouvant adopter des formes aussi diverses, l’articulation entre l’estampage et son inscription, les dimensions matérielles, formelles et linguistiques de cette inscription (avec la question des styles calligraphiques et variantes graphiques). De manière générale, les avis étaient partagés entre des participants aux profils professionnels et spécialisations variées (enseignants-chercheurs ou chercheurs en histoire de l’art, paléographie, littérature ou histoire, restaurateurs du patrimoine, conservateurs ou directeurs de musée, etc.). Les principales réserves concernaient les difficultés techniques d’un encodage textuel qui puisse exprimer les dimensions matérielles de l’inscription (pour des chercheurs en sciences humaines) et de son estampage et les limites de ce qu’un corpus numérique peut offrir en termes de rapport à l’œuvre (qu’il s’agisse de l’inscription sur objet ou falaise par exemple) et sa reproduction sous forme d’estampage (une œuvre à l’encre à part entière).

À la suite de cette première réflexion collective, et en préparation du lancement du projet Altergraphy, Lia Wei a participé au workshop d’encodage EpiDoc organisé par Gabriel Bodard et Simona Stoyanova en avril 2023 à l’Institute of Classical Studies à Londres. Elle a ensuite participé à deux conférences organisées par Manuel Sassmann (Académie des Sciences de Heidelberg) en juin 2023, à Daegu (une session intitulée « Documenting Inscriptions in China: Historical and Contemporary Perspectives » à AAS-in-Asia) et à l’Academy of Korean Studies et à la Korea University à Seoul (« Stone Inscriptions and their Afterlives »). Outre Manuel Sassmann et Michael Hatch, déjà présents à Paris en Mars 2023, ces deux événements ont réuni Yan Weitian (Indiana University) et Xue Lei (Oregon University), tous deux spécialisés dans l’épigraphie médiévale et sa réception moderne.

Enfin, une réunion a eu lieu en août 2023 avec les partenaires de l’Université de Gand, Christoph Anderl et Laurent Van Cutsem, ainsi que l’équipe des techniciens de la Database of Medieval Chinese Texts (DMCT), pour entamer la réflexion quant aux options de contextualisation et visualisation des données épigraphiques du projet Altergraphy à travers la constitution d’une base de données pour l’instant essentiellement constituée de manuscrits et de textes imprimés. L’ajout d’un module dédié à l’épigraphie serait une option envisageable pour mettre en évidence la diversité des supports et techniques d’écriture abordées par la DMCT.

Publiés régulièrement sur le carnet Hypothèses de l’ANR, ces billets de blog ont pour vocation de rendre compte des différentes étapes et démarches adoptées au sein du projet de recherche Altergraphy. Ils permettront aux lecteurs de se familiariser avec les différents rouages d’une recherche collaborative en construction. Nous avons le plaisir de vous présenter ici les différentes activités relatives au projet Altergraphy.

Affiche de l’exposition “Pratique de l’estampage: images et objets inscrits”
Vue de la galerie de l’Auditorium du pôle des langues et civilisations. photo: Sonia Leconte 2023