@inproceedings{Cheng-Sheang-Koptient-Grabar-Saggion:TALN:2022,
    author = {Cheng Sheang, Kim and Koptient, Ana{\"\i}s and Grabar, Natalia and Saggion, Horacio},
    title = "Identification of complex words and passages in medical documents in French",
    booktitle = "Actes de la 29e Conf\'erence sur le Traitement Automatique des Langues Naturelles. Volume 1 : conf\'erence principale / Travaux originaux",
    month = "6",
    year = "2022",
    address = "Avignon, France",
    publisher = "Association pour le Traitement Automatique des Langues",
    pages = "115-124",
    note = "The purpose of automatic text simplification is to provide a new version of documents that are easier to understand by a given population or easier to process by other NLP applications",
    abstract = "Identification de mots et passages difficiles dans les documents m\'edicaux en fran\c{c}ais. L'objectif de la simplification automatique des textes consiste \`a fournir une nouvelle version de documents qui devient plus facile \`a comprendre pour une population donn\'ee ou plus facile \`a traiter par d'autres applications du TAL. Cependant, avant d'effectuer la simplification, il est important de savoir ce qu'il faut simplifier exactement dans les documents. En effet, m\^eme dans les documents techniques et sp\'ecialis\'es, il n'est pas n\'ecessaire de tout simplifier mais juste les segments qui pr\'esentent des difficult\'es de compr\'ehension. Il s'agit typiquement de la t\^ache d'identification de mots complexes : effectuer le diagnostic de difficult\'e d'un document donn\'e pour y d\'etecter les mots et passages complexes. Nous proposons de travail sur l'identification de mots et passages complexes dans les documents biom\'edicaux en fran\c{c}ais.",
    keywords = "Complex word identification, Text simplification.",
    url = "http://talnarchives.atala.org/TALN/TALN-2022/2891.pdf"
}
