@inproceedings{Randriatsitohaina-Hamon:TALN:2020,
    author = "Randriatsitohaina, Tsanta and Hamon, Thierry",
    title = "Identification des probl\`emes d'annotation pour l'extraction de relations",
    booktitle = "Actes de la Conf\'erence sur le Traitement Automatique des Langues Naturelles. Volume 2 : Traitement Automatique des Langues Naturelles (Articles courts)",
    month = "6",
    year = "2020",
    address = "Nancy, France",
    publisher = "Association pour le Traitement Automatique des Langues",
    pages = "323-331",
    note = "Identification of annotation problem for the relation extraction",
    abstract = "L'annotation d'un corpus est une t\^ache difficile et laborieuse, notamment sur des textes de sp\'ecialit\'e comme les textes biom\'edicaux. Ainsi, dans un contexte comme l'extraction des interactions alimentm\'edicament (FDI), l'annotation du corpus POMELO a \'et\'e r\'ealis\'ee par un seul annotateur et pr\'esente des risques d'erreur. Dans cet article, nous proposons d'identifier ces probl\`emes d'annotation en utilisant un corpus Silver Standard (CSS) que nous \'etablissons \`a partir d'un vote majoritaire parmi les annotations propos\'ees par des mod\`eles entra{\^\i}n\'es sur un domaine similaire (interaction m\'edicamentm\'edicament - DDI) et l'annotation manuelle \`a \'evaluer. Les r\'esultats obtenus montrent que l'annotation dans POMELO est consid\'erablement \'eloign\'ee du CSS. L'analyse des erreurs permet d'en identifier les principales causes et de proposer des solutions pour corriger l'annotation existante.",
    keywords = "Annotation, relation extraction, corpus biom\'edical, interaction m\'edicament-aliment",
    url = "http://talnarchives.atala.org/TALN/TALN-2020/97.pdf"
}
