Une archive numérique francophone des articles de recherche en Traitement Automatique de la Langue.
Actes de 21e Conférence en Recherche d'Information et Applications (CORIA) newline 19e Rencontres Jeunes Chercheurs en RI (RJCRI) newline 33e Conférence sur le Traitement Automatique des Langues Naturelles (TALN) newline 28e Rencontre des Étudiants Chercheurs en Informatique pour le Traitement Automatique des Langues (RÉCITAL) (CORIA-TALN-2026'2026), Nantes (France)
Actes de l'atelier sur l'évaluation des modèles génératifs (LLM) et challenges (EvalLLM 2026)
Hichem Semmar, Eric Sanjuan
»
[article]
[bib]
[résumé]
Analyse des dynamiques internes des LLMs pour distinguer mémorisation et hallucination
Louis Jourdain, Skander Hellal
»
[article]
[bib]
[résumé]
CoRAFIG : corpus multi-genre pour la méta-évaluation du résumé automatique en français
Alexandre Gallot, Louis Jourdain
»
[article]
[bib]
[résumé]
De l'outil au scénario : génération automatique de benchmarks pour agents conversationnels
Khanh-An C. Quan, Camille Guinaudeau, Shin'ichi Satoh
»
[article]
[bib]
[résumé]
Évaluation de la cohérence des modèles vision-langage pour la tâche de question-réponse visuelle
Thibault Bañeras-Roux, Kumar Shashi, Driss Khalil, Sergio Burdisso, Petr Motlicek, Shiran Liu, Mickael Rouvier, Jane Wottawa, Richard Dufour
»
[article]
[bib]
[résumé]
Évaluation de la reconnaissance automatique de la parole par les grands modèles de langage génératifs
Quentin Brabant
»
[article]
[bib]
[résumé]
Évaluation de métriques de RAG dans un contexte applicatif : une expérience, ses conclusions et ses limites
Christophe Denis
»
[article]
[bib]
[résumé]
Fabrique sémiotique hybride et évaluation stratifiée des systèmes RAG sur SciFact
Benedictus Kent Rachmat, Thomas Gerald, Zheng Zhang, Cyril Grouin
»
[article]
[bib]
[résumé]
Les données de calibration comptent-elles vraiment pour LoRA?
Carmelle Meli Songuon, Raphaël Troncy, Yoan Chabot
»
[article]
[bib]
[résumé]
Les systèmes GraphRAG en pratique : vers une taxonomie des questions, des méthodes et défis d'évaluation
Hugo De Bosschere, Maximillien Lyonnais, Clément Geliot
»
[article]
[bib]
[résumé]
Quantification du conflit entre mémoire paramétrique et mémoire contextuelle : Étude des Métriques de Dégradation sur la Famille de modèles Qwen3.5
Gautier Evennou, Antoine Chaffin, Vivien Chappelier, Ewa Kijak
»
[article]
[bib]
[résumé]
Revisite du légendage de différences d'images avec BLIP2IDC
Carl Hatoum, Catherine Combes, Virginie Burnaz-Fresse, Christophe Gravier, Mathieu Orzalesi
»
[article]
[bib]
[résumé]
Sélection de résumés par aspect pour le déploiement industriel : agrégation de Borda multi-objectif sans référence
Rian Touchent, Eric de la Clergerie
»
[article]
[bib]
[résumé]
TABIB: Vers un Benchmark Adversarial Français pour les LLMs Biomédicaux
Dhaker iyad Nejah, Mounira Harzallah, Giuseppe Berio, Yasamin Eslami
»
[article]
[bib]
[résumé]
What Do Current Evaluation Practices Evaluate About LLMs in Ontology-Oriented Generation?Focused Review for Specialized-Domain Settings