IA et recherche documentaire : quelques éléments pour une formation de formateurs
Abstract
Formation URFIST de Bordeaux, octobre 2025
Full text
IA et recherche documentaire Quelques éléments pour une ormation de formateurs Raphaëlle Bats, 2025
Context IA & universités En guise d’introduction
L’IA générative : un sujet tendance Par JPxG —DALL-E 3, Domaine public, https://commons.wikimedia.org/w/index.php?curid=144161107
An overviewof headlines about Chat GPT (Dec2022) Source : https://www.theguardian.com/technology/chatgpt?page=17 Thèmes •La triche et la copie : méfiance envers les usages •Le remplacement des humains : inquiétude à la fois socio-éco-philosophique •La technologie : émerveillement
An overviewof headlines about Chat GPT (Dec2023) Source: https://www.theguardian.com/technology/chatgpt?page=7 Thèmes •La triche et la copie : méfiance envers les usages •Le remplacement des humains : inquiétude à la fois socio-écophilosophique •La technologie : émerveillement
An overviewof headlines about Chat GPT (Dec2024) Source: https://www.theguardian.com/technology/chatgpt?page=2 Thèmes •La triche et la copie : méfiance envers les usages > et envers l’outil et transformation des institutions •Le remplacement des humains : inquiétude à la fois socio-écophilosophique > inquiétude sociale (liens) •La technologie : émerveillement > acceptation lucide de la transformation en cours •Le droit : les données, les sources
An overviewof headlines about Chat GPT (Oct 2025) Source: https://www.theguardian.com/technology/chatgpt?page=2 Thèmes •Nouvelle inquiétude : la question de la réalité et de la vérité
L’IA et ESR Source : Service d'information du Gouvernement
Les étudiants et l’IA 87%
Les 6 domaines dans lesquels l’IA peut améliorerle travail académique Source: https://ars.elscdn.com/content/image/1-s2.0S2666990024000120-gr2_lrg.jpg
IA générative et recherche le plan du cours Bloc 1 : Généralités •Définitions •Histoire •Contexte Bloc 4 : Rédaction, productions de savoirs •Produire des slides, vidéos, etc. •Ecrire des articles •Reformuler, traduire, etc. •Citer les IA / Zotero Bloc 5 : Valorisation • Interfaces / catalogues : mode d’accès à l’info •Médiation •Communication : publication et revue par les éditeurs Bloc 3 : Données •Entrainement LLM •Traitement des données •Production de données •Datavisualisation Bloc 2 : Recherche doc et veille •Mots-clés •Problématique •Revue littérature • Vérification de l’info
Context Des IA à l’IA Générative Histoire et définitions
L’IA générative : une petite histoire et un peu de vocabulaire Source : https://aqua-cloud.io/generative-ai-in-testing/
Frise chronologique de l’IA Source: https://medium.com/@lmpo/abrief-history-of-ai-with-deeplearning-26f7948bc87b
IA et IA générative
Machine Learning : apprentissage automatique https://fr.wikipedia.org/wiki/Intelligence_artificiellex
Apprentissage supervisé ? Non supervisé ? «L’IA supervisée utilise des données étiquetées pour entraîner des modèles et effectuer des prédictions ou des classifications. A l’inverse, la non supervisée traite des données non étiquetées pour découvrir des structures ou des motifs intrinsèques. » Source : https://www.dynamique-mag.com/article/quelques-notions-avancees-sur-l-ia
Connexionniste
Comparaison des courants symbolique et connexionniste de l'intelligence artificielle. Le courant neurosymbolique se situe à l’interstice de ces deux approches. (CC BY 4.0) dans Alsaïdi, Ismaïl. (2023). Rôle, évaluation et réglementation des intelligences artificielles appliquées au diagnostic et à la thérapeutique.
https://waizz.net/fr/quest-ce-que-intelligenceartificielle-ia/
https://www.frenchweb.fr/ que-devient-liasymbolique/322592 Intelligence Artificielle Générale ATTENTION : l’IA Générale n’est pas l’IA générative
https://waizz.net/fr/quest-ce-que-intelligenceartificielle-ia/
Les chatbots James grills, Chatbot
Timeline of ChatBot Source: https://www.techtarget.com/search enterpriseai/tip/The-history-ofartificial-intelligence-Complete-AItimeline
ChatBot / Generative AI Source: https://www.techtarget.com/searchenterpriseai/tip/The-history-of-artificial-intelligence-Complete-AI-timeline
LLM ou grand modèle de langage « Ce sont des réseaux de neurones profonds entraînés sur de grandes quantités de texte non étiqueté utilisant l'apprentissage auto-supervisé[5]. Les LLM sont apparus vers 2017 et ont été utilisés pour la mise en œuvre d'agents conversationnels. (…) Les modèles de langage possédant un grand nombre de paramètres s'avèrent capables de capturer une grande partie de la syntaxe et de la sémantique du langage humain. Cela permet de retraduire une connaissance générale sur le monde conséquente, avec « mémorisation » d'une grande quantité de faits lors de l'entraînement. » Source : https://fr.wikipedia.org/wiki/Grand_mod%C3%A8le_de_langage
LLM et probabilité Jeu pour comprendre comment marche une LLM https://professeurherve.forge.a pps.education.fr/monpremierll m/
ECODOC – “A vous de jouer” Un atelier pour lire et s’approprier des données scientifiques Testé lors de 5 ateliers menés : Atelier 1 : Doctorants et professionnels de l’INRIA + Masters en design Atelier 2 à 4 : Étudiants de L2 en information-communication Atelier 5 : Jeunes d’un centre social (12-14 ans) 21 jeux produits : Voir le tableau page suivante Un atelier pour Permettre l’appropriation de données scientifiques > Permettre l’appropriation d’un cours >> Concevoir des jeux pour des formations
ECODOC – “A vous de jouer” ECODOC – “A vous de jouer”
ECODOC – “A vous de jouer” ECODOC – “A vous de jouer”
ECODOC – “A vous de jouer” La méthode de l’atelier est expliquée dans notre guide : « Lectures sensibles de la science : guide de médiation de la recherche » Téléchargeable grauitement : https://zenodo.org/records/15771901 ECODOC – “A vous de jouer”
URFIST, formation et IA Projet de cours sur l’IA au sein du réseau et projet de jeu sérieux sur le sujet Utiliser la méthode ECODOC pour concevoir des jeux de validation des connaissances lors d’un cours sur l’IA > une expérimentation pendant le congrès Bobcatsss 2025 : 3 jeux conçus. Pour permettre aux étudiants de s’approprier le cours et à utiliser dans les formations > d’où notre présence aujourd’hui
Ce que l’on va faire aujourd’hui
Un atelier 1. Co-concevoir des jeux sérieux 2. A partir d’un ensemble de ressources sur la thématique de l’IA et de la recherche d’information 3. A réutiliser dans la cadre de formation avec ses usagers (BU/BM) ou les bibliothécaires
Qu’est-ce qu’un jeu ? “Tous les jeux partagent les caractéristiques suivantes : un objectif, des règles, un système de feedback et une participation volontaire.” McGonigal (2012) Reality is broken “Une activité physique ou mentale, non impose, non mue par un quelconque but utilitaire, et qui engage celui qui joue dans le divertissement et le plaisir.” Larousse, 2024
Le processus de création de jeu Définir les objectifs d’apprentissage Fixer les contraintes Choisir le type de jeu Choisir le format Prototyper-maquetter Tester et améliorer Définir les règles Concevoir et imprimer
Des données pour faciliterla compréhensionde l’IA Ensemble de ressources avec des documents sur : Le contexte de l’intelligence artificielle Contexte spécifique : IA et recherche Corpus d’outils sélectionnés Enjeux et défis pour la recherche académique
Prototype Trouver une idée L’essayer, la faire évoluer en brainstorming Utiliser le storyboard pour la faire fonctionner
Inspirez-vous de jeux que vous connaissez Penser à leurs mécanismes de jeu Collecte de points Utilisation de dés Défi de mémoire
Context Les outils IA pour la recherche documentaire et leurs limites .
Exercice Donner deux noms d’outils IA et leurs usages
60 outils Source : https://www.uneiaparjour.fr/selection-outils/
Les outils IA pour la recherche documentaire 1/4 Source : https://www.educationconnection.com/resources/ai-research-for-writing-a-paper/
Les outils IA pour la recherche documentaire 2/4 Source : https://www.educationconnection.com/resources/ai-research-for-writing-a-paper/
Les outils IA pour la recherche documentaire 3/4 Source : https://www.educationconnection.com/resources/ai-research-for-writing-a-paper/
Les outils IA pour la recherche documentaire 4/4 Source : https://www.educationconnection.com/resources/ai-research-for-writing-a-paper/
Outils IA et leurs services
1.3: AI and MindMap https://www.contextminds.com/ https://www.contextminds.com/
1.3: AI and MindMap –NotebookLM
1.3: AI and MindMap –NotebookLM https://notebooklm.google.com
1.3: AI and MindMap –NotebookLM ???
Recherche de références biblio
2/Explorer des sources variées Objectifs: Chercher des références Sélectionner des documents Discuter avec les références Outils : ➢Explorer le Rabbit Hole avec Rabbit Research ➢Discuter avec les références dans ELICIT ➢Chat avec un PDF
2.1: Explorer le Rabbit Hole avecResearchRabbit https://researchrabbitapp.com 1 2
A propos des knowledges graphs Extrait cours de JB. Monat et A.I Azilan, Urfist de Lyon
2.2: Discuter avec les références dans ELICIT ELICIT : https://elicit.com/ 1 2 3
2.3: Chat with PDF with 1 23
3.3: Revue de littérature avec ELICIT ELICIT : https://elicit.com/ 1/ je pose une question 2/ il trouve des références 3/ sort un abstract
3.3: Revue de littérature avec ELICIT ELICIT : https://elicit.com/ 4/ un tableau d’analyse des références
3.3: Revue de littérature avec ELICIT ELICIT : https://elicit.com/ 5/ il propose des concepts clés et une synthèse
Fiabilité
Réception © Universcience
Réception La majorité des 18-24 ans fait confiance aux IA génératives et les perçoit comme ayant de nombreux avantages © Universcience
Les chatbots gen sont-ils fiables ?
LLM et vérité https://www.arthurperret.fr/articles/2025-06-20-congres-sfsic-ia-impasse-informationnelle.html
Méfiance Système probabiliste lui-même Données qui alimentent l’IA et système d’entraînement Solutions ? Du mode de questionnement de l’IA > prompt
Probabilité et confiance Source CNIL : https://www.cnil.fr/fr/les-questions-reponses-de-la-cnil-sur-lutilisation-dun-systeme-dia-generative
Se méfier des réponses Source: Standford : https://www.google.com/url?sa=t&source=web&rct=j&opi=89978449&url=https://aiindex.stanford.edu/wp-content/uploads/2024/05/HAI_AI-Index-Report2024.pdf&ved=2ahUKEwipyp7siPiKAxXKV6QEHdmMA8EQFnoECCMQAQ&usg=AOvVaw1TDFLP2mJRjdbTqe4MK3w4
Solution 1 : des outils fiables ? Quelles données ? SophIA / CAIRN : «Par rapport aux autres outils existants, sa différence est double : d’une part il se base uniquement sur les contenus scientifiques validés diffusés sur [Cairn.info], d’autre part, il propose d’accéder directement aux extraits de ces publications en mettant en avant les chercheurs et leurs réponses diverses aux questions posées. Plutôt qu’une tentative de synthèse hasardeuse et proposant des paraphrases approximatives, l’utilisateur peut donc découvrir en contexte (chronologique, géographique, disciplinaire, etc.) les échanges scientifiques autour de la problématique abordée. » https://apropos.cairn.info/fr/mission/ia
Solution 2 : des outils fiables ? Comparer
Des réponses fausses Qui ne dépendent pas de la version de l’IA Des réponses surtout incomplètes Elaboration d’un test à base de prompt, test réutilisable Goria, S. (2025). Élaboration d’un protocole d’évaluation comparative pour estimer la qualité des réponses fournies par une iag suite à une demande informationnelle précise. I2D - Information, données & documents, Juillet(1), 184-210. https://doi.org/10.3917/i2d.251.0184. Solution 3 : des outils fiables : élaboration d’un test
Evaluation des réponses : un exercice à faire avec les étudiants Goria, S. (2025). Élaboration d’un protocole d’évaluation comparative pour estimer la qualité des réponses fournies par une iag suite à une demande informationnelle précise. I2D - Information, données & documents, Juillet(1), 184-210. https://doi.org/10.3917/i2d.251.0184.
Solution 4: des outils fiables ? le filtre de vérité https://www.reddit.com/r/PromptEngineering/c omments/1kup28y/chatgpt_and_gemini_ai_will _gaslight_you_everyone/ "Vous avez raison, vous ne pouvez pas combattre le cœur d'entraînement probabiliste de l'IA. Le but de l'invite n'est pas d'arrêter la rivière, c'est de la diriger. C'est de construire une 'sortie' préfabriquée. C'est de la gestion des risques. Ce n'est pas censé être une solution magique. Sans cela, le LLM est plus susceptible d'halluciner une supposition confiante."
Les prompts Les prompts : la formulation de la question posée à l’IA générative. De la manière dont est posée cette question ou la série de question dépendent non seulement la réponse, mais encore sa qualité. Pour autant le prompt ne résout pas les limites internes à l’outil (données).
Faire un bon prompt Source: https://www.microsoft.com/en-us/education/blog/2024/06/five-quick-prompting-tips-to-get-more-from-your-ai-assistant/ Eléments : •Persona : jeu de rôle •Objectif : réponse attendue •Audience : le niveau de réponse •Contexte : spécifie le cadre de la réponse •Limites : les contraintes données Autres termes : •Instruction •Contexte •Input data •Output Indicator
Des exemples de prompts A utiliser avec des étudiants ! https://www.promptingguide. ai/fr/introduction/examples
Améliorer ses prompts Bonnes pratiques pour améliorer la qualité des réponses : •clarté de la demande, •spécificité du langage, •fourniture de contexte utile, •usage d'exemples, •précision, •structuration par étapes, •itération et affinage François Magnan : https://francoismagnan.wordpress.com/
Context Limites des outils IA et responsabilité .
Limites de ces outils •Omniprésence et magie •Coût : égalité et équité •Ethique
Omniprésence et magie
A propos des assistants IA : forcing et magie Voir l’excellente enquête de Limites Numériques, mars 2025 : https://limitesnumeriques.fr/travauxproductions/ai-forcing L'IA sur le devant de la scène : •Occupation des espaces très visibles sur les pages •Une mise en avant graphique : couleur •Insistance : plusieurs accès répétés possibles •Une mise en avant par interruption de l’expérience : ouverture de boîtes •Vous n'êtes qu'à un clic de l'utiliser : possible utilisation involontaire •Toujours activée... : et difficile à désactivée L'IA est présentée comme magique •Le symbole de la magie et de l'innovation •La couleur de la magie : sur-utilisation des bleus et des violets •Le tout en un ou l’indéfinition de la fonctionnalité «Le bouton IA de Zoom, par exemple, a un usage complètement différent de celui de Google, et pourtant ils sont visuellement identiques. » •L’invisibilisation de la machine et sa matérialité
Coût
Coût des IA : entrainement Source: Standford : https://www.google.com/url ?sa=t&source=web&rct=j&o pi=89978449&url=https://aii ndex.stanford.edu/wpcontent/uploads/2024/05/H AI_AI-Index-Report2024.pdf&ved=2ahUKEwipyp 7siPiKAxXKV6QEHdmMA8EQ FnoECCMQAQ&usg=AOvVaw 1TDFLP2mJRjdbTqe4MK3w4
Coût d’usage 1. Modèle de licence : prévisible mais coûteux en amont 2. Modèle basé sur la consommation : flexible mais variable 3. Modèle d’abonnement : cohérent mais rigide 4. Modèle freemium : à faible risque, mais potentiellement coûteux 5. Modèle de partage des revenus : objectifs alignés mais gestion compliquée 6. Modèle facturé aux résultats : moins risqué, mais difficile à définir
Coût d’usage : les abonnements –Chat GPT
Coût d’usage : les abonnements –ELICIT
Ecologie Le coût écologique (énergie, eau, CO2) est lié à : «L’entraînement des modèles : les processus d’entraînement, qui nécessitent souvent plusieurs itérations, mobilisent des serveurs énergivores. L’augmentation de la puissance de calcul : les centres de données hébergeant ces serveurs consomment des quantités importantes d’énergie, notamment pour le refroidissement. La demande croissante de stockage : plus de données et de calculs engendrent des besoins en stockage massif, ce qui amplifie l’empreinte carbone. » https://institut-superieurenvironnement.com/blog/li ntelligence-artificielle-unepollution-cachee-au-coeurde-linnovation/
Hallucination, vulnérabilité informationnelle et méfiance envers les institutions « Les bibliothécaires notent que ceux qui adoptent le plus largement les chatbots et leur font le plus confiance sont ceux qui sont les moins compétents en matière de littératie informationnelle. Il est donc plus difficile de les faire comprendre que le chatbot a tout inventé. Heureusement, lorsqu’il s’agit de titres de livres hallucinés, les bibliothécaires peuvent rapidement vérifier leur propre catalogue et WorldCat, un catalogue mondial. S’il n’y figure pas, il y a de fortes chances que l’ouvrage n’existe pas. » https://www.lesnumeriques.com/intelligence-artificielle/livres-hallucines-quand-l-intelligence-artificielle-seme-le-chaosdans-les-bibliotheques-n242587.html Demandes d’ouvrages hallucinés par les IA auprès des bibliothèques et conflits de méfiance.
IA : menace ou opportunité ? Lire l’enquête de l’IPSOS : https://www.ipsos.com/fr-fr/vivre-avec-lintelligenceartificielle-opportunite-ou-menace
Données personnelles Toute question posée à une IA générative, tout document qui lui est soumis la nourrit. Pour éviter que vos questions soient des données de l’IA et participent de son entrainement, il faut le préciser dans les paramètres. Chat GPT : contrôle des données > enregistrement des discussions.
Evaluation des outils IAg https://docs.google.com/spreadsheets/d/1qWTZE5uEjc9 6CdrMN8uUnwu4V8sTtr3ruOQH6gl2BMk/edit?gid=0#gi d=0
Droits d’auteurs / citation Le droit d’auteur et l’IA est une question complexe. Comment citer une production IA ? > auteur : créateur de l’IA Selon les styles, la citation sera différente : > APA : à citer dans la bibliographie : Compagnie IAg comme auteur. > Chicago : à citer uniquement dans le texte ou dans les notes. Modèle IAg comme auteur et compagnie comme éditeur
Citer une production IA Extrait diaporama JB Monat et A.I. Azilan, 2025
Déclaration d’utilisation de l’IA Il est nécessaire de spécifier l’utilisation de l’IA dans vos productions : articles, mémoires, thèse, etc. Proposition de l’Université de Montréal
IA et capacités cognitives https://www.lemonde.fr/sciences/article/2025/07/01/l-utilisation-de-chatgpt-pourrait-influencer-nos-capacitescognitives_6617187_1650684.html
Les étudiants et l’IA
ResponsibleAI Source: Standford : https://www.google.com/ url?sa=t&source=web&rct =j&opi=89978449&url=htt ps://aiindex.stanford.edu/ wpcontent/uploads/2024/05/ HAI_AI-Index-Report2024.pdf&ved=2ahUKEwi pyp7siPiKAxXKV6QEHdm MA8EQFnoECCMQAQ&us g=AOvVaw1TDFLP2mJRjdb Tqe4MK3w4