Au-delà des mots-clés : accéder à l'IWAC avec l'IA

Vous pouvez désormais explorer la Collection Islam Afrique de l'Ouest (CIAO) en posant vos questions en langage naturel, avec l'assistant IA que vous utilisez déjà. Deux composants ouverts le rendent possible : un serveur MCP en lecture seule, qui donne à un assistant compatible un accès structuré à la collection, et un "skill" de recherche qui lui apprend à bien chercher. Cette page présente la démarche et explique comment connecter Claude ou ChatGPT.

Pourquoi la recherche par mots-clés montre ses limites

La recherche par mots-clés est rapide et familière, mais elle apparie des chaînes de caractères plutôt que des idées. Une requête sur « hajj » ne fera pas forcément remonter les articles parlant de « pèlerinage à La Mecque » si ces mots exacts n'y figurent pas. La même chaîne « hadj » renvoie à la fois le pèlerinage et les nombreux hommes qui portent « El Hadj » comme titre honorifique. Les sources historiques aggravent le problème : variantes orthographiques, évolution de la langue et concepts qui ne correspondent pas aux termes d'aujourd'hui. Le bruit issu de l'OCR des vieilles numérisations de presse dégrade encore le texte. Comme l'observent Huistra et Mellink (2016), la numérisation de masse pousse les chercheurs à aborder les sources « par des mots précis », ce qui laisse les résultats à la merci de l'outil de recherche. La recherche par mots-clés suppose aussi que l'on sache déjà comment la collection est organisée, quels termes elle emploie et quels pays elle couvre bien. La plupart des utilisateurs l'ignorent.

Pourquoi ne pas simplement interroger un chatbot ?

De plus en plus, les internautes posent leur question directement à un chatbot commercial plutôt qu'à un moteur de recherche. Interrogez-en un sur l'islam en Afrique de l'Ouest et la réponse sera le plus souvent générique, parfois stéréotypée : la région est faiblement représentée dans les données d'entraînement de ces modèles, qui se rabattent alors sur des généralités et, au pire, inventent leurs sources. La CIAO est en libre accès, et au cours de la dernière année des robots d'IA, venus en grande partie des États-Unis et de Chine, ont moissonné le site à de multiples reprises. Pourtant, malgré tout ce trafic, les chatbots puisent à peine dans la collection et la citent rarement. Ils savent aspirer la CIAO ; ils ne savent pas s'en servir.

Une autre porte d'entrée : un serveur et un skill

Plutôt qu'un chatbot unique, la CIAO s'ouvre à l'IA par deux couches qui fonctionnent avec l'assistant de votre choix.

Le serveur MCP — la plomberie

Le Model Context Protocol (MCP) est une norme ouverte, publiée en novembre 2024, qui relie un assistant IA à une source de données extérieure au moyen d'un ensemble défini de requêtes appelées outils. Si vous avez déjà autorisé un assistant à lire votre messagerie ou votre agenda, vous avez utilisé un serveur MCP. Le serveur de la CIAO propose plus de vingt outils en lecture seule : rechercher dans les articles de presse, en lire un intégralement, consulter la notice d'une personne ou d'une organisation, comparer la couverture entre pays, ou consulter l'analyse de sentiment déjà calculée pour chaque article. Le principe est le même que celui de IIIF pour les images : une interface partagée qui permet à d'autres de se servir de la collection sans en prendre possession.

Le skill de recherche — la méthode

Un SKILL.md est un ensemble d'instructions en langage clair qui apprend aux agents IA à bien se servir de ces outils. Le skill de la CIAO encode une méthode de recherche en cinq phases inspirée de la pratique archivistique : établir ce que contient la collection avant de chercher ; chercher systématiquement en français, avec des variantes de translittération pour les termes arabo-islamiques (Tabaski pour l'Aïd el-Kébir, Maouloud pour Mawlid) ; lire intégralement les sources les plus pertinentes ; recouper articles, publications et références ; puis restituer les résultats avec leurs sources et un niveau de confiance. À chaque réponse, le skill signale aussi les lacunes de la collection, de sa prédominance francophone à la faible couverture du Niger et à l'absence de presse nigériane, afin que l'assistant ne fasse jamais passer un corpus partiel pour l'ensemble.

Chaque résultat renvoie à la notice d'origine sur islam.zmo.de, de sorte que vous pouvez vérifier toute affirmation à sa source. Le serveur ne génère rien lorsque vous posez une question : il se contente de retrouver ce que la collection contient déjà. L'assistant travaille à partir de l'archive elle-même, plutôt que de ses données d'entraînement, si bien que ses réponses restent ancrées dans des sources vérifiables.

Ce que vous pouvez demander

Une fois connecté, vous pouvez poser à la collection des questions comme :

  • « Comment la presse béninoise a-t-elle couvert la Tabaski ? »
  • « Compare la couverture médiatique de l'islam en Côte d'Ivoire, au Burkina Faso et au Bénin. »
  • « Trouve des références universitaires sur Izala au Niger, en français et en anglais. »
  • « Résume ce que contient la collection sur les débats autour de la laïcité dans les années 1990. »

Vous formulez votre demande en langage naturel et l'assistant détermine quels outils appeler et comment combiner les filtres. Vous pouvez interroger en français ou en anglais. La plupart des sources de presse sont en français et l'assistant les interroge en français quelle que soit la langue de votre question.

Comment se connecter

Il existe deux façons de se connecter, selon l'assistant que vous utilisez. Les noms de menus ci-dessous sont donnés tels qu'ils apparaissent dans l'interface en anglais ; ils peuvent différer si l'application est réglée en français.

Claude Desktop (s'exécute sur votre ordinateur)

Recommandé pour la plupart des utilisateurs. L'installation se fait en un clic, sans ligne de commande, et comprend l'ensemble des outils ainsi que le skill de recherche.

  1. Ouvrez la page des versions et téléchargez le paquet correspondant à votre système d'exploitation : iwac-mcp-server-windows.mcpb pour Windows, ou iwac-mcp-server-macos.mcpb pour macOS. (Claude Desktop n'existe pas sous Linux ; il n'y a donc pas de paquet Linux.)
  2. Double-cliquez sur le fichier. Claude Desktop ouvre une fenêtre d'installation : vérifiez les détails et cliquez sur Install. Vous pouvez aussi glisser le fichier sur Settings → Extensions.
  3. À votre première question, le serveur télécharge environ 250 Mo de données depuis Hugging Face sur votre ordinateur. Les recherches sont ensuite rapides et locales.

Ajoutez le skill de recherche (vivement recommandé). Téléchargez iwac-mcp-skill.zip depuis la même version. Dans Claude Desktop, ouvrez Customize → Skills → + → Create skill → Upload a skill et sélectionnez le zip. Une fois le skill installé, il vous suffit de poser votre question : Claude planifie les recherches pour vous.

Facultatif — la recherche par le sens. Vingt outils fonctionnent d'emblée. Deux autres trouvent les articles et les publications par le sens (embeddings sémantiques) plutôt que par mots-clés : ils font remonter un texte traitant d'une idée même lorsqu'il n'emploie pas vos mots exacts. Désactivés par défaut, ils nécessitent une clé Google AI Studio gratuite, que vous collez dans les réglages de l'extension. La plupart des utilisateurs n'en ont pas besoin.

ChatGPT

Le serveur est également hébergé en ligne : vous pouvez l'ajouter à ChatGPT comme connecteur personnalisé. Il faut un abonnement payant (Plus, Pro, Business, Enterprise ou Edu) et ChatGPT sur le web, à l'adresse chatgpt.com. Le connecteur est en lecture seule et ne demande ni identifiant ni clé d'API.

  1. Activez le mode développeur dans Settings → Apps & Connectors → Advanced settings. Selon votre compte, cette section peut s'intituler « Apps » ou « Connectors ».
  2. Dans Apps & Connectors, cliquez sur Create, puis renseignez :
    • Name : CIAO
    • MCP Server URL : https://islam.zmo.de/mcp/
    • Authentication : No authentication
  3. Enregistrez. ChatGPT se connecte au serveur et liste ses outils.
  4. Dans une conversation, ouvrez le menu + → Developer mode et cochez CIAO, puis posez votre question. Nommer le connecteur dans votre requête aide : par exemple, « En utilisant le connecteur CIAO, trouve la couverture de presse de… ». Le mode recherche approfondie (deep research) de ChatGPT peut utiliser le même connecteur pour trouver et lire des sources, puis citer les liens CIAO dans son rapport.

ChatGPT ne peut pas charger le skill de recherche. Le serveur intègre toutefois l'essentiel des consignes, dont les translittérations françaises et les mises en garde sur la couverture.

Ce qu'il fait, et ce qu'il ne fait pas

Cette démarche élargit l'accès. Vous pouvez interroger en langage naturel, suivre une question où qu'elle mène et atteindre des documents que la recherche par mots-clés laisserait échapper, chaque affirmation restant traçable jusqu'à sa source.

Elle ne remplace pas une recherche rigoureuse. Ancrer l'assistant dans la collection transforme le risque d'erreur plutôt qu'il ne l'élimine : l'assistant peut encore mal lire une source, traiter comme interchangeables des termes qui ne le sont pas (intégrisme, fondamentalisme et salafisme recouvrent de vraies différences), ou laisser croire que l'archive parle d'elle-même. Les réponses ne valent que ce que valent les métadonnées qui les sous-tendent, et la collection demeure partielle, façonnée par ce qui a été numérisé, dans quelle langue et depuis quel pays. Elle soutient l'exploration et la lecture distante et complète la lecture rapprochée et votre propre jugement.

Et ensuite ?

Un assistant conversationnel est prévu pour le site de la CIAO lui-même : il fera tourner un modèle open source sur ces mêmes outils, de sorte que consulter la collection ne nécessitera ni abonnement ni compte auprès d'un service d'IA commercial.