Comment construire une base de connaissances pour un assistant IA ?

Lien copié

Une base de connaissances n’est pas un dossier de fichiers. Elle a besoin de documents à jour, de responsables clairs, de métadonnées et d’une règle sur quoi faire quand aucune réponse n’est trouvée.

Visuel de couverture

Mettre d’abord les documents en ordre

Je ne construirais pas une base de connaissances à partir de tout le dossier de l’entreprise. Je rassemblerais d’abord un court jeu de documents validés avec responsable et date, car la recherche sur un fichier périmé rend l’erreur convaincante.

L’erreur que j’éliminerais d’abord : On tente de réparer une mauvaise base avec un long prompt. Mais si elle contient deux réponses différentes à une même question, le modèle ne saura pas laquelle est actuelle tant que vous n’ajoutez pas de règles de fraîcheur.

Visuel 01
Visuel 01

Que préparer et quel résultat attendre

  • Résultat : L’assistant répond depuis la bonne version de document et peut montrer d’où vient la règle, au lieu de raconter avec assurance un vieux fichier.
  • Construisez un registre de documents : nom, type, version, responsable, date de mise à jour, audience, accès et prochaine date de revue.
  • Gardez les données source et les droits d’accès séparés de la sortie pour pouvoir auditer ce qu’a fait la knowledge base for the AI assistant.
  • Créez des tests pour une question exacte, un conflit entre deux versions, une réponse manquante et un document restreint.

Construire une base que l’on peut continuer de mettre à jour

  1. Retirer le bruit avant l’upload

    N’ajoutez pas au index doublons, brouillons ni documents sans responsable. Choisissez d’abord une source actuelle pour chaque règle.

    Проверьте: Chaque document a un responsable et une date de révision.

    Если не сработало: Mettez les fichiers douteux en quarantaine plutôt que de les supprimer au hasard.

  2. Ajouter des métadonnées d’accès

    Pour chaque enregistrement, stockez department, region, product et access level. La recherche doit filtrer le document avant que le texte n’atteigne le contexte du modèle.

    Проверьте: Un utilisateur ne reçoit pas un fragment d’un document auquel il n’a pas accès.

    Если не сработало: Commencez par un dossier partagé sans données sensibles.

  3. Écrire des réponses ancrées à un fragment

    Dans l’instruction, fixez le format : réponse, document, version, que faire en cas de conflit. Ne demandez pas de citations si la source n’est jamais entrée dans le contexte.

    Проверьте: La réponse inclut un lien ou le nom de la source.

    Если не сработало: Faites de la réponse un brouillon et montrez les fragments trouvés à un humain.

  4. Faire une revue pilotée par les questions

    Une fois par semaine, relisez les questions sans réponse, les documents périmés et les cas où un employé a corrigé l’assistant. Mettez à jour la source, pas seulement le prompt.

    Проверьте: Chaque erreur devient un changement de document ou de test.

    Если не сработало: Assignez un responsable de la base et une date de revue au calendrier.

Visuel 02
Visuel 02

Fiche document minimale

Pour chaque fichier, stockez doc_id, title, source_url, owner, valid_from, valid_to, audience, access_level et status : draft, approved, archived. Avant la recherche, filtrez les documents archivés et ceux auxquels l’utilisateur n’a pas accès.

Découpez les longues instructions par sens, pas tous les 500 caractères. Gardez product, region et date dans le titre du fragment pour ne pas mélanger une politique de retour d’un pays avec la règle d’un autre.

  • Chaque réponse a besoin d’un lien vers le fragment source.
  • Une question que la base ne peut pas répondre doit aller dans une file de mise à jour.

Comment accepter la base avant le lancement

Construisez 20 questions de test : ordinaires, synonymes, règles en conflit, document expiré et demande hors accès. Pour chacune, enregistrez expected_source et expected_answer. Cela valide la précision de la recherche et le contrôle d’accès, pas le côté « intelligent » de l’IA.

Un document a besoin d’un responsable et d’une durée de vie

Ajoutez `doc_id`, `title`, `source_url`, `owner`, `valid_from`, `valid_to`, `audience`, `access_level` et `status = draft/approved/archived`. Avant la recherche, excluez l’archive et les documents sans droits d’accès. Découpez une longue instruction par sens, pas au hasard tous les 500 caractères.

Construisez 20 questions de test : ordinaire, synonyme, règles en conflit, document expiré et hors accès. Pour chacune, stockez `expected_source` et `expected_answer`. La base est prête quand vous pouvez expliquer d’où vient la réponse et qui mettra à jour le document après une erreur.

Comment savoir qu’une source est sûre pour l’IA

CritèreQuestionBon signe
EntréeQu’est-ce qui entre exactement dans la knowledge base for the AI assistant ?Construisez un registre de documents : nom, type, version, responsable, date de mise à jour, audience, accès et prochaine date de revue.
ActionQue le système a-t-il le droit de faire seul ?Uniquement des actions prélistées, sans accès à tout le compte
ContrôleComment savoir que le résultat est acceptable ?Créez des tests pour une question exacte, un conflit entre deux versions, une réponse manquante et un document restreint.
ÉchecOù va un cas peu clair ?Renvoyez « non trouvé » et transmettez la question au responsable de la base — ne demandez pas au modèle de combler le trou avec des connaissances générales.

Ce qui doit changer après la mise en place

L’assistant répond depuis la bonne version de document et peut montrer d’où vient la règle, au lieu de raconter avec assurance un vieux fichier.

Visuel 03
Visuel 03

Pourquoi l’assistant cite avec assurance d’anciennes règles

Lancer avant que les données d’entrée soient prêtes

Indexer un dossier de brouillons et de versions obsolètes.

Accorder trop de permissions

Compter sur un prompt plutôt que sur un filtre d’accès.

Ignorer les cas limites

Ne pas montrer à l’utilisateur la source de la réponse.

Laisser les échecs sans responsable

Mettre à jour seulement le vector store sans responsable du document source.

Quand une base de connaissances devient un système à part

Vous avez besoin d’un spécialiste quand la base contient des données personnelles, plusieurs niveaux d’accès, des dizaines de sources, ou doit passer un audit.

Que tester avant de brancher l’équipe

Pour qui est cette approche pour une base de connaissances d’assistant IA ?

Une base de connaissances n’est pas un dossier de fichiers. Elle a besoin de documents à jour, de responsables clairs, de métadonnées et d’une règle sur quoi faire quand aucune réponse n’est trouvée.

Par où commencer si tout est encore manuel ?

Construisez un registre de documents : nom, type, version, responsable, date de mise à jour, audience, accès et prochaine date de revue.

Comment vérifier que le dispositif ne fera pas de dégâts ?

Créez des tests pour une question exacte, un conflit entre deux versions, une réponse manquante et un document restreint.

Que faire d’un résultat peu clair ?

Renvoyez « non trouvé » et transmettez la question au responsable de la base — ne demandez pas au modèle de combler le trou avec des connaissances générales.

Agents et intégrations IA

Quand un agent est utile, comment relier les données et les outils, et où garder un contrôle humain.

Visuel de couverture
Agents et intégrations IA 7 min de lecture

Qu’est-ce qu’un agent IA et à quoi sert-il pour une PME ?

Pour « Qu’est-ce qu’un agent IA et à quoi sert-il pour une PME ? », précisez les entrées, les actions autorisées, le point de contrôle et le résultat métier avant de choisir un modèle ou une intégration.

informatifLire ↗
Visuel de couverture
Agents et intégrations IA 7 min de lecture

Agent IA, chatbot ou automatisation classique : que choisir ?

Pour « Agent IA, chatbot ou automatisation classique : que choisir ? », précisez les entrées, les actions autorisées, le point de contrôle et le résultat métier avant de choisir un modèle ou une intégration.

commercialLire ↗
Visuel de couverture
Agents et intégrations IA 7 min de lecture

Comment connecter l’IA aux fichiers, au CRM, à l’agenda et à l’email ?

Pour « Comment connecter l’IA aux fichiers, au CRM, à l’agenda et à l’email ? », précisez les entrées, les actions autorisées, le point de contrôle et le résultat métier avant de choisir un modèle ou une intégration.

commercialLire ↗
Visuel de couverture
Agents et intégrations IA 7 min de lecture

MCP, n8n, Make ou Zapier : quel choix pour une entreprise ?

Pour « MCP, n8n, Make ou Zapier : quel choix pour une entreprise ? », précisez les entrées, les actions autorisées, le point de contrôle et le résultat métier avant de choisir un modèle ou une intégration.

commercialLire ↗

Voir tous les articles