Base de connaissances et RAG

Chatbot avec vos propres données — base de connaissances et RAG

FAQ, PDF, informations produits, documents de service comme base de connaissances. L'IA répond avec précision à partir des informations de votre entreprise.

Un chatbot avec vos propres données ne répond pas uniquement à partir de connaissances linguistiques générales, mais utilise le contenu que vous fournissez spécifiquement à votre tenant. Zentor App propose trois moyens pour cela : les entrées de connaissances manuelles, le crawl d'un site web et le téléversement de fichiers. Conviennent par exemple les questions fréquentes des clients, les informations produits, les processus de service, les validations internes, les PDF, les documents HTML ou texte, ainsi que les exports WordPress. Pour le téléversement de fichiers, la taille maximale est de 100 Mo. Le crawl du site web traite jusqu'à 300 pages par exécution, respecte le fichier `robots.txt`, est limité à huit minutes et peut être relancé toutes les 24 heures.

Après leur ingestion, les contenus sont traités dans la base de connaissances du tenant concerné. La séparation s'effectue côté serveur ; les données d'un autre tenant ne doivent jamais apparaître comme source. Lors d'une requête, le chatbot recherche un contenu correspondant et n'utilise que les informations trouvées comme contexte métier. Le RAG est désactivé par défaut et doit être activé pour le tenant concerné. Ce point est important, car l'existence d'un contenu de connaissances ne signifie pas encore que le bot l'utilise activement pour répondre.

Pour obtenir de bons résultats, les contenus doivent être formulés de façon claire, à jour et sans contradiction. Une description de produit ne devrait pas mentionner simultanément deux prix ou délais de livraison différents. Des documents répétitifs, obsolètes ou partiellement valides dégradent la sélection des sources pertinentes. Avant une publication, il est donc recommandé d'effectuer un test avec des questions clients réalistes : questions de définition simples, questions de détail concrètes et cas où la réponse ne figure explicitement pas dans la base de connaissances. Le bot ne doit pas inventer d'informations manquantes, mais rester limité au contenu existant ou déclencher un transfert (handover).

La base de connaissances ne remplace pas automatiquement une maintenance éditoriale. Après des modifications apportées aux produits, contrats ou processus, les entrées concernées doivent être mises à jour ou réimportées. Vérifiez également le statut de traitement après un crawl ou un téléversement. Un document téléversé avec succès n'est utilisable qu'une fois son traitement terminé. Pour les forfaits Starter et Sur mesure (Individuell), 1 000 Mo de stockage et 100 entrées de connaissances sont enregistrés comme valeurs de forfait confirmées. Des extensions ne doivent pas être présumées tant qu'elles n'ont pas été expressément convenues.

Pour une maintenance continue, chaque source devrait avoir un responsable clair et une date de vérification. Une source obsolète est particulièrement problématique pour les prix, les conditions de livraison ou les procédures juridiques. Après une correction, il convient non seulement de remplacer l'entrée, mais aussi de vérifier si d'anciennes versions issues du crawl ou des fichiers téléversés contiennent encore la même information.

Comment fonctionne le RAG

Génération augmentée par récupération (RAG) : le chatbot effectue une recherche dans votre base de connaissances et la combine avec la compréhension linguistique de l'IA.

  • Vos documents comme source de connaissances
  • La recherche vectorielle trouve les contenus pertinents en quelques millisecondes
  • L'IA formule des réponses à partir de vos contenus
  • Traçabilité des sources : chaque réponse est vérifiable

Sources de connaissances prises en charge

Zentor App traite différents types de documents comme base pour le chatbot.

  • Documents PDF et DOCX
  • Saisies de connaissances manuelles directement dans le tableau de bord
  • Exploration du site web pour l'importation automatique de contenu
  • Listes de FAQ et jeux de données structurés

Vos données restent en sécurité

Toutes les données de connaissances sont stockées au sein de l'UE. Aucun accès de tiers externes sans consentement. Option d'hébergement sur site (On-Premises) disponible dans l'offre Sur mesure (Individuell).

Questions fréquentes

Dois-je « entraîner » le chatbot ?

Pas au sens classique du machine learning. Vous alimentez la base de connaissances avec vos documents.

Puis-je téléverser des fichiers PDF ?

Oui. Zentor App traite les PDF, les documents texte et les saisies directes.

Qu'est-ce que le RAG ?

Génération augmentée par récupération (RAG) : le chatbot effectue une recherche dans votre base de connaissances et la combine avec la compréhension linguistique de l'IA.

Les réponses sont-elles à jour ?

Aussi à jour que votre base de connaissances. Les mises à jour prennent effet immédiatement après le téléversement.

Quels types de documents sont pris en charge ?

PDF, DOCX, TXT, saisies manuelles et exploration de site web selon la configuration.

Un chatbot avec vos propres données

Découvrez comment Zentor App transforme votre base de connaissances en réponses de chatbot précises.