Base de connaissances (RAG)
Comment AskAIs apprend à partir de votre site web, de vos fichiers et de vos questions-réponses, et comment il s’en sert pour répondre.
L’agent IA répond à partir de ce que vous lui apprenez dans Training : des pages de votre site web, des fichiers que vous importez et des paires question-réponse. Quand un visiteur pose une question, AskAIs recherche les segments les plus pertinents et ne transmet que ceux-là à l’IA : les réponses viennent de votre propre contenu, pas de suppositions.
Comment lui apprendre
- Web pages : saisissez une URL et AskAIs explore votre site. Il lit 50 pages, sauf si vous choisissez un autre nombre (jusqu’à 500), et la limite de documents de votre forfait peut l’arrêter plus tôt.
- Files : importez un fichier à la fois, jusqu’à 25 Mo : PDF, DOCX, TXT, Markdown, CSV ou JSON. Les PDF doivent contenir une couche de texte (les pages numérisées ne peuvent pas être lues). Les anciens fichiers .doc, les tableurs et les présentations ne sont pas pris en charge.
- Q&A : ajoutez des paires question-réponse une par une, ou collez du texte CSV dans Bulk import (CSV).
Les fichiers et les paires de Q&A peuvent être masqués par plateforme, par exemple dans votre app iOS. Les éléments masqués ne sont pas utilisés pour répondre aux visiteurs de cette plateforme.
Ce que devient votre contenu
- AskAIs extrait le texte et le découpe en segments d’environ 2 000 caractères, avec un court chevauchement entre segments voisins. Chaque paire de Q&A reste un seul segment.
- Chaque segment reçoit un embedding (par défaut OpenAI
text-embedding-3-small) et est stocké dans PostgreSQL avec pgvector. - L’élément affiche alors Ready. Si le texte ne peut pas être lu, il affiche Failed, et vous pouvez relancer le traitement.
- Si aucun embedding ne peut être créé, les segments sont tout de même stockés et retrouvés par recherche par mots-clés.
Comment les réponses s’en servent
- Les salutations et les échanges de politesse sautent la recherche. Pour les autres messages, AskAIs lance la recherche avec les messages récents du visiteur et compare les embeddings par similarité cosinus.
- Les segments sous un seuil de similarité sont écartés. Les meilleurs sont transmis à l’IA : 5 par défaut, et au plus 2 d’un même document.
- Les segments sont ajoutés aux instructions de l’IA comme documentation de référence. L’IA a pour consigne de ne pas suivre les instructions écrites à l’intérieur, et de ne pas inventer de faits sur le produit qui n’y figurent pas ; à la place, elle pose une question ou propose de parler à une personne.
- Quand un visiteur pose une question factuelle sur le produit et que rien de pertinent n’est trouvé, AskAIs ne laisse pas l’IA deviner. Elle indique qu’elle n’a pas cette information et transfère le chat à votre équipe, sauf si le transfert automatique est désactivé.
Votre contenu peut être dans une langue et vos visiteurs dans une autre : l’IA traduit les faits qu’elle utilise dans la langue du visiteur.
Réglages
Dans Agent IA, section Base de connaissances (RAG) :
- Activer la récupération depuis la base de connaissances (RAG) : ne la désactivez que si l’IA ne doit pas du tout utiliser votre contenu, par exemple pour un bot de conversation informelle.
- Top-K segments : le nombre de segments que reçoit l’IA (5 par défaut).
- Modèle d'embedding : avec votre propre clé IA, vous pouvez aussi définir un endpoint et une clé pour les embeddings, distincts de l’endpoint de chat. Les embeddings doivent avoir 1 536 dimensions, comme
text-embedding-3-small.
IA hébergée ou votre propre clé
Avec l’IA hébergée, vous n’avez pas besoin de clé ; avec votre propre clé, votre fournisseur vous facture directement. Dans les deux cas, la limite mensuelle de réponses IA de votre forfait s’applique. Les questions répétées réutilisent un embedding de recherche mis en cache pendant 24 heures.