Guías

Base de conocimientos (RAG)

Cómo aprende AskAIs de tu sitio web, tus archivos y tus preguntas y respuestas, y cómo los usa al responder.

El agente de IA responde con lo que le enseñas en Training: páginas de tu sitio web, archivos que subes y pares de pregunta y respuesta. Cuando un visitante pregunta algo, AskAIs busca los fragmentos más relevantes y le pasa a la IA solo esos, así que las respuestas salen de tu propio contenido y no de suposiciones.

Formas de enseñarle

  • Web pages: introduce una URL y AskAIs rastrea tu sitio. Lee 50 páginas salvo que indiques otro número (hasta 500), y el límite de documentos de tu plan puede detenerlo antes.
  • Files: sube un archivo cada vez, de hasta 25 MB: PDF, DOCX, TXT, Markdown, CSV o JSON. Los PDF necesitan una capa de texto (las páginas escaneadas no se pueden leer). No se admiten los archivos .doc antiguos, las hojas de cálculo ni las presentaciones.
  • Q&A: añade pares de pregunta y respuesta uno a uno, o pega texto CSV en Bulk import (CSV).

Los archivos y los pares de pregunta y respuesta se pueden ocultar por plataforma, por ejemplo en tu app de iOS. Los elementos ocultos no se usan en las respuestas a los visitantes de esa plataforma.

Qué pasa con tu contenido

  • AskAIs extrae el texto y lo divide en fragmentos de unos 2000 caracteres, con un pequeño solapamiento entre fragmentos vecinos. Cada par de pregunta y respuesta queda como un solo fragmento.
  • Cada fragmento recibe un embedding (por defecto, text-embedding-3-small de OpenAI) y se guarda en PostgreSQL con pgvector.
  • Después, el elemento muestra Ready. Si el texto no se puede leer, muestra Failed y puedes volver a intentarlo.
  • Si no se puede generar un embedding, los fragmentos se guardan igualmente y se encuentran mediante búsqueda por palabras clave.

Cómo se usa al responder

  • Los saludos y la charla trivial no pasan por la búsqueda. Para los demás mensajes, AskAIs busca con los mensajes recientes del visitante y compara embeddings por similitud de coseno.
  • Los fragmentos por debajo de un umbral de similitud se descartan. Los mejores van a la IA: 5 por defecto, y como máximo 2 de un mismo documento.
  • Los fragmentos se añaden a las instrucciones de la IA como material de referencia. Se le indica a la IA que no siga instrucciones escritas dentro de ellos y que no invente datos del producto que no contengan; en su lugar, hace una pregunta u ofrece hablar con una persona.
  • Cuando un visitante pregunta por un dato del producto y no se encuentra nada relevante, AskAIs no deja que la IA adivine. Responde que no tiene esa información y pasa el chat a tu equipo, salvo que el traspaso automático esté desactivado.

Tu contenido puede estar en un idioma y tus visitantes hablar otro: la IA traduce los datos que usa al idioma del visitante.

Configuración

En Agente de IA, en la sección Base de conocimientos (RAG):

  • Habilitar recuperación de la base de conocimientos (RAG): desactívalo solo si la IA no debe usar tu contenido en absoluto, por ejemplo en un bot de charla trivial.
  • Fragmentos Top-K: cuántos fragmentos recibe la IA (5 por defecto).
  • Modelo de embeddings: con tu propia clave de IA también puedes configurar un endpoint y una clave para embeddings, distintos del endpoint de chat. Los embeddings deben tener 1536 dimensiones, como text-embedding-3-small.

IA alojada o tu propia clave

Con la IA alojada no necesitas clave; con tu propia clave, tu proveedor te factura directamente. En ambos casos se aplica el límite mensual de respuestas de IA de tu plan. Las preguntas repetidas reutilizan un embedding de búsqueda guardado en caché durante 24 horas.