Guias

Base de conhecimento (RAG)

Como o AskAIs aprende com seu site, seus arquivos e suas perguntas e respostas, e como usa esse conteúdo ao responder.

O agente de IA responde com base no que você ensina a ele em Training: páginas do seu site, arquivos que você envia e pares de pergunta e resposta. Quando um visitante pergunta algo, o AskAIs busca os trechos mais relevantes e passa só esses trechos para a IA, então as respostas vêm do seu próprio conteúdo, e não de palpites.

Formas de ensinar

  • Web pages: informe uma URL e o AskAIs rastreia seu site. Ele lê 50 páginas, a menos que você defina outro número (até 500), e o limite de documentos do seu plano pode fazê-lo parar antes.
  • Files: envie um arquivo por vez, de até 25 MB: PDF, DOCX, TXT, Markdown, CSV ou JSON. PDFs precisam ter uma camada de texto (páginas digitalizadas não podem ser lidas). Arquivos .doc antigos, planilhas e apresentações não são suportados.
  • Q&A: adicione pares de pergunta e resposta um a um ou cole texto CSV em Bulk import (CSV).

Arquivos e pares de Q&A podem ser ocultados por plataforma, por exemplo no seu app iOS. Itens ocultos não são usados nas respostas para visitantes dessa plataforma.

O que acontece com o seu conteúdo

  • O AskAIs extrai o texto e o divide em trechos de cerca de 2.000 caracteres, com uma pequena sobreposição entre trechos vizinhos. Cada par de Q&A continua sendo um único trecho.
  • Cada trecho recebe um embedding (por padrão, text-embedding-3-small da OpenAI) e é armazenado no PostgreSQL com pgvector.
  • Em seguida, o item mostra Ready. Se o texto não puder ser lido, ele mostra Failed, e você pode tentar de novo.
  • Se não for possível gerar um embedding, os trechos ainda são armazenados e encontrados por busca por palavra-chave.

Como as respostas usam o conteúdo

  • Saudações e conversa fiada pulam a busca. Para as demais mensagens, o AskAIs busca com as mensagens recentes do visitante e compara embeddings por similaridade de cosseno.
  • Trechos abaixo de um limite de similaridade são descartados. Os melhores vão para a IA: 5 por padrão, e no máximo 2 de um mesmo documento.
  • Os trechos são adicionados às instruções da IA como material de referência. A IA é instruída a não seguir instruções escritas dentro deles e a não inventar fatos sobre o produto que eles não contêm; em vez disso, ela faz uma pergunta ou oferece falar com uma pessoa.
  • Quando um visitante pergunta sobre um fato do produto e nada relevante é encontrado, o AskAIs não deixa a IA adivinhar. Ela diz que não tem essa informação e passa o chat para a sua equipe, a menos que a transferência automática esteja desativada.

Seu conteúdo pode estar em um idioma e seus visitantes falarem outro: a IA traduz os fatos que usa para o idioma do visitante.

Configurações

Em Agente de IA, na seção Base de conhecimento (RAG):

  • Ativar recuperação da base de conhecimento (RAG): desative apenas se a IA não deve usar seu conteúdo de forma alguma, por exemplo em um bot de conversa informal.
  • Trechos Top-K: quantos trechos a IA recebe (padrão: 5).
  • Modelo de embedding: com sua própria chave de IA, você também pode definir um endpoint e uma chave de embedding, separados do endpoint de chat. Os embeddings precisam ter 1.536 dimensões, como os do text-embedding-3-small.

IA hospedada ou sua própria chave

Com a IA hospedada, você não precisa de chave; com sua própria chave, o provedor cobra você diretamente. Em qualquer caso, vale o limite mensal de respostas de IA do seu plano. Perguntas repetidas reutilizam um embedding de busca em cache por 24 horas.