Base de conhecimento (RAG)
Como o AskAIs aprende com seu site, seus arquivos e suas perguntas e respostas, e como usa esse conteúdo ao responder.
O agente de IA responde com base no que você ensina a ele em Training: páginas do seu site, arquivos que você envia e pares de pergunta e resposta. Quando um visitante pergunta algo, o AskAIs busca os trechos mais relevantes e passa só esses trechos para a IA, então as respostas vêm do seu próprio conteúdo, e não de palpites.
Formas de ensinar
- Web pages: informe uma URL e o AskAIs rastreia seu site. Ele lê 50 páginas, a menos que você defina outro número (até 500), e o limite de documentos do seu plano pode fazê-lo parar antes.
- Files: envie um arquivo por vez, de até 25 MB: PDF, DOCX, TXT, Markdown, CSV ou JSON. PDFs precisam ter uma camada de texto (páginas digitalizadas não podem ser lidas). Arquivos .doc antigos, planilhas e apresentações não são suportados.
- Q&A: adicione pares de pergunta e resposta um a um ou cole texto CSV em Bulk import (CSV).
Arquivos e pares de Q&A podem ser ocultados por plataforma, por exemplo no seu app iOS. Itens ocultos não são usados nas respostas para visitantes dessa plataforma.
O que acontece com o seu conteúdo
- O AskAIs extrai o texto e o divide em trechos de cerca de 2.000 caracteres, com uma pequena sobreposição entre trechos vizinhos. Cada par de Q&A continua sendo um único trecho.
- Cada trecho recebe um embedding (por padrão,
text-embedding-3-smallda OpenAI) e é armazenado no PostgreSQL com pgvector. - Em seguida, o item mostra Ready. Se o texto não puder ser lido, ele mostra Failed, e você pode tentar de novo.
- Se não for possível gerar um embedding, os trechos ainda são armazenados e encontrados por busca por palavra-chave.
Como as respostas usam o conteúdo
- Saudações e conversa fiada pulam a busca. Para as demais mensagens, o AskAIs busca com as mensagens recentes do visitante e compara embeddings por similaridade de cosseno.
- Trechos abaixo de um limite de similaridade são descartados. Os melhores vão para a IA: 5 por padrão, e no máximo 2 de um mesmo documento.
- Os trechos são adicionados às instruções da IA como material de referência. A IA é instruída a não seguir instruções escritas dentro deles e a não inventar fatos sobre o produto que eles não contêm; em vez disso, ela faz uma pergunta ou oferece falar com uma pessoa.
- Quando um visitante pergunta sobre um fato do produto e nada relevante é encontrado, o AskAIs não deixa a IA adivinhar. Ela diz que não tem essa informação e passa o chat para a sua equipe, a menos que a transferência automática esteja desativada.
Seu conteúdo pode estar em um idioma e seus visitantes falarem outro: a IA traduz os fatos que usa para o idioma do visitante.
Configurações
Em Agente de IA, na seção Base de conhecimento (RAG):
- Ativar recuperação da base de conhecimento (RAG): desative apenas se a IA não deve usar seu conteúdo de forma alguma, por exemplo em um bot de conversa informal.
- Trechos Top-K: quantos trechos a IA recebe (padrão: 5).
- Modelo de embedding: com sua própria chave de IA, você também pode definir um endpoint e uma chave de embedding, separados do endpoint de chat. Os embeddings precisam ter 1.536 dimensões, como os do
text-embedding-3-small.
IA hospedada ou sua própria chave
Com a IA hospedada, você não precisa de chave; com sua própria chave, o provedor cobra você diretamente. Em qualquer caso, vale o limite mensal de respostas de IA do seu plano. Perguntas repetidas reutilizam um embedding de busca em cache por 24 horas.