Organize os documentos primeiro
Eu não construiria uma base de conhecimento a partir da pasta inteira da empresa. Eu reuniria primeiro um conjunto curto de documentos aprovados com responsável e data, porque a busca em um arquivo velho faz o erro soar convincente.
O erro que eu eliminaria primeiro: As pessoas tentam consertar uma base ruim com um prompt longo. Mas se ela guarda duas respostas diferentes para a mesma pergunta, o modelo não saberá qual está atual até você adicionar regras de frescor.

O que preparar e qual resultado esperar
- Resultado: O assistente responde a partir da versão certa do documento e pode mostrar de onde veio a regra, em vez de recontar com confiança um arquivo antigo.
- Monte um registro de documentos: nome, tipo, versão, responsável, data de atualização, público, acesso e próxima data de revisão.
- Mantenha os dados de origem e os direitos de acesso separados da saída para auditar o que a knowledge base for the AI assistant fez.
- Crie testes para uma pergunta exata, um conflito entre duas versões, uma resposta ausente e um documento restrito.
Construa uma base que você consiga continuar atualizando
- Remova lixo antes do upload
Não adicione ao índice duplicatas, rascunhos nem documentos sem responsável. Primeiro escolha uma fonte atual para cada regra.
Проверьте: Todo documento tem um responsável e uma data de revisão.
Если не сработало: Mova arquivos duvidosos para quarentena em vez de apagá-los sem critério.
- Adicione metadados de acesso
Para cada registro, armazene department, region, product e access level. A busca deve filtrar o documento antes de o texto chegar ao contexto do modelo.
Проверьте: Um usuário não recebe um fragmento de um documento ao qual não tem acesso.
Если не сработало: Comece com uma pasta compartilhada sem dados sensíveis.
- Escreva respostas ancoradas em um fragmento
Na instrução, defina o formato: resposta, documento, versão, o que fazer em conflito. Não peça citações se a fonte nunca entrou no contexto.
Проверьте: A resposta inclui um link ou o nome da fonte.
Если не сработало: Torne a resposta um rascunho e mostre os fragmentos encontrados a uma pessoa.
- Faça uma revisão guiada por perguntas
Uma vez por semana, revise perguntas sem resposta, documentos desatualizados e casos em que um funcionário corrigiu o assistente. Atualize a fonte, não só o prompt.
Проверьте: Cada erro vira mudança de documento ou de teste.
Если не сработало: Atribua um responsável da base e uma data de revisão no calendário.

Cartão mínimo do documento
Para cada arquivo armazene doc_id, title, source_url, owner, valid_from, valid_to, audience, access_level e status: draft, approved, archived. Antes da busca, filtre documentos arquivados e documentos aos quais o usuário não tem acesso.
Divida instruções longas por sentido, não a cada 500 caracteres. Mantenha product, region e date no título do fragmento para não misturar uma política de devolução de um país com a regra de outro.
- Toda resposta precisa de um link para o fragmento de origem.
- Uma pergunta que a base não consegue responder deve ir para uma fila de atualização.
Como aceitar a base antes do lançamento
Monte 20 perguntas de teste: comuns, sinônimos, regras conflitantes, documento vencido e pedido sem acesso. Para cada uma, registre expected_source e expected_answer. Isso valida a precisão da busca e o controle de acesso, não o quão «inteligente» a IA soa.
Um documento precisa de responsável e de vida útil
Adicione `doc_id`, `title`, `source_url`, `owner`, `valid_from`, `valid_to`, `audience`, `access_level` e `status = draft/approved/archived`. Antes da busca, exclua o arquivo e documentos sem direitos de acesso. Divida uma instrução longa por sentido, não aleatoriamente a cada 500 caracteres.
Monte 20 perguntas de teste: comum, sinônimo, regras conflitantes, documento vencido e sem acesso. Para cada uma, armazene `expected_source` e `expected_answer`. A base está pronta quando você consegue explicar de onde veio a resposta e quem vai atualizar o documento depois de um erro.
Como saber se uma fonte é segura para dar à IA
| Critério | Pergunta | Bom sinal |
|---|---|---|
| Entrada | O que exatamente entra na knowledge base for the AI assistant? | Monte um registro de documentos: nome, tipo, versão, responsável, data de atualização, público, acesso e próxima data de revisão. |
| Ação | O que o sistema pode fazer sozinho? | Apenas ações pré-listadas, sem acesso a toda a conta |
| Verificação | Como você sabe que o resultado é aceitável? | Crie testes para uma pergunta exata, um conflito entre duas versões, uma resposta ausente e um documento restrito. |
| Falha | Para onde vai um caso pouco claro? | Retorne «não encontrado» e passe a pergunta ao responsável da base — não peça ao modelo para preencher a lacuna com conhecimento geral. |
O que deve mudar depois da configuração
O assistente responde a partir da versão certa do documento e pode mostrar de onde veio a regra, em vez de recontar com confiança um arquivo antigo.

Por que o assistente cita com confiança regras antigas
Indexar uma pasta de rascunhos e versões desatualizadas.
Confiar em um prompt em vez de um filtro de acesso.
Não mostrar ao usuário a fonte da resposta.
Atualizar só o vector store sem um responsável pelo documento de origem.
Quando uma base de conhecimento vira um sistema separado
Você precisa de um especialista quando a base guarda dados pessoais, vários níveis de acesso, dezenas de fontes ou precisa passar por auditoria.
O que testar antes de conectar o time
Para quem é essa abordagem com uma base de conhecimento para o assistente de IA?
Uma base de conhecimento não é uma pasta de arquivos. Ela precisa de documentos atuais, responsáveis claros, metadados e uma regra do que fazer quando nenhuma resposta for encontrada.
Por onde começar se tudo ainda é manual?
Monte um registro de documentos: nome, tipo, versão, responsável, data de atualização, público, acesso e próxima data de revisão.
Como verificar se a configuração não vai causar dano?
Crie testes para uma pergunta exata, um conflito entre duas versões, uma resposta ausente e um documento restrito.
O que fazer com um resultado pouco claro?
Retorne «não encontrado» e passe a pergunta ao responsável da base — não peça ao modelo para preencher a lacuna com conhecimento geral.







