Respostas dos seus documentos, com a fonte ao lado
Construímos a busca que responde perguntas a partir dos documentos da sua empresa, mostra de onde tirou cada resposta e só usa o que cada pessoa pode ver.

Para quem é
Para empresas em que a resposta existe num manual, contrato ou política, mas ninguém a encontra a tempo.
O que resolve
- A mesma pergunta chega ao jurídico ou ao suporte várias vezes por semana.
- A informação está espalhada entre pastas, wiki, e-mails e PDFs digitalizados.
- A busca atual só acha a palavra exata, não o assunto.
- Um assistente genérico responde com confiança, mas não diz de onde tirou a resposta.
- Nem todo mundo pode ver todo documento, e a busca não sabe disso.
O que fazemos
- Coleta e atualização dos documentos
- Pastas, wiki e sistemas lidos de forma agendada; o que muda é atualizado, o que é apagado sai do índice.
- Preparação do texto
- Documentos divididos em trechos, com tabelas preservadas e OCR para os digitalizados.
- Busca por sentido e por termo
- Busca semântica combinada com busca por palavra, para achar tanto o assunto quanto o código exato.
- Resposta com fonte
- Cada resposta indica o documento e o trecho usados; sem fonte suficiente, o sistema diz que não sabe.
- Permissões respeitadas
- A busca só considera documentos que a pessoa que pergunta já tem permissão de abrir.
- Dados pessoais nos documentos
- Levamos em conta a LGPD: o que entra no índice, quem consulta e por quanto tempo fica.
- Perguntas de teste
- Perguntas reais com respostas conferidas, usadas para medir cada mudança antes da publicação.
O que você recebe
- API de busca pronta para o seu produto, intranet ou chat interno
- Rotina de coleta que mantém o índice atualizado
- Respostas com link para o documento e o trecho de origem
- Conjunto de perguntas de teste, com relatório da qualidade das respostas
- Registro das consultas, com acesso restrito
Como fazemos
Acervo
Que documentos entram, onde estão, quem pode ver cada um e quais têm dados pessoais.
Perguntas de teste
Reunimos com a sua equipe perguntas reais e as respostas certas.
Primeira versão
Coleta, índice e respostas com fonte para uma parte do acervo, medidos contra as perguntas.
Ampliação
O restante do acervo entra, com as permissões conferidas fonte por fonte.
Acompanhamento
Perguntas sem resposta e respostas contestadas viram novos casos de teste.
Exemplos de tecnologia
- PostgreSQL
- pgvector
- OpenSearch
- Python
- OCR
- OpenTelemetry
No Brasil, tratamos de
- LGPD
- Lei Geral de Proteção de Dados Pessoais (Lei nº 13.709/2018).
Serviços relacionados
Perguntas frequentes
E quando o documento não tem a resposta?
O sistema deve dizer que não encontrou, em vez de inventar. Isso é configurado e testado com perguntas cuja resposta não está no acervo; ainda assim pode errar, e por isso a fonte fica sempre à mão para conferir.
Funciona com PDFs digitalizados?
Funciona, com OCR. A qualidade depende da digitalização: páginas tortas, carimbos e textos à mão pioram o resultado. Avaliamos uma amostra no começo; formulários e documentos com campos fixos ficam melhor na extração de dados.
Os documentos saem da nossa empresa?
Depende do modelo escolhido. Com um provedor externo, trechos dos documentos são enviados a cada pergunta; com um modelo na sua nuvem, ficam no seu ambiente. A decisão é da sua empresa, levando em conta a LGPD.
Precisamos organizar os documentos antes?
Não precisa estar perfeito, mas versões antigas e duplicadas confundem as respostas. No levantamento do acervo apontamos o que vale limpar primeiro.
Escreva para a Balkan
Falar sobre o seu projeto