Ir para o conteúdo
Balkan Tecnologia

Respostas dos seus documentos, com a fonte ao lado

Construímos a busca que responde perguntas a partir dos documentos da sua empresa, mostra de onde tirou cada resposta e só usa o que cada pessoa pode ver.

Fio verde-menta ampliado sob uma lupa de latão, sobre uma pilha de folhas em branco.

Para quem é

Para empresas em que a resposta existe num manual, contrato ou política, mas ninguém a encontra a tempo.

O que resolve

  • A mesma pergunta chega ao jurídico ou ao suporte várias vezes por semana.
  • A informação está espalhada entre pastas, wiki, e-mails e PDFs digitalizados.
  • A busca atual só acha a palavra exata, não o assunto.
  • Um assistente genérico responde com confiança, mas não diz de onde tirou a resposta.
  • Nem todo mundo pode ver todo documento, e a busca não sabe disso.

O que fazemos

Coleta e atualização dos documentos
Pastas, wiki e sistemas lidos de forma agendada; o que muda é atualizado, o que é apagado sai do índice.
Preparação do texto
Documentos divididos em trechos, com tabelas preservadas e OCR para os digitalizados.
Busca por sentido e por termo
Busca semântica combinada com busca por palavra, para achar tanto o assunto quanto o código exato.
Resposta com fonte
Cada resposta indica o documento e o trecho usados; sem fonte suficiente, o sistema diz que não sabe.
Permissões respeitadas
A busca só considera documentos que a pessoa que pergunta já tem permissão de abrir.
Dados pessoais nos documentos
Levamos em conta a LGPD: o que entra no índice, quem consulta e por quanto tempo fica.
Perguntas de teste
Perguntas reais com respostas conferidas, usadas para medir cada mudança antes da publicação.

O que você recebe

  • API de busca pronta para o seu produto, intranet ou chat interno
  • Rotina de coleta que mantém o índice atualizado
  • Respostas com link para o documento e o trecho de origem
  • Conjunto de perguntas de teste, com relatório da qualidade das respostas
  • Registro das consultas, com acesso restrito

Como fazemos

  1. Acervo

    Que documentos entram, onde estão, quem pode ver cada um e quais têm dados pessoais.

  2. Perguntas de teste

    Reunimos com a sua equipe perguntas reais e as respostas certas.

  3. Primeira versão

    Coleta, índice e respostas com fonte para uma parte do acervo, medidos contra as perguntas.

  4. Ampliação

    O restante do acervo entra, com as permissões conferidas fonte por fonte.

  5. Acompanhamento

    Perguntas sem resposta e respostas contestadas viram novos casos de teste.

Exemplos de tecnologia

  • PostgreSQL
  • pgvector
  • OpenSearch
  • Python
  • OCR
  • OpenTelemetry

No Brasil, tratamos de

LGPD
Lei Geral de Proteção de Dados Pessoais (Lei nº 13.709/2018).

Serviços relacionados

Perguntas frequentes

E quando o documento não tem a resposta?

O sistema deve dizer que não encontrou, em vez de inventar. Isso é configurado e testado com perguntas cuja resposta não está no acervo; ainda assim pode errar, e por isso a fonte fica sempre à mão para conferir.

Funciona com PDFs digitalizados?

Funciona, com OCR. A qualidade depende da digitalização: páginas tortas, carimbos e textos à mão pioram o resultado. Avaliamos uma amostra no começo; formulários e documentos com campos fixos ficam melhor na extração de dados.

Os documentos saem da nossa empresa?

Depende do modelo escolhido. Com um provedor externo, trechos dos documentos são enviados a cada pergunta; com um modelo na sua nuvem, ficam no seu ambiente. A decisão é da sua empresa, levando em conta a LGPD.

Precisamos organizar os documentos antes?

Não precisa estar perfeito, mas versões antigas e duplicadas confundem as respostas. No levantamento do acervo apontamos o que vale limpar primeiro.

Escreva para a Balkan

Falar sobre o seu projeto