O problema: a resposta existe, mas ninguém a encontra
Uma empresa de construção e topografia vive de pequenos dados. Quando chega o aço. O que dizia o último levantamento. Quem orçou o quê, e quando.
Esses dados existem. Só estão espalhados:
- Mensagens de voz gravadas a caminhar pela obra
- Fotos de um desenho anotado
- Folhas de cálculo enviadas por email uma vez e nunca mais abertas
- PDF de fornecedores e do cadastro
- Mensagens num grupo que ao meio-dia já subiu no ecrã
Pergunte «quanto gastámos em aço em setembro?» e a resposta está numa folha de cálculo. Pergunte «quando é a próxima entrega?» e está numa mensagem de voz de terça-feira. Ninguém tem as duas na cabeça.
Então pergunta-se a um colega. O colega vai procurar. Agora há duas pessoas paradas.
Porque é que uma pesquisa não resolve
A pesquisa encontra documentos, não respostas. Escreva «aço setembro» e recebe cinco folhas. Continua a ter de as abrir e somar sozinho.
E a maioria das ferramentas de IA documental não sabe fazer contas. A abordagem habitual é cortar tudo em excertos, encontrar os que se parecem com a pergunta e entregá-los a um modelo de linguagem. Funciona para «o que diz a nossa política de segurança?». Desfaz-se em «quanto gastámos?».
Uma pesquisa por semelhança encontra as linhas. Não as sabe somar. E não consegue dizer que linha usou — portanto não há como verificar.
Para uma empresa que assina contratos com base nesses números, uma resposta que não se pode verificar não é uma resposta.
O que construímos
Um assistente interno, em croata, que a equipa usa como um grupo de conversa.
Tudo chega ao mesmo sítio: mensagens escritas, mensagens de voz, folhas de cálculo, PDF, fotos. Depois qualquer pessoa pode fazer uma pergunta e receber uma resposta com ligação à origem.

Com tudo o que entra acontecem duas coisas.
Primeiro, é guardado. Em bruto e de imediato, antes de qualquer tentativa mais elaborada. Nada é deitado fora porque um classificador teve um mau dia.
Segundo, um filtro decide se é informação de negócio. «A entrega chega quinta-feira» é. «Quem quer café?» não é. O que passa é processado em duplicado:
- Como factos numa tabela: fornecedores, datas, valores, materiais. É isto que torna as contas possíveis.
- Como significado pesquisável: para que «aço» encontre também «varão de betão», e uma pergunta mal formulada acerte na mesma.
Quando alguém pergunta, o assistente usa as duas vias. Corre uma consulta real à base de dados para o que é numérico e uma pesquisa por significado para o que é descritivo, e responde a partir das duas.
Cada resposta mostra de onde veio
Foi o que mais importou ao cliente.
Por baixo de cada resposta há ligações à fonte. Não «de acordo com os vossos documentos» — uma ligação à linha exata da folha, à página do PDF ou à mensagem de onde saiu o número. Toca-se e chega-se a essa linha, realçada.

Isso muda a relação com a ferramenta. Uma resposta que se verifica com um toque é uma resposta sobre a qual se age.
As datas saem da conversa
O trabalho de obra é marcado de passagem. «O levantamento fazemos na quinta» diz-se uma vez, numa mensagem de voz, e não fica escrito em mais lado nenhum.
O assistente lê essas menções e leva-as para um calendário, com ligação de volta à frase de onde vieram.

Um detalhe pesou mais do que esperávamos. As pessoas erram rotineiramente metade de uma data — dizem «domingo, dia 18» quando o 18 é sexta-feira. Em vez de deixar a IA escolher em silêncio e soar segura, a discrepância é assinalada para revisão humana. Uma data errada que se torna discretamente um compromisso é pior do que não haver data.
As partes difíceis
O croata é mal servido pelas ferramentas padrão. A maioria dos motores de pesquisa de texto traz suporte para inglês e mais uma dúzia de línguas. O croata não está lá. Tivemos de escrever nós o tratamento da língua — incluindo um erro em que đ atravessa inalterado o passo padrão de normalização de texto, fazendo com que qualquer pesquisa por um nome como Đuro falhasse em silêncio. Existe agora um teste cuja única razão de ser é impedir que alguém «simplifique» aquilo.
O filtro promove, nunca apaga. As mensagens e ficheiros originais ficam sempre guardados. O filtro só decide o que segue para processamento. Assim, quando o melhoramos, podemos voltar a passá-lo por tudo o que já foi recolhido — impossível se a primeira versão tivesse deitado coisas fora.
É uma aplicação de telemóvel, porque o trabalho é lá fora. Quem está na obra não está a uma secretária. A aplicação foi feita para uso com uma mão, na carrinha ou no estaleiro: gravar uma mensagem de voz, fotografar um desenho, fazer uma pergunta.

Para que serve este padrão
Isto não é exclusivo da construção. A mesma forma serve a qualquer empresa onde o conhecimento é real mas está disperso, e onde uma resposta errada tem consequências:
- Serviços profissionais: histórico de projetos, âmbito do trabalho, quem acordou o quê
- Indústria: condições de fornecedores, especificações de peças, histórico de incidentes
- Imobiliário e manutenção: registos de manutenção, custos por local, histórico de empreiteiros
- Qualquer empresa que viva num grupo de conversa: onde a memória da organização está mesmo na conversa, e sai quando as pessoas saem
Vale a pena repetir as duas coisas que fazem isto funcionar: juntar consultas reais à base de dados com pesquisa por significado e citar a fonte exata. Sem a primeira, não sabe contar. Sem a segunda, ninguém confia.



