Atendimento com IA na sua máquina
Um atendente de IA que roda num computador da sua empresa, responde só com o que está no seu banco e passa a conversa para uma pessoa quando não sabe.
Instalamos o atendimento de IA dentro da sua empresa: um computador com placa de vídeo (RTX 3090 ou RTX 3060) roda o modelo de linguagem e o banco de dados, e a nossa orquestração cuida do WhatsApp sem guardar o histórico. O modelo não responde de memória: preço, prazo, estoque e status de pedido chegam do seu sistema, e cada resposta é conferida contra essas fontes antes de sair. Quando falta informação, ele avisa que vai verificar e passa a conversa para a sua equipe. Cada descuido corrigido pela equipe vira fato, exemplo ou regra no banco e entra na prova noturna. É assim que o atendimento aprende sem inventar.
O que você recebe
- Máquina de atendimento configurada (RTX 3090 ou RTX 3060)
- Modelo aberto local e banco SQL Server Express
- WhatsApp oficial (Meta Cloud API) com transcrição de áudio
- Conferência de toda resposta contra as fontes
- Revisão da equipe: correção vira fato, exemplo ou regra
- Prova noturna com perguntas-armadilha
Como fazemos
O mesmo desenho das nossas máquinas: o atendimento volta sozinho depois de desligar, avisa quando o modelo perde a placa de vídeo e tem backup com restauração provada. Antes do primeiro cliente, ele passa por uma bateria de perguntas reais e perguntas-armadilha e só entra no ar com zero invenção. A RTX 3090 cobre atendimento geral; a RTX 3060 cobre atendimento de escopo fechado (dúvidas frequentes, status de pedido, agendamento). Como opção, as decisões de encaminhamento podem usar um serviço externo de classificação, que recebe só o texto da mensagem, sem nome nem telefone, e apenas com o seu consentimento. Sem essa opção, a conversa inteira é processada na sua máquina.