Case real: como estruturamos um agente de IA que qualifica leads 24h no nosso site, com prompt engineering, proteções de segurança e handoff para humano.
Este é o case que quase não publicamos. Faz mais de um ano que rodamos, dentro do nosso próprio site, um agente de IA que atende, qualifica e prepara todo lead antes de encaminhar pro nosso time. Neste texto contamos o que funcionou, o que quebramos no processo e o que qualquer negócio pode replicar.
Antes, todo botão de contato do nosso site mandava direto pro nosso WhatsApp. Resultado: 60% dos leads chegavam sem informação ("oi, tudo bem?"), a equipe gastava a primeira metade da conversa perguntando dados básicos e muitos leads sumiam antes de responder o time.
Precisávamos de algo que: (a) atendesse em segundos, 24h; (b) coletasse nome, serviço e faixa de investimento antes de passar pra gente; (c) tivesse tom humano, sem parecer robô de árvore de decisão; (d) não custasse os R$ 3.500/mês que consultoria enterprise cobra.
1. Widget web (React) — o que o visitante vê. Bolha no canto, abre janela de chat. Simples. Design integrado ao site pra não parecer plugin de prateleira.
2. Edge Function serverless — mediador. Recebe as mensagens, aplica rate limit, valida payload, protege contra prompt injection e chama o LLM.
3. LLM (Gemini 2.0 Flash) com prompt system especializado. O prompt define: (a) papel do agente (assistente da Topo das Buscas); (b) objetivo (coletar 3 informações); (c) regras (uma pergunta por vez, tom direto, não inventar preços, não se identificar como IA); (d) formato de saída quando qualificação está pronta (JSON estruturado).
4. Handoff pro WhatsApp humano. Quando o LLM emite o JSON de "ready", o widget redireciona pro WhatsApp com mensagem pré-formatada contendo os dados coletados. O time humano abre a conversa já com contexto completo.
Na primeira versão o agente inventava preços, prometia prazos e às vezes se declarava IA ("como uma inteligência artificial, não posso..."). Isso derrubava confiança. Três ajustes resolveram:
Colocar LLM no ar sem proteção é convite pra abuso e conta gigante de API. As camadas que aplicamos:
Cada landing de nicho tem um AGENTE DIFERENTE. O de psicólogo pergunta cidade, especialidade principal, preferência de plano. O de dentista pergunta bairro, cadeiras da clínica, especialidade dominante. Fluxo é o mesmo, prompt é totalmente diferente. Isso multiplicou nossa qualificação por 3.
O agente resolve o primeiro contato, a qualificação, o handoff, e reengaja quem sumiu (com follow-up automático em 24h/72h). O que continua com humano: negociação, fechamento, relacionamento contínuo. Isso é intransferível.
Sim, é um dos serviços mais procurados hoje. Clínicas, escritórios de advocacia e prestadores de serviço são os que mais se beneficiam pelo volume de mensagem repetitiva.
Sim, a mesma arquitetura funciona conectada à API oficial do WhatsApp Business. A diferença é que aí o custo por conversa entra em jogo (R$ 0,04-0,10 por conversa Meta).
O agente é programado pra dizer honestamente que o consultor humano dará o detalhe e conduzir a conversa de volta pra qualificação. Isso preserva confiança e libera humano só pro que realmente exige julgamento.
Se você quer estruturar um agente de IA no seu site ou WhatsApp com essa mesma arquitetura, fale com a gente pelo próprio agente aqui do site.
Assuntos: Agentes de IA, WhatsApp, Prompt Engineering, Automação, Case Real.
Publicado por Topo das Buscas — agência de SEO, criação de sites e Agentes de IA em São Paulo. WhatsApp: (11) 96693-8839.