Estefani & Co. Blog

E se a IA travar no meio do atendimento (deu pau, timeout, caiu uma ferramenta) — o cliente fica falando sozinho?

Resposta rápida

Não fica. Quando algo quebra tecnicamente no meio da conversa — uma ferramenta que falha, o orçamento de uso que estoura, uma resposta que passa do tempo limite — o sistema entra num estado específico, chamado degradado, que assume o turno na hora: reconhece o problema com honestidade, não inventa resposta e avisa que vai retomar ou chamar alguém do time. É diferente de a IA "não saber responder" por falta de informação sobre o negócio (isso é escopo, resolvido perguntando ou escalando); aqui a falha é técnica, e a regra vale sempre: a conversa nunca fica muda esperando.

O que quer dizer a IA "travar" no meio do atendimento?

Três coisas concretas podem dar errado por trás da tela: uma ferramenta que o agente chama (consultar agenda, registrar um lead, gerar um link) devolve erro; o orçamento de uso daquela conversa estoura o teto configurado; ou uma chamada demora mais do que o tempo limite. Nenhuma tem a ver com o agente "não saber o que dizer" — é infraestrutura falhando, como qualquer sistema falha de vez em quando. A diferença é o que acontece no instante seguinte: silêncio, ou alguém assumindo o turno.

Isso é a mesma coisa que a IA não saber responder uma pergunta?

Não, e vale separar os dois porque são problemas diferentes, com soluções diferentes. Quando a IA não tem o dado pra responder — um preço fora da base, uma condição que não foi configurada — ela pergunta o que falta ou passa pra um humano: isso é limite de escopo, e a conversa segue rodando normalmente. O caso deste artigo é outro: não é falta de informação, é uma peça técnica que quebrou no meio do processo. Os dois viram formas de "não sei", mas o gatilho e o tratamento interno são distintos, porque a causa é distinta.

Como o sistema evita ficar mudo quando algo quebra de verdade?

Existe uma rota específica no motor de conversa — o estado degradado — que qualquer falha técnica ativa, com prioridade sobre todas as outras: não importa em que ponto da conversa o cliente estava (descobrindo o que precisa, já qualificado, perto de fechar), se algo quebra, o próximo passo é sempre entrar nesse estado, nunca travar em silêncio ou devolver um erro cru. E tem uma segunda camada de segurança dentro dele: o sistema primeiro tenta gerar, com o próprio modelo de linguagem, uma mensagem natural reconhecendo o problema; se essa chamada também falhar, existe uma frase fixa, escrita no código, que sai no lugar. É fallback dentro de fallback — a única forma de a conversa ficar realmente muda seria as duas camadas falharem ao mesmo tempo, e mesmo aí o código está escrito pra nunca deixar isso acontecer.

O aviso é sempre a mesma frase decorada, tipo bot de banco?

Na prática, não — e essa diferença separa um sistema que "fecha o loop" de um robô que só repete a mesma frase morta. A instrução usada nesse estado não é um texto fixo: é uma orientação (reconhecer o problema com honestidade, não inventar resposta, avisar que vai retomar ou chamar o time), e o modelo escreve a mensagem de novo a cada vez, no tom daquela conversa. O texto decorado, igual em toda falha, só existe como último recurso — a frase que sai quando até a geração da mensagem de erro falha. O caminho comum é uma resposta variada; o caminho de emergência é uma frase fixa, mas nunca silêncio.

Ela chama alguém do time quando trava?

Sim — e essa é a parte que fecha o loop de verdade. A própria instrução do estado degradado já inclui avisar que alguém do time vai dar sequência, e a frase de último recurso do sistema termina exatamente assim: "Já te retorno — vou pedir pra alguém do time dar sequência." O cliente não fica pendurado numa "vou verificar e te chamo" vazia; ele recebe um aviso concreto de que uma pessoa está entrando na conversa. E, porque cada empresa roda numa instância isolada da própria IA, uma falha técnica na operação de um cliente não vira problema na de outro — o estado degradado resolve o instante daquela conversa, sem depender (nem afetar) mais ninguém.

Caso real

Essa mecânica não é promessa de slide — está escrita e testada no motor que roda o próprio atendimento da Estefani & Co. No código existe um nó chamado degradado_node: quando a extração de sinais da conversa falha, o roteador da máquina de estados manda a conversa pra esse nó em vez de deixar o erro subir e travar tudo. Dois testes automatizados provam isso. O primeiro simula uma falha de extração e confirma que a conversa entra em estado degradado com uma mensagem real ao cliente — sem exceção não tratada, sem silêncio. O segundo é mais duro: simula a extração e a própria geração da mensagem de erro falhando ao mesmo tempo, e mesmo assim o sistema devolve a frase fixa de último recurso, nunca derruba a conversa. Tem ainda um terceiro comportamento testado: se a falha acontece no meio de uma ação já em andamento (registrar uma conversão, por exemplo), o estado degradado "trava" ali de propósito, pra impedir que a mesma ação seja repetida por engano na mensagem seguinte. É engenharia sem glamour, mas é o que decide se o cliente sente um solavanco ou silêncio total.

Perguntas frequentes

Erro técnico e "a IA não sabe responder" são a mesma coisa?

Não. Não saber responder é falta de informação sobre o negócio (preço, prazo, regra) — a IA pergunta ou escalona normalmente. Erro técnico é ferramenta, orçamento ou tempo estourando por trás da cena — aí entra o estado degradado.

O cliente recebe uma mensagem de erro feia, tipo "Error 500"?

Não. A mensagem é escrita para reconhecer o problema com honestidade e avisar o próximo passo, no mesmo tom da conversa — nunca um erro técnico cru.

Isso pode travar a conversa pra sempre?

O desenho existe justamente pra evitar isso: mesmo se a geração da mensagem também falhar, existe uma frase de último recurso escrita no código que garante uma resposta ao cliente.

Um problema técnico em outro cliente pode travar meu atendimento também?

Não deveria — cada empresa roda numa instância isolada, com banco e processo próprios. Uma falha técnica na conversa de um cliente não tem caminho pra afetar a de outro.

Depois que trava, alguém humano realmente entra na conversa?

Sim, esse é o objetivo do estado: fechar o loop avisando que uma pessoa do time vai dar sequência, não deixar o cliente esperando uma resposta que nunca chega.

Cristian de Estefani
Consultor de IA · ex-diretor de operações (mercado financeiro)

Cristian de Estefani estruturou operações de grande escala no mercado financeiro antes de fundar a Estefani & Co. Hoje implementa IA em empresas do interior de São Paulo — atendimento, automação e inteligência de dados — e ensina o empresário a operar a solução, mão na massa. Base em São Carlos; atendimento em São Carlos, Araraquara e Ribeirão Preto (diagnóstico presencial, implementação remota).

Quer ver isso rodando no seu negócio?
Chama no WhatsApp