Resumo: Vozes e vídeos convincentes podem ser usados para imitar pessoas e pressionar decisões. Uma pesquisa de 2026 ajuda a entender o risco, mas a proteção depende menos de reconhecer uma falsificação e mais de confirmar a identidade e a autorização por outro caminho.
Uma mensagem chega no meio do expediente. A voz parece ser do gestor, o assunto faz sentido e o pedido é urgente: resolver uma transferência antes que uma negociação seja perdida. Em outra situação, alguém recebe uma ligação com a voz de um familiar pedindo ajuda. O que aproxima esses casos é o convite para agir antes de conferir.
Esses são exemplos hipotéticos, mas ilustram uma mudança real: ferramentas capazes de gerar fala e imagem ampliam os recursos disponíveis para a personificação. Uma comunicação pode parecer humana, familiar e contextualizada sem ter sido enviada por quem aparenta representar.
Depois de discutir como sites falsos fabricam credibilidade, precisamos olhar para outra dimensão do problema. Aqui, a alegação busca acionar uma relação de confiança. O objetivo pode ser obter dinheiro, informação ou uma autorização.
IA generativa é a tecnologia que produz conteúdo, como texto, áudio e imagens, a partir de padrões aprendidos. A clonagem de voz procura reproduzir características vocais de uma pessoa. Já deepfake designa conteúdo sintético ou manipulado, frequentemente usado para simular a fala ou a imagem de alguém.
Em um alerta publicado em 3 de dezembro de 2024, o FBI descreveu usos de IA em fraudes: textos mais convincentes, perfis fictícios, áudios de personificação e vídeos que simulam autoridades ou executivos. A instituição destaca a redução do esforço necessário para enganar. É um alerta sobre modalidades de abuso, não uma medição da participação da IA em todos os golpes.[1]
A implicação prática é que a correção da escrita e a naturalidade da fala perderam parte de seu valor como filtros. Esses sinais continuam informativos, mas não estabelecem, sozinhos, a origem nem a legitimidade de um pedido.
Fred Heiding e sete coautores investigaram a suscetibilidade a golpes de voz produzidos com IA. O trabalho foi submetido ao arXiv em 10 de julho de 2026 e revisado em 20 de agosto. A página informa uma versão publicada em Expert Systems with Applications.[2]
O experimento por questionário envolveu 4.100 adultos nos Estados Unidos, expostos a gravações ou transcrições de cenários de golpe; houve também 12 entrevistas. Na categoria de familiar em dificuldade, até 36% declararam que atenderiam ou poderiam atender ao pedido. Esse resultado não é uma taxa observada de transferências ou perdas reais.
Os autores apontam a economia da automação como um risco importante: reduzir o custo de realizar contatos pode ampliar a viabilidade dos ataques. Os números, porém, não devem ser transportados diretamente para famílias ou empresas brasileiras. Responder a um cenário de pesquisa é diferente de vivenciar uma tentativa real, com suas possibilidades de confirmação.
Em uma equipe pequena, reconhecer o gestor costuma bastar para iniciar uma conversa. Para executar uma ação sensível, precisamos de outra pergunta: aquele pedido está autorizado pelo processo da organização?
Imagine que uma empresa tenha um procedimento para alterações de dados de fornecedores. Se uma ligação pede que ele seja ignorado porque “o diretor já concordou”, o risco está na exceção solicitada. Mesmo uma chamada legítima pode conter uma orientação incompleta ou equivocada. Conferir a autorização protege também contra erros cotidianos.
A tecnologia torna mais visível uma fragilidade anterior: procedimentos que dependem exclusivamente da capacidade de uma pessoa reconhecer outra sob pressão. Melhorar essa estrutura é mais útil do que exigir que todos se tornem especialistas em áudio sintético.
Em orientação publicada em 20 de março de 2023, Alvaro Puig, da Federal Trade Commission, a agência de proteção do consumidor dos Estados Unidos, recomenda confirmar a história ligando para um número já conhecido da pessoa. Se ela não responder, outra pessoa próxima pode ajudar na verificação.[3]
O princípio é sair do caminho controlado pelo solicitante. Um número enviado na própria mensagem suspeita não oferece a mesma confirmação que um contato mantido anteriormente. Abrir outro aplicativo também não resolve automaticamente: precisamos saber de onde veio o contato e o que estamos verificando.
Nas empresas, minha proposta é registrar previamente os responsáveis e os canais de aprovação. A confirmação deve alcançar a pessoa certa e vincular a autorização à ação específica, com destinatário, finalidade e demais informações necessárias. Um “está tudo certo” vago deixa espaço para interpretações diferentes.
Não é necessário transformar a convivência em suspeita permanente. Um combinado pode definir como a família reage a um pedido urgente: interromper a conversa, procurar o contato conhecido e envolver outra pessoa de confiança antes de decidir.
O FBI sugere uma palavra ou frase secreta para ajudar na verificação.[1] Ela funciona como um recurso adicional, não como garantia isolada. Minha recomendação é não substituí-la pelo restante da confirmação, especialmente quando o pedido envolve consequências importantes.
Também proponho ensaiar uma frase: “Vou confirmar pelo contato que já tenho e retorno”. Dizer isso com tranquilidade reduz a necessidade de improvisar diante da pressão. O combinado precisa ser fácil de lembrar e conhecido por todos que poderão utilizá-lo.
Uma regra perde força quando o funcionário é criticado por segui-la. Se o líder exige conferência formal, mas demonstra irritação quando alguém a realiza, a equipe aprende que o procedimento vale apenas quando não incomoda.
Por isso, proponho que as lideranças expliquem publicamente quais pedidos exigem confirmação e aceitem a pausa quando a regra for aplicada. Um processo bem definido deve funcionar mesmo que a solicitação pareça vir da pessoa mais influente da organização.
Um exercício útil é apresentar à equipe uma situação fictícia: um contato solicita uma exceção urgente. A atividade deve pedir que cada participante identifique a ação solicitada, o canal de confirmação e quem pode autorizá-la. O objetivo é praticar o procedimento, sem criar uma competição para descobrir quem reconhece melhor uma falsificação.
Produzir voz sintética não demonstra, por si só, intenção de enganar. Podemos imaginar usos legítimos em materiais educativos, traduções e versões narradas de conteúdo. A diferença aparece na relação com as pessoas envolvidas: autorização, transparência e responsabilidade pela mensagem.
Uma instituição que decide narrar seus materiais com voz sintética pode informar isso, revisar o conteúdo e manter claro quem responde pela publicação. Se a voz representa uma pessoa identificável, a decisão também precisa respeitar a autorização dessa pessoa e o alcance do uso combinado.
O contraste ajuda a avaliar o bom e o mau uso. No golpe, a representação serve para ocultar a origem e obter uma ação. Em uma aplicação legítima, ela pode facilitar a comunicação sem fabricar uma identidade ou um consentimento.
O conselho não é acreditar que tudo foi falsificado. É reservar a confirmação proporcional às consequências do pedido. Uma conversa informal e uma autorização para movimentar recursos não precisam do mesmo processo.
Quando uma mensagem mistura urgência, sigilo e abandono de procedimento, a melhor resposta pode ser recuperar o contexto: quem pediu, o que precisa acontecer e quem confirma. Essa pausa organiza a decisão.
O avanço da IA exige adaptar a maneira de confiar. Podemos continuar reconhecendo vozes e rostos, enquanto aprendemos a sustentar ações importantes em confirmações que outra pessoa também consiga verificar.
Assine a newsletter e receba conteúdos objetivos para aplicar no trabalho e na carreira.
Quero receber os conteúdos