Deepfake de áudio: basta 3 segundos de voz e €30
Deepfakes de áudio podem ser gerados a partir de 3 segundos de voz real e custo baixo (~30€). Crescem fraudes, clonagem vocal e uso indevido de celebridades.

Meta description: Deepfakes de áudio podem ser gerados a partir de 3 segundos de voz real e custo baixo (~30€). Crescem fraudes, clonagem vocal e uso indevido de celebridades.
A tecnologia capaz de reproduzir vozes humanas com fidelidade a partir de apenas três segundos de gravação e por um custo indicado de cerca de €30 vem ampliando fraudes, clonagem vocal e usos indevidos de celebridades, segundo reportagem da ANSA que cita empresas de segurança e especialistas do setor. Além de aplicações legítimas, como acessibilidade em cinema, especialistas alertam para o aumento de golpes por engenharia social e ataques direcionados a instituições financeiras e figuras públicas.
O que a reportagem relata
- A partir de três segundos de áudio real é possível criar uma réplica convincente da voz de uma pessoa; o valor médio indicado para gerar a voz sintética pode ficar em torno de 30 euros, segundo a matéria da ANSA.
- A tecnologia tem usos positivos — por exemplo, para a recriação de vozes em projetos culturais e de acessibilidade — mas também facilita fraudes e manipulações.
"Deepfake de áudio pode ser criado com três segundos de voz e custar cerca de €30", segundo a ANSA.
Casos e exemplos citados
- Uso legítimo: a recriação da voz do ator Val Kilmer em um filme, citada como exemplo de aplicação para fins artísticos e de acessibilidade, quando a tecnologia é usada para recuperar linhas de diálogo de atores com limitações vocais.
- Fraudes: a reportagem menciona um ataque que envolveu a clonagem de voz usada contra um manager do banco Fideuram, além de manipulações envolvendo celebridades, onde vozes falsificadas foram empregadas para criar conteúdos enganosos ou pressionar financeiramente alvos.
- Reação institucional: a primeira‑ministra Giorgia Meloni registrou sua voz no Escritório de Propriedade Intelectual da União Europeia (EUIPO) como medida preventiva para se defender de falsificações geradas por IA, segundo a ANSA.
Dados e tendências segundo o setor
- O relatório citado pela ANSA, com dados da empresa de cibersegurança McAfee, aponta crescimento expressivo do fenômeno:
- 900% de aumento em deepfakes (vídeo, foto e áudio) em um ano.
- Tentativas de fraude cresceram mais de 3.000%; ataques aumentaram 700% ano a ano em 2026.
- Crimes ligados à clonagem vocal e deepfake de áudio registraram aumento de 1.300%, segundo os números do setor citados.
- Essas métricas indicam não apenas maior capacidade técnica, mas também escalabilidade comercial e criminal da síntese de voz barata.
Riscos e implicações
- Criminosos usam clonagem vocal para golpes de engenharia social: pedidos falsos de transferência, instruções a subordinados ou pressões a familiares de vítimas.
- A disponibilização de serviços de síntese por baixo custo reduz barreiras de entrada para atacantes, ampliando o número e a sofisticação das fraudes.
- Além do dano financeiro, há risco reputacional para figuras públicas, empresas e instituições — vozes falsificadas podem ser usadas para manipular opinião, extorquir ou induzir decisões.
- Medidas tecnológicas de detecção evoluem, mas spécialistes alertam que autenticação multifatorial e protocolos de verificação adicionais permanecem essenciais.
Relevância para brasileiros e descendentes de italianos
- As ameaças de deepfake de áudio não são limitadas pela fronteira: brasileiros e comunidades de descendentes de italianos podem ser alvos de golpes semelhantes, especialmente quando há relações financeiras, burocráticas ou pessoais transnacionais.
- Empresas financeiras, gestores e figuras públicas no Brasil enfrentam riscos análogos aos citados na Itália; golpes por chamada de voz ou mensagens com gravações manipuladas já registraram incidentes em vários países.
- Medidas preventivas recomendadas incluem:
- adoção de autenticação por múltiplos fatores nas operações sensíveis;
- protocolos internos que exijam confirmações por canais distintos (por exemplo, mensagem escrita ou verificação presencial) antes de autorizar transferências;
- gravação e documentação de comunicações críticas;
- atenção a sinais típicos de deepfake (entonação atípica, pausas estranhas, inconsistências contextuais).
- Para quem acompanha processos de cidadania italiana ou mantém contatos na Itália, é prudente verificar identidades por canais oficiais e estar atento a solicitações financeiras por voz ou áudio. Notícias sobre o tema e medidas oficiais relacionadas à Itália podem ser acompanhadas em Notícias da Itália e em pautas sobre Vida na Itália.
Conclusão
A combinação de amostras curtas de voz e custos baixos para gerar áudio sintético torna os deepfakes de áudio uma ameaça crescente para segurança cibernética, fraudes financeiras e proteção da imagem pública. Enquanto a tecnologia oferece benefícios legítimos, especialistas e autoridades recomendam medidas preventivas e protocolos robustos de verificação para reduzir riscos.
Fonte: ANSA




