El desarrollo acelerado de modelos generativos de audio y herramientas de aprendizaje automático accesibles ha modificado drásticamente los patrones delictivos asociados al fraude telefónico y la extorsión patrimonial. La firma especializada en seguridad informática ESET Latinoamérica emitió una alerta preventiva ante el incremento de estafas basadas en clonación de voz (deepfakes vocales), modalidad donde los atacantes sintetizan el timbre, tono y ritmo de personas reales para consumar secuestros virtuales o transferencias de emergencia bajo engaño.
De acuerdo con un reporte de la compañía de seguridad en telecomunicaciones Hiya, una de cada cuatro personas ha recibido una llamada con audio generado por inteligencia artificial en el último año, mientras que un 24% de los usuarios encuestados admitió su incapacidad para distinguir una voz sintética de una grabación humana legítima. Los atacantes requieren fragmentos de apenas tres a cinco segundos de audio —obtenidos frecuentemente de videos públicos en redes sociales o mensajes de voz— para alimentar software comercial de clonación en el entorno de la tecnologia digital.
«La efectividad de estos fraudes radica en la manipulación emocional inmediata; por ello, la medida preventiva más sólida consiste en pactar previamente una palabra o código de seguridad familiar confidencial que sirva como mecanismo de autenticación ante llamadas de emergencia», advirtió Mario Micucci, Investigador de Seguridad Informática de ESET Latinoamérica.
El especialista recomendó que este código no incluya referencias personales evidentes en internet, además de colgar inmediatamente ante cualquier llamada atípica para verificar el paradero del familiar por canales directos y presentar la denuncia correspondiente ante las unidades de policía cibernética.
Equipo de redacción
















Leave a Reply