Escuchar a un familiar ya no es una garantía: así funcionan clonan voces con IA

Foto perfil Cristian Serrano
12 Min de lectura

Te contamos cómo funciona la estafa con voces falsas y qué puedes hacer antes de enviar dinero.

Suena el teléfono. Del otro lado escuchas a tu hijo, tu pareja, un hermano o cualquier otra persona que reconocerías incluso medio dormido. Está asustado, dice que ocurrió algo grave y necesita dinero inmediatamente.

La voz es la correcta; pero precisamente ahí está el problema: en 2026, reconocer una voz ya no basta para confirmar quién está hablando.

Más datos: Truecaller lleva a otro nivel su batalla contra las estafas telefónicas

Las herramientas de inteligencia artificial permiten crear imitaciones convincentes utilizando fragmentos relativamente breves de audio, mientras las redes sociales pueden proporcionar el resto del guion: nombres, familiares, trabajo, viajes o cualquier detalle que ayude a convertir una mentira en una emergencia aparentemente real. ESET advierte que estas técnicas ya se utilizan en fraudes y secuestros virtuales, y propone una defensa sorprendentemente sencilla: acordar una palabra de seguridad familiar.

No es un escenario reservado a demostraciones de laboratorio. Una encuesta publicada por Hiya en marzo de 2026 encontró que uno de cada cuatro estadounidenses consultados afirmó haber recibido una llamada con una voz deepfake durante los 12 meses anteriores. Otro 24% dijo no estar seguro de poder distinguir una de una llamada auténtica. El estudio abarcó más de 12.000 personas en seis países, aunque esas cifras concretas corresponden a Estados Unidos y no deben extrapolarse automáticamente a Colombia.

Estafa telefónica
Aumenta el número de víctimas de estafa telefónica / Composición de Pixelados con IA

La pregunta importante, entonces, no es si podremos entrenar el oído para ganarle siempre a la IA.

Es qué podemos hacer cuando lo que escuchamos ya no constituye una prueba suficiente.

Así funciona una estafa con una voz clonada por IA

El deepfake puede parecer la parte más sofisticada del engaño, pero por sí solo no consigue demasiado. La estafa funciona cuando esa voz falsa se combina con una vieja conocida: la ingeniería social.

El esquema general comienza con información.

Una muestra de voz puede aparecer en un video publicado en redes sociales, una entrevista, contenido relacionado con el trabajo o cualquier grabación accesible en internet. ESET señala que unos pocos segundos de audio pueden ser suficientes para producir una imitación convincente con las herramientas actuales.

Al mismo tiempo, las publicaciones públicas pueden revelar mucho más que cómo suena una persona.

Otros datos: Qué significa la propuesta de Huawei de “IA contra IA” en ciberseguridad en Andicom

Quiénes son sus familiares. Dónde trabaja. Si está viajando. Qué relaciones tiene. Incluso si alguien cercano probablemente tendrá dificultades para contactarlo durante determinadas horas.

La IA pone la voz. La información pública puede escribir el libreto.

Después llega la llamada.

Uno de los escenarios descritos por especialistas es el secuestro virtual: alguien asegura que un familiar está retenido y utiliza durante algunos segundos una voz parecida a la suya para hacer creíble la historia. No significa que exista un secuestro real; precisamente el fraude consiste en convencer a la familia de que sí lo hay para exigir dinero.

Y el audio falso ni siquiera necesita sostener una conversación impecable durante varios minutos.

Los delincuentes pueden mezclar breves fragmentos de voz con llanto, gritos o ruido de fondo. El caos ayuda: cuanto más emocionalmente alterada esté la persona que recibe la llamada, menos tiempo dedica a preguntarse por qué algo no termina de sonar bien.

Más ciberseguridad: Estafas 2026: Contestar ciertas llamadas podría dejarte sin dinero en segundos

La trampa más importante no está en la voz

Imagina que durante una llamada escuchas una pequeña pausa extraña.

En una situación normal quizá te llamaría la atención.

Si en cambio crees que un familiar acaba de sufrir un accidente o está siendo amenazado, probablemente tengas preocupaciones bastante más urgentes que analizar la respiración entre dos palabras.

Ese es el verdadero músculo del fraude.

La voz clonada es el disfraz; la urgencia intenta impedir que tengas tiempo de quitárselo.

La FTC estadounidense identifica precisamente varios patrones recurrentes en las falsas emergencias familiares: el supuesto problema debe resolverse inmediatamente, la víctima es presentada como la única persona capaz de ayudar y, en ocasiones, se le exige mantener todo en secreto. También pueden aparecer personajes que aporten autoridad a la historia, como un falso abogado, médico o policía.

Después viene la solicitud de dinero.

Transferencias, criptomonedas, aplicaciones de pago u otros mecanismos difíciles de revertir son especialmente atractivos para este tipo de estafas porque reducen las posibilidades de recuperar los fondos una vez enviados.

Por eso buscar únicamente “errores de IA” en la voz puede ser una defensa frágil.

Las imitaciones mejoran. Una llamada telefónica ya introduce compresión y ruido. Y un delincuente puede añadir todavía más interferencias para ocultar defectos.

La solución más útil es cambiar la pregunta.

En vez de pensar “¿esta voz parece real?”, conviene comprobar “¿puedo demostrar por otro medio que realmente es esa persona?”.

Una palabra de seguridad puede funcionar como el 2FA de tu familia

Aquí aparece una defensa que no necesita inteligencia artificial, suscripción mensual ni actualizar el firmware de ningún familiar: acordar previamente una palabra o frase que solo conozca el círculo cercano.

Si alguien llama con una emergencia sospechosa, se le pide esa palabra.

La idea se parece, conceptualmente, a la autenticación en dos pasos: reconocer una voz aporta una señal, pero conocer un dato secreto previamente acordado añade una comprobación independiente.

La palabra debe cumplir dos condiciones importantes: ser suficientemente sencilla para que la familia pueda recordarla y suficientemente extraña para que un desconocido no pueda encontrarla revisando Instagram durante cinco minutos.

Por eso el nombre de la mascota, un cumpleaños, el colegio, el equipo de fútbol favorito o cualquier dato publicado habitualmente en internet son pésimos candidatos.

Mejor algo privado y arbitrario.

Y como hasta la mejor contraseña familiar puede olvidarse justo cuando más se necesita, hace falta un plan B.

Ese plan es todavía más sencillo: terminar la llamada y crear tú mismo el siguiente contacto.

No devuelvas la llamada al número que acaba de aparecer en pantalla. Marca el número del familiar que ya tienes guardado, escríbele por el chat que utilizan normalmente o pregunta a otra persona cercana si sabe dónde está.

La FTC recomienda precisamente contactar directamente a la supuesta víctima utilizando un número conocido en lugar de confiar en la voz que acaba de llamar.

Si era una emergencia real, la conversación continúa.

Si era un fraude, acabas de quitarle al estafador algo que necesitaba desesperadamente: controlar toda la historia.

Otros datos: Capturas de pantalla falsas, la trampa con la que están estafando a las personas

Qué hacer si recibes una llamada sospechosa

Cuando la llamada mezcla una voz conocida, una emergencia y una petición económica urgente, estas medidas pueden evitar que el miedo tome la decisión por ti:

  1. No envíes dinero ni compartas información personal inmediatamente. La urgencia forma parte habitual del engaño.
  2. Pide la palabra de seguridad, si tu familia acordó una.
  3. Termina la llamada si algo resulta extraño.
  4. Contacta directamente al familiar usando un número o canal que ya conocías antes de la emergencia.
  5. Consulta con otra persona cercana si no consigues localizarlo.
  6. Conserva números, mensajes, comprobantes y cualquier otra evidencia si confirmas que se trató de un fraude.
  7. Si ya enviaste dinero, contacta cuanto antes a tu banco para informar lo ocurrido y preguntar si existe alguna posibilidad de bloquear o recuperar la operación.

En Colombia, si la llamada implica una posible extorsión, la Policía Nacional dispone de la línea gratuita 165 del GAULA para atención inmediata. La institución recomienda utilizar ese canal cuando se requiere intervención urgente.

La Secretaría de Seguridad de Bogotá también alertó en marzo de 2026 sobre modalidades de suplantación telefónica que utilizan inteligencia artificial para falsificar voces de familiares o conocidos. Es decir, aunque buena parte de las estadísticas disponibles proceda de otros mercados, el mecanismo tampoco es ajeno al contexto colombiano.

Tus redes sociales pueden prestarle información al estafador sin que lo notes

No hace falta caer en la paranoia de borrar cada fotografía y desaparecer de internet.

Sí conviene entender que determinadas publicaciones pueden tener usos muy distintos del que imaginábamos al subirlas.

Un video permite escuchar una voz. Una fotografía puede revelar parentescos. Una publicación de vacaciones confirma que alguien está lejos de casa. LinkedIn puede ayudar a reconstruir relaciones laborales.

Por separado parecen pequeños datos.

Juntos pueden hacer que una llamada falsa incluya suficientes verdades como para que la mentira resulte mucho más convincente.

Revisar quién puede ver publicaciones personales, evitar anunciar desplazamientos innecesariamente y pensar dos veces antes de exponer información familiar sensible reduce parte de ese material disponible.

Pero incluso con perfiles perfectamente configurados hay una regla que sigue funcionando: ninguna solicitud urgente de dinero debería depender únicamente de que una voz “suene correcta”.

Esa prueba dejó de ser suficiente.

¿Sabías que?

En 2019, años antes de que ChatGPT convirtiera la inteligencia artificial generativa en conversación cotidiana, una empresa ya perdió 220.000 euros después de que uno de sus directivos creyera estar hablando por teléfono con su jefe.

La imitación no solo reproducía su voz: la víctima dijo reconocer también la entonación y el acento alemán del ejecutivo. Autorizó la transferencia y empezó a sospechar después, cuando aparecieron inconsistencias y llegó una nueva petición de dinero. Mientras intentaba contactar al verdadero jefe, volvió a recibir una llamada del falso. El caso fue documentado por la aseguradora Euler Hermes y se convirtió en uno de los primeros fraudes con voz generada por IA reportados públicamente. En otras palabras, la voz dejó de ser una prueba fiable de identidad antes de que la mayoría supiéramos que necesitábamos desconfiar de ella.

Compartir este artículo