encabezado_seccion
encabezado_seccion

En busca de evidencia criminal: alcances y limitaciones de la Acústica Forense

Una problemática que ahora enfrenta es el uso de IA para crear voces

27-07-2026

Por María Luisa Santillán, Ciencia UNAM-DGDC


La fonética y la acústica forense es el área que estudia todo lo relacionado con los sonidos de la lengua con un fin legal. Es parte de la criminalística y puede ser utilizada como prueba pericial en el esclarecimiento de un delito.

La comparación forense de voz es una de las áreas fundamentales para la acústica forense. Se utiliza siempre que haya implicada una evidencia oral, una grabación, un mensaje de voz de Whatsapp o de celular. Si se cuenta con este tipo de evidencia y con la grabación de un sospechoso, se puede hacer una comparación forense de voz.

Otro campo de la fonética y acústica forense es el perfilamiento lingüístico, el cual se utiliza cuando sólo se tiene una grabación y nada contra qué compararla. No necesariamente se ocupa con fines legales, pero sirve para construir perfiles, analizar el uso de ciertos fonemas en algunas regiones y poder hacer predicciones sobre qué tipo de persona es la que está en una llamada sin conocerla, pero sí describirla.

“Al escuchar una grabación empiezo a detectar ciertas características que me permiten perfilar al sujeto, si es hombre o mujer, de qué generación es, más o menos de qué origen, etcétera. Eso es perfilamiento lingüístico”, explica la doctora Fernanda López Escobedo, de la Escuela Nacional de Ciencias Forenses de la UNAM.


  • La fonética y acústica forense son parte de la lingüística forense. Sus primeros pasos se remontan a 1968, cuando el lingüista sueco Jan Svartvik analizó diversas pruebas lingüísticas de un hombre acusado de matar a su esposa. Se demostró que él no lo había hecho.

Caracterizar hablantes

Parte del trabajo de la doctora López Escobedo es utilizar modelos estadísticos para analizar y comparar grabaciones de voz, para ello ha creado bases de datos con voces de individuos representativos de la población mexicana. En la actualidad, tiene un acervo de 117 hablantes de la Ciudad de México, el cual le permitirá documentar y distinguir las características lingüísticas de estos individuos.

“Estoy convencida de que hay muchos rasgos lingüísticos de los fonemas, en particular de ciertos sonidos –por ejemplo la S– que permiten comparar estas grabaciones y tener mayor certeza de que se trate o no de la misma persona, utilizando modelos estadísticos, pero enfocándose nada más en ciertos sonidos de lenguaje, no en toda el habla, como lo hacen los sistemas automáticos”.

La investigadora destaca que además de las grabaciones para la base de datos, también recopila otras para hacer comparaciones, ya que es necesario tener voces grabadas de personas en tiempos diferentes, porque el tipo de habla modifica ciertos sonidos, pues no es lo mismo estar leyendo un texto que estar en medio de una conversación.

Para estas grabaciones utiliza como guía un Map Task (tarea de mapa), el cual consiste en ir guiando al entrevistador a través de un mapa con diferentes nombres para promover y registrar el uso de ciertos sonidos que no son tan frecuentes en la lengua.

“Por ejemplo en una llamada de secuestro, les van diciendo lo que tienen que hacer y lo que hacemos es simular ese tipo de habla porque también los fonemas cambian sus características si estás en un tipo de habla leída, espontánea o de Map Task”.

Para esta labor utiliza la estadística aplicada a casos forenses, con el fin de emplear técnicas que les permitan comparar características entre muestras dubitadas (que no se conoce su origen) y muestras que sí provienen de un sospechoso.

Usa software libre, que ha sido desarrollado por universidades, como el RStudio, que es para el uso de diferentes técnicas estadísticas y Praat que sirve para etiquetar grabaciones de audio. Sin embargo, la doctora López Escobedo añade que uno de los objetivos de su línea de investigación es desarrollar una herramienta propia que sea de acceso gratuito. Actualmente cuenta con un proyecto aprobado por la SECIHTI para desarrollar dicha herramienta.

“En la que el usuario pueda hacer la comparación entre dos grabaciones y emitir un resultado de qué tanto se parecen esas dos grabaciones, a partir de un corpus o de una base de datos de hablantes del español de México”.


 IA contra evidencias orales

Entre las problemáticas a las que se enfrenta la acústica forense desataca la creación de voces con inteligencia artificial y la falta de reconocimiento de esta área.

En cuanto a la primera, uno de los proyectos más recientes de la doctora López Escobedo consiste en identificar qué tanto la IA es capaz de simular la voz de un individuo al grado de que no es posible diferenciarla de una voz natural. Comenta que cuando empezó la inteligencia artificial era muy evidente detectar una voz humana de una voz artificial, pero eso ha cambiado en la actualidad, tanto que para algunas personas ya no es posible distinguir entre una y otra.

“Si ya es difícil para el oído humano hacer esta discriminación, qué tan difícil será hacerlo para los modelos de comparación forense de voz”.

Una de sus propuestas es no analizar toda la voz humana, sino sólo características muy particulares de ella que quizá no sean tan fácil de replicar para una inteligencia artificial, por ejemplo, las muletillas o el alargamiento de las vocales al final de una frase.

En relación con el poco conocimiento que se tiene de la acústica forense en México responde que hace falta que los ministerios públicos o los defensores se den cuenta del potencial del área, pues el análisis científico de evidencias orales podría aportar pruebas contundentes para esclarecer delitos.

Existen países como España donde desde hace varios años se ha desarrollado este campo, hay más cultura al respecto y se solicitan más peritajes de comparación forense de voz. En México, se han realizado varios esfuerzos para impulsar la acústica forense, incluso, la doctora López Escobedo participó en la elaboración de unas guías de valoración de la prueba pericial, del Consejo de la Judicatura Federal, en donde realizó el capítulo relacionado con la guía de voz.

Análisis de la voz de Frida Kahlo

Las técnicas de la acústica forense también se han utilizado para fines no legales. Uno de estos casos fue el proyecto realizado entre la doctora Fernanda López Escobedo, especialistas del Instituto de Investigaciones en Matemáticas Aplicadas y Sistemas (IIMAS) de la UNAM y de la Fonoteca Nacional.

El objetivo fue identificar si la voz de una mujer que leía un poema en un audio de 1955 era de Frida Kahlo o la de la locutora y experta en doblaje Amparo Garrido.

“La Fonoteca nos buscó para hacer la confronta. Y esa historia es interesante porque es un caso no forense, pero en donde se utilizan las técnicas de acústica forense, no para determinar si es Frida, pues eso no podemos hacerlo porque debíamos tener la certeza de que esa grabación es de ella, sino para determinar si estas dos voces, la de la supuesta Frida y la de Amparo Garrido se parecen o no”.

Lo que hicieron fue crear, con ayuda de la Fonoteca Nacional, una base de datos de locutoras de la época para hacer dicha comparación. Encontraron que no es la voz de Amparo Garrido, pero tampoco concluyeron si es la de Frida Kahlo porque para ello tendría que haber otra grabación que tenga su voz para poder compararla.

“La comparación que hacemos nos dice que no es Amparo Garrido y al no poder atribuírselo a ella, la hipótesis de que es Frida se sostiene”, concluye la investigadora.


Publicaciones relacionadas

ChatGPT. Alcances, limitaciones y dilemas de la inteligencia artificial

Aula del crimen, el escenario perfecto para la ciencia forense

¿Cómo la ciencia forense pudo leer mis crímenes?


Explora la ciencia en la UNAM en tu formato preferido

Enrédate         Síguenos en nuestras redes sociales

 

Gacetas UNAM

 

Misión espacial

 

Covid-19

 

Navega por la Ciencia en la UNAM


Ciencia Joven

Universidad Nacional Autónoma de México (UNAM)
Dirección General de Divulgación de la Ciencia (DGDC)
Hecho en México. Todos los derechos reservados 2026. La información aquí publicada tiene como fuente principal a investigadores de la UNAM y es responsabilidad de quien la emite; no necesariamente refleja el punto de vista de esta institución. Los contenidos pueden ser reproducidos con fines no lucrativos, siempre y cuando no se mutile, se cite la fuente completa y su dirección electrónica. De otra forma, requiere permiso previo por escrito de la institución. Créditos

Apoyado por Proyecto PAPIME PE306815

Sitio web administrado por:
Dirección General de Divulgación de la Ciencia de la UNAM

Desarrollado por Smart Systems

/DGDCUNAM