Publicidad
 
11/07/2019

Crean robot que predice gestos escuchando sólo tu voz

Crean software que predice las expresiones corporales de una persona con sólo oír lo que dice
Crean robot que predice gestos escuchando sólo tu voz
Crean robot que predice gestos escuchando sólo tu voz

 

Cuando hablamos nuestro cuerpo se mueve en sincronía, ya sea que los ojos se agranden al remarcar  una palabra en especial o movimientos más grandes como saludar con una mano , hacer un chasquido o aplaudir al compás de una canción. En ese sentido un grupo de investigadores diseñaron un software con Inteligencia Artificial que sabe cómo se moverá una persona basándose únicamente en el sonido de la voz ¿ increíble, cierto?

 

¿ Cómo fue el proceso?

Los desarrolladores grabaron 144 horas de video de 10 personas diferentes que hablaban. Los convocados fueron una profesora de química, una monja, y cinco presentadores de programas de televisión: Conan O'Brien, Ellen DeGeneres, John Oliver, Jon Stewart y Seth Meyers.

Utilizando un algoritmo que ya existía para producir figuras con "palitos" (esqueléticas) que representan las posiciones de los brazos y las manos de la persona que está hablando, lograron buenos resultados en la etapa inicial. Después, entrenaron su propio algoritmo con esos datos para que pudiera  predecir los gestos basándose en el nuevo audio de los altavoces.

 

 

 

Los gestos generados por el software fueron mucho más cercanos a la realidad que los que se seleccionaron al azar del mismo orador. Otro software parecido, diseñado originalmente para anticipar los movimientos de las manos de violinistas y pianistas, ya habia sido desarrollado, el mismo se utilizó para comparar las diferencias con el primero en cuestión, pero estas predicciones también fueron superadas.

 

Otra de las estrategias planteadas fue entrenar a una persona para predecir los gestos de otra y no tuvo tan buenos resultados como  el software.

 

Alimentar los gestos pronosticados en un algoritmo de generación de imágenes existente llevó a videos semirrealistas, ahora el siguiente paso del equipo de desarrolladores es predecir gestos basados no solo en el audio, sino también en las transcripciones de los mismos. 

 

Las aplicaciones potenciales incluyen la creación de personajes animados, robots que se mueven naturalmente o firmas de movimiento de personas para identificar videos falsos.

 

Video: Youtube 

Foto: Pixubay