Los japoneses apuestan a manejar la TV con la voz

Por María Sol Pogliani
Los nipones están cada vez más cerca de su objetivo. Por lo menos, ya concluyeron la primera de las tres etapas necesarias para alcanzarlo, al concluir el desarrollo de un novedoso software que separa la voz del ruido ambiente y de otras voces que se emiten simultáneamente. En el diseño del sistema –que está en trámite de patentamiento- participaron científicos de la Facultad de Ingeniería de la UNER y de Ingeniería y Ciencias Hídricas de la UNL

El control remoto es el centro de disputa en las familias, pero los japoneses cambiarán en poco tiempo esta realidad. Las grandes industrias niponas están interesadas en producir televisores que se manejen a través de la voz.

La fantasía del espectador de dominar la TV sin aparato alguno, se podrá concretar en el mediano plazo gracias al trabajo desempeñado por Diego Milone, Leandro Di Persia, y Masuzo Yanagida, quienes realizaron sus actividades de investigación y desarrollo en las Universidades Nacionales del Litoral, Entre Ríos y Doshisha (Japón).

Luego de tres años, los científicos lograron desarrollar un software capaz de distinguir señales, separarlas y limpiar las voces de otros ruidos; uno de los problemas centrales de quienes estudian las aplicaciones de voz a los sistemas de comunicación.

Con el software listo, ya se cumplió la primera de las tres etapas necesarias para producir la TV inteligente. “Nuestro desarrollo se concentra en la etapa inicial de procesamiento de la señal. Una vez obtenida la voz limpia, el sistema debe realizar un reconocimiento de la voz para detectar lo que se dijo, luego debe evaluar si la orden responde a comandos válidos para el televisor y finalmente debe transformar esos comandos en señales electrónicas que controlen el televisor’’, explicó Leandro Di Persia.

La vinculación establecida entre las universidades llevó al bioingeniero a viajar a Japón y conocer el proyecto que desvelaba a los nipones. "Estaban trabajando en sistemas para control remoto de televisores y como en ese caso los micrófonos están lejos del hablante se capta mucho ruido del ambiente. Por eso, estaban investigando la alternativa de la separación ciega de fuentes para mejorar la calidad de la señal. Ahí me propusieron trabajar en eso, y luego de mi retorno a la Argentina, realicé la tesis doctoral en coincidencia con lo que había comenzado a trabajar en Japón", comentó Di Persia.

Novedoso y patentable

A pesar de que existen otros sistemas que utilizan métodos para mitigar el efecto del ruido ambiente, el software desarrollado por argentinos y japoneses es novedoso porque separa múltiples fuentes sonaras basadas en sus propiedades estadísticas y sin necesitar ningún dato sobre el tipo de sonido ni su posición. La técnica utilizada se denomina "separación ciega de fuentes" y hasta ahora no existe ningún software en el mercado que utilice este tipo de tecnología.

El sistema, que posee una alta velocidad de procesamiento, no sólo distingue los sonidos del ruido ambiente sino que también separa la voz de otras que se emiten simultáneamente.

El software no sólo es útil para dominar televisores sin que medie control remoto alguno sino también "para la etapa de preprocesamiento de cualquier sistema que utilice al habla y deba funcionar en condiciones en las que puede introducirse ruido, como teléfonos en modo de manos libres, sistemas de videoconferencias, audífonos digitales para hipoacúsicos y reconocedores del habla para computadoras", sostuvo el Dr. Diego Milone.

El software (asociado al TV) ya esta en trámite de patentamiento, último paso para "formalizar la transferencia entre el mundo académico y la industria", concluyó Milone, quien destacó que la investigación pudo realizarse gracias al financiamiento obtenido por los proyectos UNL CAID 012-72 y ANPCyT PICT 11-12700 de la UNER (que contó con el aporte de la Agencia Nacional de Promoción Científica y Tecnológica).