¡Mi celular no me oye!

Los programas para reconocer la voz de mando en los teléfonos celulares aun no están diseñados para entender todos los idiomas en el mundo

Los sistemas de reconocimiento de voz, como Siri, son cada vez más sofisticados, pero están lejos de ser perfectos y de comportarse como humanos.

¿Cuántas veces has hecho una pregunta o le pides a Siri, Google Voice o S-Voice que haga algo, pero no entienden tu instrucción? Cuando se lo dices en inglés, piensas que no te entiende por tu acento, pero luego si hablas en español, tampoco te entiende, especialmente si son palabras en inglés.

“Es como construir castillos en el cielo”, manifiesta Pedro Moreno, investigador y científico principal del equipo de reconocimiento de voz de Google, a CNET en Español, en Nueva York.

“Y la razón es porque hay entre 5,000 y 6,000 idiomas hablados en el planeta, pero solamente 300 tienen más de un millón de personas. Si cubrimos esas 300 lenguas, tendríamos casi un 99 por ciento de la población”, asegura.

Google tiene mucho terreno que cubrir. Su software de reconocimiento de voz, Google Now, solamente entiende 48 idiomas, algunos de poblaciones con menos de un millón de personas– entre ellos catalán, vasco y gallego.

ACOSTÚMBRATE A MI VOZ

1390435683_230114tecno2

Pero ¿cómo se llega al punto donde una máquina puede aprender a reconocer tu voz?

“A cierto nivel, (el software) imita cómo funciona el cerebro”, explica Moreno. “Piensa en esto como si (la máquina) fuera un humano. Si (el humano) pasa tiempo en el estado de Louisiana, aunque se haya criado en el Bronx, Nueva York, puede que le tome algunas semanas –tal vez menos– para empezar a entender cómo hablan”, señala Moreno, haciendo referencia al fuerte acento de los habitantes de esta ciudad en el sur de los Estados Unidos.

“Es cuestión de exponer la red neuronal artificial a todos estos acentos diferentes”, asegura.

La red neuronal artificial –de una tecnología parte del área de computación de la inteligencia artificial– imita la red neuronal del cerebro humano por la manera que aprende.

En el caso del reconocimiento de voz, explica Moreno, se programa el software para recibir las ondas fonéticas de la voz de un individuo, procesar dicha información y convertirla en texto. Después de eso se crean los parámetros de la red neuronal artificial para comenzar a predecir el texto que debería escribir según lo que escuchó. Google usa este proceso.

1390435677_230114tecno3

Tecnología Celular voz archivo

Puede interesarte

×

El contenido de LA PRENSA es el resultado de mucho esfuerzo. Te invitamos a compartirlo y así contribuís a mantener vivo el periodismo independiente en Nicaragua.

Comparte nuestro enlace:

Si aún no sos suscriptor, te invitamos a suscribirte aquí