IA de Sonos mejora sonido para personas con pérdida auditiva

La IA de Sonos mejora el sonido para personas con pérdida auditiva, proporcionando mayor claridad y optimizando la experiencia de quienes tienen dificultades para oír.
La IA de Sonos mejora el sonido para personas con pérdida auditiva, proporcionando mayor claridad y optimizando la experiencia de quienes tienen dificultades para oír.

 

Para muchas personas, seguir con claridad los diálogos en películas o series de televisión se ha convertido en un reto.

No solo por mezclas de audio deficientes o la diversidad de acentos, sino también por factores como la acústica del entorno o la pérdida auditiva.

Aumentar el volumen no siempre es suficiente, y recurrir a los subtítulos puede distraer de la experiencia visual.

En respuesta a esta problemática, Sonos presentó una versión actualizada de su función Mejora de la Voz, que ofrece cuatro niveles de ajuste diseñados para mejorar la claridad del diálogo.

Uno de estos niveles fue desarrollado específicamente para personas con pérdida auditiva.

Esta función, impulsada por Inteligencia Artificial, ya está disponible mediante una actualización gratuita para la barra de sonido Sonos Arc Ultra.

Colaboración con expertos.

Con el objetivo de crear una solución que respondiera a las necesidades reales de quienes tienen dificultades para escuchar diálogos, la compañía trabajó en conjunto con el Royal National Institute for Deaf People (RNID).

La colaboración incluyó a 37 participantes de distintas edades y capacidades auditivas, quienes probaron la función en una variedad de contenidos durante casi un año.

Así lo explica Matt Benatan, Principal Research Scientist en Sonos:

«No es sólo práctico, es emocional. Uno de los aspectos más importantes de ver un programa de televisión, series o películas es la oportunidad de crear vínculos a través de eventos culturales y de entretenimiento que se ven en tiempo real. Si un espectador no puede oír completamente el diálogo, entonces pierde la capacidad de disfrutar y participar en el momento».

Los ingenieros de la marca utilizaron aprendizaje automático para separar el diálogo del resto de los sonidos, logrando mayor nitidez sin comprometer la experiencia sonora general.

Harry Jones, Sound Experience Engineer en Sonos, agrega detalles:

«Esto nos permite extraer sólo el diálogo en los momentos más necesarios, sin afectar en exceso al volumen ni restar valor a la experiencia cinematográfica general».

Niveles para cada necesidad.

La función Mejora de la Voz puede activarse desde la pantalla de inicio de la app Sonos y ofrece cuatro niveles de intensidad:

  • Bajo: mejora sutil que mantiene la intención original del contenido.
  • Medio: proporciona mayor claridad sin alterar significativamente la mezcla sonora.
  • Alto: resalta el diálogo con mayor fuerza, reduciendo otros elementos del audio.
  • Máximo: diseñado específicamente para personas con pérdida auditiva, prioriza la claridad del diálogo sobre el resto del contenido sonoro.

A diferencia de los niveles más equilibrados, el nivel Máximo controla el rango dinámico de los sonidos no vocales, situando el diálogo en primer plano.

Experiencia desde el hogar.

La perspectiva de los usuarios fue central en el diseño de esta función.

Así lo afirma Lauren Ward, Lead Researcher del RNID:

«Queríamos asegurarnos de que la mejora de la voz funcionara para todos, incluso para aquellos que quizá ni siquiera se dieran cuenta de que tenían pérdida auditiva».

Agregó que uno de cada tres adultos en el Reino Unido y cerca de uno de cada cuatro en Estados Unidos sufren algún grado de pérdida auditiva.

Para perfeccionar el sistema, la marca también colaboró con Chris Jenkins, reconocido ingeniero de mezcla de sonido cinematográfico.

Su participación ayudó a trasladar técnicas profesionales de extracción de voz al entorno doméstico, manteniendo la fidelidad de los efectos y la música. Jenkins sostiene que:

«La nueva función de Mejora de la Voz de Sonos supone un gran avance a la hora de abordar los retos que plantea el diálogo en la amplia oferta de contenidos disponibles hoy en día. También es una prueba de la importancia de mantener el toque humano al crear con IA: hemos dedicado innumerables horas a sesiones de escucha en las que trabajamos en todos los detalles».

Benatan añadió que desde el inicio del proyecto, tuvieron claro que debía poner en el centro a las personas con pérdida auditiva. Explica que:

«Lo que aprendimos de los investigadores y participantes del RNID complementó a la perfección las aportaciones de Chris Jenkins, lo que nos permitió tener en cuenta una gama más amplia de perspectivas de los oyentes».
Compartir:
Los más leídos

Logo del podcast Entrevistas Exclusivas




RT

Información especializada de Tecnología, Innovación, Ciencia e Investigación global.