La voz es mucho más que un conjunto de sonidos que forman palabras. Es nuestra huella sonora: en ella reconocemos nuestras emociones, nuestro acento, nuestro ritmo al hablar y parte de nuestra historia personal.
Algunas enfermedades, como la ELA, la esclerosis múltiple y otras enfermedades neuromusculares o neurodegenerativas, así como determinadas intervenciones quirúrgicas, pueden afectar a la capacidad de hablar. En estos casos, la tecnología puede convertirse en una gran aliada para preservar una parte importante de nuestra identidad. Conocer con antelación las herramientas que permiten preservar o recrear la voz puede ayudarnos a prepararnos y tomar decisiones con más calma.
En Qinera creemos que la comunicación debe ser funcional, pero también personal y humana. Por eso, queremos hablarte de las voces personalizadas y de dos soluciones que permiten preservar o recrear una voz para utilizarla en un comunicador: My Own Voice y ElevenLabs.
En este artículo te explicamos cómo funciona cada una y qué aspectos conviene valorar antes de elegir.

¿Por qué puede ser importante utilizar tu propia voz?
La voz de un comunicador es la que permite hacer audible aquello que la persona escribe o selecciona. Pero su función no se limita únicamente a transmitir un mensaje: también puede influir en cómo se siente la persona al comunicarse y en cómo quiere presentarse ante los demás.
Por eso, utilizar una voz digital creada a partir de la propia (o de grabaciones personales) puede aportar un valor especialmente importante:
- Conexión emocional: escuchar una voz con rasgos propios puede hacer que la comunicación resulte más cercana tanto para la persona como para su familia y su entorno.
- Identidad: conservar características como el acento, el timbre o la entonación puede ayudar a que la persona se reconozca en la voz de su comunicador.
- Participación social: disponer de una voz más personal permite que el comunicador no solo transmita lo que la persona quiere decir, sino también parte de cómo quiere expresarse ante los demás.
My Own Voice y ElevenLabs: dos formas de crear una voz personalizada
Ambos permiten crear una voz digital a partir de grabaciones de la propia persona, pero lo hacen mediante procesos diferentes.
My Own Voice está específicamente diseñado para preservar la voz antes de que el habla cambie o se pierda. Para ello, propone una grabación guiada con un conjunto concreto de frases.
ElevenLabs, por su parte, utiliza inteligencia artificial para recrear una voz a partir de muestras de audio. Estas pueden grabarse expresamente para crearla o proceder, en algunos casos, de notas de voz, vídeos y otros archivos anteriores.
Conocer cómo funciona cada solución puede ayudar a valorar cuál se adapta mejor al momento en el que se encuentra la persona, al material disponible y al comunicador que utilizará. – Gil Barrero, asesor en tecnología de apoyo
My Own Voice: preservar la voz mediante una grabación guiada
Acapela My Own Voice es un servicio de banco de voz pensado especialmente para personas cuya capacidad de hablar puede verse afectada por una enfermedad o una intervención quirúrgica. El proceso consiste en grabar 50 frases breves y fonéticamente equilibradas. A partir de ellas, el sistema crea una voz sintética personalizada capaz de leer cualquier texto escrito en un comunicador.
La persona puede registrarse en la plataforma, realizar las grabaciones, generar su voz y probar el resultado online antes de adquirir la licencia necesaria para instalarla en un dispositivo o aplicación compatible. Una vez instalada, la voz puede utilizarse sin conexión a internet. Esto permite disponer de ella también fuera de casa, durante desplazamientos o en lugares donde la cobertura sea limitada. Es posible utilizarla con los programas TD Snap, TD Communicator y otros.
My Own Voice puede resultar especialmente útil cuando la persona todavía puede realizar las grabaciones y quiere dejar preparada una voz personalizada para utilizarla si la necesita más adelante. – Gil Barrero, asesor en tecnología de apoyo

ElevenLabs: recrear la voz mediante inteligencia artificial
ElevenLabs permite crear una voz digital mediante inteligencia artificial a partir de diferentes muestras de audio. Estas muestras pueden proceder de grabaciones realizadas expresamente para crear la voz o de archivos anteriores, como notas de voz y vídeos. Esta posibilidad puede resultar especialmente valiosa cuando la persona ya no puede realizar un proceso de banco de voz guiado, pero conserva grabaciones en las que su voz se escucha con suficiente claridad.
ElevenLabs ofrece diferentes procesos de clonación. En ambos casos, la calidad y la consistencia del material influyen directamente en el resultado:
- Clonación instantánea: puede trabajar con una cantidad reducida de audio,
- Clonación profesional: necesita grabaciones más extensas para crear un modelo más detallado de la voz.
Las voces creadas con ElevenLabs pueden conectarse con Grid 3 y Grid for iPad, TD Snap y Communicator 5 mediante una cuenta y una clave de acceso. Como la generación del audio se realiza a través de sus servidores, es necesario disponer de conexión a internet para utilizar la voz.

¿Qué diferencias conviene tener en cuenta?
Aunque ambas soluciones permiten personalizar la voz de un comunicador, existen algunas diferencias prácticas que pueden ayudar a orientar la elección.
El momento en el que se realiza el proceso
- My Own Voice está pensado principalmente para preservar la voz mientras la persona todavía puede completar una grabación guiada.
- ElevenLabs también puede utilizar grabaciones nuevas, pero permite valorar archivos anteriores cuando ya no es posible seguir un guion específico.
Las grabaciones necesarias
- My Own Voice utiliza un guion cerrado de 50 frases, creado para recoger los sonidos necesarios del idioma y generar posteriormente cualquier mensaje.
- ElevenLabs trabaja con muestras de audio libres. Estas pueden ser grabaciones preparadas para el proceso o archivos ya existentes, siempre que tengan una calidad suficiente.
La conexión a internet
- Una vez instalada, la voz de My Own Voice puede utilizarse localmente sin depender de una conexión permanente.
- ElevenLabs funciona en la nube y necesita internet para generar los mensajes con la voz personalizada, lo que genera una cierta latencia o retardo en el mensaje. Si la conexión falla al utilizarla en el software de comunicación, el programa puede recurrir a la voz instalada en el dispositivo.
El software de comunicación
- My Own Voice puede adquirirse desde nuestra página web y también está incluida en los dispositivos de Tobii Dynavox (TD Navio, TD I-110, TD Pilot y TD I-Series) con el proceso de grabación guiado por frases.
- ElevenLabs dispone de integración con Grid 3 y Grid for iPad, TD Snap y Communicator 5, donde la voz se conecta mediante la cuenta y la clave de acceso del usuario.
La forma de acceder a la voz
- My Own Voice permite crear y probar la voz antes de adquirir la licencia necesaria para instalarla y utilizarla en un comunicador.
- ElevenLabs funciona mediante una cuenta y un servicio online. Los usuarios con licencia de Grid 3 tienen cuenta gratuita y las personas con ELA pueden solicitarla gracias a un programa de la ONG Bridging Voice (https://bridgingvoice.org/).
La privacidad de los datos
- My Own Voice es un servicio de pago y ofrece privacidad en los datos compartidos (las grabaciones) que no son utilizados para entrenar otros modelos.
- ElevenLabs utiliza las grabaciones de los diferentes usuarios para entrenar otros modelos de voz, tus datos pueden ser utilizados de forma anónima para otros desarrollos.

¿Qué opción puede adaptarse mejor a cada persona?
No existe una respuesta única. La elección dependerá del momento en el que se encuentre la persona, de si todavía puede realizar nuevas grabaciones, del material de audio disponible y del comunicador o software que vaya a utilizar.
My Own Voice puede ser una opción especialmente adecuada cuando todavía es posible completar una grabación guiada y se quiere preservar la voz con antelación. El proceso permite crear y escuchar el resultado antes de adquirir la licencia y, una vez instalada en un dispositivo compatible, utilizar la voz sin depender de una conexión permanente a internet.
Por su parte, ElevenLabs puede resultar interesante para personas que ya utilizan Grid 3 o Grid for iPad y disponen de una conexión estable. También permite trabajar con grabaciones nuevas o valorar audios anteriores, siempre que tengan la calidad suficiente para generar una voz personalizada.
Más que buscar una solución mejor que otra, se trata de conocer cómo funciona cada una y valorar cuál responde mejor a las necesidades, preferencias y circunstancias de la persona.
En Qinera te acompañamos en el proceso
Sabemos que este proceso y la elección de una herramienta puede generar muchas dudas. En Qinera te ayudamos a comprender cómo funcionan My Own Voice y ElevenLabs, valorar las grabaciones disponibles y comprobar su compatibilidad con el comunicador o software que utilizas.
Nuestro equipo de expertos no solo te ayuda con la parte técnica de la configuración, sino que te asesora desde una perspectiva terapéutica para encontrar la herramienta que mejor se adapte a tu vida. ¿Quieres conocer cómo podría sonar tu voz digital? Contacta con nuestro equipo y te ayudaremos a valorar las opciones y los siguientes pasos.

Gil Barrero
Especialista en informática y tecnología adaptada. Experto en accesos, sistemas de posicionamiento y videojuegos accesibles. Asesor en tecnología de apoyo en Qinera.
Si deseas ponerte en contacto con Gil, puedes hacerlo por medio de su correo electrónico (gil.barrero@qinera.com).
Leer sus artículos