La voz que explica
La explicación se dice con voces neuronales que se generan en la nube, párrafo por párrafo, y quedan guardadas con el documento. Tu computadora o tu teléfono solo reproduce el audio: no hay modelos que bajar ni nada que instalar.
Las voces
Las voces son de un idioma y no de la app: una voz castellana leyendo inglés suena a alguien leyendo en un idioma que no sabe. Las que se ofrecen son las del idioma de la presentación, que es el de la explicación, y hay dos en cada uno:
- Mina, femenina. Es la que viene elegida.
- Mino, masculina.
Se llaman igual en español y en inglés, pero no son la misma voz traducida: cada idioma tiene las suyas, nativas de ese idioma. Y sí, Mina es también el nombre del personaje de la app.
La voz se cambia desde los ajustes del dock, en cualquier momento, y cada documento sigue con la voz con la que lo venías escuchando. Cambiarla no vuelve a pensar la explicación: el guion ya está escrito y lo que se hace de nuevo es decirlo.
La velocidad
De 0,8× a 1,75×, en siete pasos. La velocidad no regenera nada: es el audio que ya está, dicho más rápido o más lento, así que se puede mover en la mitad de una frase sin esperar.
De corrido
Al terminar la última idea de la diapositiva, y la pregunta si están encendidas, pasa a la siguiente y sigue. Es lo que convierte a Filmina en algo que se escucha de corrido en vez de algo que se le va pidiendo de a una. Para quedarte en una diapositiva, pausa.
Si la que sigue todavía se está preparando, Mina te lo dice («Preparando la explicación») y la diapositiva arranca sola apenas está lista.
La misma voz lee también el resumen de la clase, tema por tema. Y cuando cierras el chat con la clase sonando, dice «Sigamos» y retoma el párrafo desde el principio, para que no vuelvas a la mitad de una frase.
Se dice una sola vez
El audio de cada párrafo se genera una sola vez y queda guardado con el documento. Volver a escuchar una diapositiva, retroceder o abrir la clase otro día, en otro dispositivo, reproduce lo que ya estaba: no se genera de nuevo y no gasta minutos de explicación de tu plan.
Lo que sí genera audio nuevo es lo que todavía no se dijo: una diapositiva que no habías escuchado, la misma con la otra voz o un párrafo que se reescribió porque marcaste que estaba mal. Cuántos minutos trae cada plan está en los precios.
En modo silencioso la explicación se escribe pero no se dice. La voz se genera recién cuando pasas a narrado.