Cómo explica cada diapositiva
Una diapositiva no es un texto corrido: son bloques sueltos en una hoja, y muchas veces un gráfico, una tabla o un esquema. Filmina trabaja sobre eso, y de ahí salen las dos cosas que la separan de un lector en voz alta: que explica en vez de leer, y que puede señalar de qué habla.
Lo que se lee de la diapositiva
De cada página se guardan dos cosas: la imagen, tal como se ve, y los bloques de texto con sus coordenadas. Las coordenadas son lo que después le permite al marco rodear el bloque exacto del que habla la voz. La imagen va al modelo junto con el texto, para que lea también lo que no está escrito en bloques.
No todo lo que hay escrito en la hoja es contenido. Antes de explicar se descartan los encabezados corridos, los pies, el número de página, la fecha y las direcciones sueltas: el número y la fecha se reconocen por su forma, y el encabezado y el pie, porque se repiten página tras página en el borde de arriba o en el de abajo. Si pasaran, la regla de cobertura total obligaría a explicarte el pie de página.
Un PDF escaneado es una foto de cada página, sin texto adentro, y ahí no hay bloques que leer ni que señalar. En vez de inventar, Mina te avisa al subirlo. Si tienes la presentación original, conviene subir esa.
Los segmentos
La explicación no vuelve como un bloque de texto: vuelve partida en segmentos de una idea, entre tres y siete por diapositiva, de diez a treinta segundos hablados cada uno. Cada segmento sabe qué bloques de la hoja cubre, y junta solo los que están cerca: un título con su párrafo, una caja con su lista.
Eso es lo que hace que el marco pueda moverse: el segmento que suena dice dónde mirar. Y es también la unidad con la que se navega, porque con las flechas de arriba y abajo se salta de una idea a la otra, no de un segundo al otro.
Lo que el modelo tiene prohibido
La explicación se escribe para ser escuchada, no leída, y eso son reglas concretas:
- No lee textual. Reformula, conecta y dice qué significa cada cosa y por qué importa. La diapositiva ya está delante.
- Precisión absoluta. Cifras, nombres, fórmulas, fechas y términos técnicos se respetan exactamente como figuran. No se redondea y no se cambia un término por un sinónimo informal.
- Sin preámbulo y sin cierre. Nada de «vamos a ver», «en esta diapositiva vemos» ni «estamos en la 22 de 62». Son los segundos que uno pasa esperando a que empiece lo que importa, así que la primera frase ya está afirmando algo del tema.
- Sin markdown. Prosa corrida: ni asteriscos, ni viñetas, ni numeración, ni tablas, ni emojis. Nada de eso suena.
- La notación, en palabras. «P de A dado B», no «pe paréntesis a barra be». Los símbolos y las fórmulas se escriben como se dicen antes de llegar a la voz, que es donde se rompen los lectores en voz alta, y se dice el símbolo que figura en la diapositiva, no el que se suele usar en la materia.
- Lo que ya se dijo no se repite. Si la diapositiva sigue con el mismo título que la anterior, lo que es eso ya se explicó: no se vuelve a definir, ni de pasada, y se cuenta solo lo que agrega esta.
La cobertura se verifica por código
Pedirle a un modelo que no se saltee nada no alcanza: hay que comprobarlo. Cuando la respuesta vuelve se revisa bloque por bloque que ninguno haya quedado sin explicar, y si falta alguno se le vuelve a pedir solo por ese. Las imágenes de la diapositiva entran en la misma cuenta: cada una se explica, o el modelo tiene que decir que solo decora. Y si un bloque de texto sigue faltando después del segundo pedido, se lee tal como está: es menos elegante, pero no queda afuera.
La cobertura no depende de que el modelo haga caso. Se comprueba, y lo que falta se pide de nuevo.
Los gráficos, las tablas y los esquemas
El modelo recibe la diapositiva como imagen, la misma que estás mirando, además de su texto. Así lee lo que en los bloques no está: los datos de un gráfico o de una tabla, los pasos de un esquema, una captura de pantalla, la aclaración chica en una esquina. Una tabla se cuenta con sus números, no se anuncia. Y lo que no llega a leer con seguridad, no lo adivina.
Cuando un segmento habla solo de una imagen, el marco va a ella. Una diapositiva que no tiene más que una imagen también se explica, si la imagen dice algo. Si solo decora (un logo, un fondo, una foto que acompaña), la voz te pide que la mires y sigue, en vez de describirte un adorno para tener algo que decir.
Los rótulos sueltos de un diagrama son un caso aparte. Se explican en conjunto, en un solo segmento, describiendo qué muestra el esquema y cómo se relacionan esos elementos según la diapositiva. Son etiquetas de un dibujo, no afirmaciones del material: dedicarle un segmento a cada palabra suelta sería inventarle una definición a cada una. Las fórmulas, en cambio, no son rótulos: de cada una se explica qué calcula y qué representa cada término.
Tus notas y tu material también cuentan
Si el documento tiene notas de clase, cada diapositiva se queda con los renglones de tus notas que comparten con ella las palabras menos comunes de la clase, y el modelo los recibe junto con los bloques. Lo que la nota agrega, se cuenta; lo que solo subraya algo que ya está en la diapositiva, le da más peso a esa parte. Cómo se cargan y cómo se dejan afuera está en las notas de clase.
Lo mismo con el material que sumaste a la clase, como un libro, un apunte, un audio o un video: los pedazos que hablan de lo mismo que la diapositiva llegan junto con ella. Se usan solo donde la aclaran (una definición más completa, un ejemplo, un porqué), y si el material la contradice, manda la diapositiva.
En qué idioma explica
La explicación va en el idioma en que está escrita la presentación, español o inglés, y no en el de la app: una clase en inglés se explica en inglés aunque Filmina esté en castellano. Se mira una sola vez, en las primeras páginas, y las voces que se ofrecen son las de ese idioma. Si no hay texto suficiente para decidir, se usa el de la app.
Si algo se cuela
Las reglas hacen que el modelo invente mucho menos, no que no pueda inventar nunca. Por eso cada párrafo del guion tiene un «Esto está mal»: al tocarlo, Filmina vuelve a mirar la diapositiva, con su imagen, tus notas y tu material, y si te da la razón reescribe ese párrafo y le pone voz de nuevo. Lo que se confirma queda aprendido para esa clase. Cómo funciona está en el visor.
Se prepara por delante
Mientras escuchas una diapositiva, las dos que siguen se van preparando por detrás, así que al pasar a la próxima casi nunca esperas. No se prepara el documento entero de una vez: solo lo que estás por escuchar.
La diapositiva que estás mirando va siempre primero: si saltas a otra, esa pasa adelante de las que se estaban preparando. Al cerrar el documento se deja de preparar lo que quedaba en cola, y al volver se retoma lo que falte.
Lo generado queda guardado en tu cuenta. El guion se guarda por idioma y el audio por voz: cambiar de voz no vuelve a pensar la explicación, la vuelve a decir. Y volver a escuchar lo que ya se explicó no lo genera de nuevo ni gasta minutos de tu plan.