Video vs. texto: qué se recuerda realmente dentro de una empresa.
No todo video le gana a todo texto. La investigación es más específica que eso — y esa especificidad es exactamente lo que determina si el mensaje de un líder sobrevive el contacto con la semana ocupada de un empleado.
Dos canales son mejor que uno
En 1971, el psicólogo Allan Paivio propuso la teoría de la codificación dual: la mente procesa la información verbal (palabras) y la información no verbal (imágenes) a través de dos canales separados, y la información codificada a través de ambos canales a la vez es más fácil de recuperar después que la información codificada a través de uno solo. Un memo activa solo el canal verbal. Una persona hablando frente a cámara — voz, cara, tono, gesto — activa ambos al mismo tiempo.
Esta es la razón mecanicista por la que un video estilo documental tiende a quedarse en la gente de una forma en que un anuncio escrito no lo hace: no es una preferencia estilística, es una diferencia en cuántos caminos de recuperación tiene la memoria.
Dónde se rompe el efecto
La versión honesta de esta investigación tiene un límite que vale la pena señalar. La investigación sobre aprendizaje multimedia de Richard Mayer — recopilada en The Cambridge Handbook of Multimedia Learning — encontró que agregar texto en pantalla que repite lo que ya está diciendo un narrador no ayuda a la retención, y en la mayoría de los casos probados la perjudica. Obligar a la gente a leer y escuchar las mismas palabras al mismo tiempo compite por la misma memoria de trabajo limitada en lugar de usar dos canales separados.
La ventaja no es el "video" en abstracto. Es específicamente combinar imágenes con narración — no apilar narración sobre texto, y no reemplazar a una persona real con un slide deck que alguien lee en voz alta. Un video de un CEO hablando a cámara activa la codificación dual. Un video de un CEO leyendo bullet points de un slide, en general, no.
Qué agrega esto más allá de la memoria
La codificación dual explica por qué un mensaje se retiene. No explica del todo por qué se le cree — eso viene de lo que el texto estructuralmente no puede transmitir: tono, expresión facial, ritmo, la diferencia visible entre alguien que cree lo que dice y alguien que recita puntos preparados. Esas señales no verbales son parte de cómo la gente decide si creerle a un mensaje, no solo si lo recuerda.
El video también compone (compounds) de forma distinta a un formato solo en vivo. Un mensaje que solo existió en la sala donde se dijo no se puede volver a visitar — un video archivado sí. Esa posibilidad de volver a verlo es lo que convierte una sola exposición en message compounding: la misma pieza sigue generando oportunidades de recuperación mucho después del día en que se publicó.
Qué significa esto para tu empresa
Personas reales frente a cámara, no slides leídos en voz alta. La ventaja de retención viene de combinar una voz real con una cara real, no del formato de video en sí mismo.
No subtitules sobre la narración para dar énfasis. Duplicar el mensaje en texto en pantalla tiende a hacerlo más difícil de retener, no más fácil.
Archivalo para que se pueda volver a ver. Una sola exposición es un solo punto de datos. Una que se puede recuperar sigue rindiendo.

Sobre el autor
Alejandro Butula García es co-founder de Hermann® y dirige la identidad audiovisual de cada cliente. Veintiocho años en publicidad, documental y producción de nivel olímpico, incluyendo campañas para Procter & Gamble y la serie del Olympic Channel Heroes of the Future.
Fuentes
- Paivio, A. (1971). Imagery and Verbal Processes. New York: Holt, Rinehart & Winston.
- Mayer, R.E. (Ed.). The Cambridge Handbook of Multimedia Learning. Cambridge University Press.
Si no sos quien toma la decisión,
no agendes.