La ciencia

El estándar abierto para la calidad del video explicativo.

Leímos la investigación publicada sobre cómo aprende la gente con video y convertimos los hallazgos que resistieron el escrutinio en reglas numéricas que nuestro generador debe cumplir. Aquí está la especificación completa, con citas y todo, con lo que no pudimos verificar claramente marcado. Es pública porque un estándar que no puedes inspeccionar no es un estándar.

Cómo leer esto

Cada regla lleva su grado de evidencia.

Cualquiera puede afirmar estar basado en la ciencia. Calificamos cada afirmación para que distingas un efecto verificado de un supuesto de trabajo. La honestidad es la credibilidad.

Verificado Superó una verificación adversarial contra una fuente primaria.
Derivado Una consecuencia aritmética de una regla verificada.
Heurístico Canon de la práctica o extrapolación de los principios de Mayer, no verificado esta ronda.
Producto Una decisión de producto, no una afirmación de investigación.
Pipeline Una propiedad medida de nuestro propio pipeline.
Parte uno

Las once leyes de diseño.

Lo que la ciencia dice de verdad, con tamaños de efecto y un enlace a la fuente primaria de cada una.

L1 Verificado

El revelado progresivo es obligatorio, y la mayor palanca que controlamos.

El contenido construido trazo a trazo supera de forma medible a mostrar escenas terminadas. Retención ηp²=0.13 to 0.17, transferencia ηp²=0.10 to 0.16, replicado en dos experimentos con narración idéntica.

En Sketchie: Nunca cortes a un diagrama terminado. Cada elemento se dibuja. Esto no es estético, es el mecanismo de retención.

Fuente: PMC9898452
L2 Verificado

La mano visible es opcional. El dibujo no.

Dibujar a mano vs empujar con la mano vs sin mano cambió la motivación intrínseca (p=0.033) pero no produjo diferencia en los resultados de aprendizaje.

En Sketchie: Nos saltamos renderizar una mano y no perdemos nada medible. Lo que importa es el propio dibujado.

Fuente: Smart Learn. Env. 2023
L3 Verificado

La señalización compra retención y transferencia al reducir la carga cognitiva.

Metaanálisis, 32 studies, N≈3,597: las señales dan retención d=0.27, transferencia d=0.34, carga d=−0.11. La magnitud de la reducción de carga predice la ganancia de aprendizaje (β=−0.70 retención, −0.60 transferencia).

En Sketchie: Las flechas, los destellos de color y los revelados de etiqueta son señales, no decoración. Cada señal apunta a lo que la narración dice ahora mismo.

Fuente: PMC5576760
L4 Verificado

Segmenta, y deja huecos de procesamiento.

Un metaanálisis de segmentación encontró ganancias significativas de retención y transferencia, de pequeñas a medianas. Parte del beneficio viene del tiempo de procesamiento que crean los límites.

En Sketchie: Las escenas son segmentos. Tras el último revelado de una escena, la narración se mantiene en silencio al menos 0.7 seconds antes del corte.

Fuente: Rey et al. 2019
L5 Verificado

El precipicio de los seis minutos es real.

A lo largo de 6.9 million sesiones de edX, la interacción se sitúa cerca de 1.0 por debajo de 6 minutos, cae a alrededor de 0.55 entre 9 y 12 minutos, y baja a aproximadamente 0.2 pasados los 12 minutos. Reforzado de forma independiente en una replicación de 2026.

En Sketchie: La salida por defecto es 6:00 fijos. Las peticiones más largas se convierten en una serie de videos por capítulos, nunca en un video largo.

Fuente: Guo et al. 2014
L6 Verificado

El dibujo estilo Khan supera a las diapositivas en cualquier duración.

Alrededor de 0.72 vs 0.52 de interacción normalizada entre 3 y 6 minutos, atribuido al movimiento dibujado a mano más una entrega hablada e improvisada.

En Sketchie: El formato está validado. La narración debe sonar hablada, no leída. Se permiten las contracciones, se anima al trato directo.

Fuente: Guo et al. 2014
L7 Verificado

La narrativa y el revelado progresivo deben ir juntos.

Un guion narrativo mejoró la transferencia (ηp²=0.12 to 0.20) pero no la retención por sí solo. Combinado CON el dibujo progresivo, lo narrativo superó a lo informativo en retención (p=0.021). Sobre visuales ESTÁTICOS, ganó en su lugar un guion informativo (η²=0.21 to 0.24).

En Sketchie: Nuestros guiones usan gramática de historia, un actor con un objetivo, un obstáculo y una resolución, precisamente porque siempre renderizamos de forma progresiva. Nunca voz en off narrativa sobre un fotograma estático.

Fuente: PMC9898452
L8 Verificado

Sin detalles seductores.

El contenido interesante pero irrelevante no mejora el aprendizaje.

En Sketchie: Cada elemento visual debe estar referido por la narración. La decoración no referida es un fallo, no un adorno.

Fuente: Mayer 2020
L9 Verificado

Termina con generación, no solo con un resumen.

Las indicaciones que hacen que quien aprende resuma o explique mejoran el aprendizaje. Es el principio de la actividad generativa.

En Sketchie: Cada video termina con un momento de recuperación: aparece una pregunta, el video se pausa 1.5 to 2 seconds, y luego un resumen de una línea.

Fuente: Springer 2020
L10 Verificado

Los límites de evento reinician la atención.

Más puntos de cambio visual y narrativo significan menos divagación mental.

En Sketchie: Los cambios de escena son reinicios de atención. Colócalos en los límites de las ideas, nunca a mitad de idea.

Fuente: Nature HSSC 2026
L11 Verificado

No optimices para la estética del número de visitas.

La calidad explicativa no correlaciona con las visitas una vez controlado el tamaño del canal (r=0.23, no significativo). Solo correlacionan los me gusta, los comentarios relevantes y las interacciones.

En Sketchie: Calificamos el diseño de aprendizaje, no las señales de viralidad.

Fuente: arXiv 2207.05872
Parte dos

Los números que el pipeline debe alcanzar.

Las leyes de arriba se convierten en objetivos concretos. Este es el contrato contra el que se comprueba el generador en cada render.

Parámetro Objetivo Grado
Duración total del video techo fijo de 6:00; punto ideal de 1:00 to 3:00 por concepto Verificado
Granularidad de la duración incrementos de 30-second Producto
Duración de escena 12 to 30 seconds, una idea por escena Verificado
Elementos por escena 3 to 7 visibles al final de la escena, título incluido Heurístico
Cadencia de revelado un nuevo elemento cada 2 to 5 seconds; nunca dos revelados a menos de 1.2s Derivado
Sincronía revelado-palabra el elemento aparece dentro de ±500ms de su palabra desencadenante Derivado
Cobertura de sincronía de palabra al menos el 95% de los elementos llevan una palabra de revelado que se resuelve Pipeline
Hueco post-escena al menos 0.7s de silencio de narración tras el último revelado, antes del corte Verificado
Estilo de revelado dibujado de contorno (0.3 to 0.5s), luego un barrido de relleno escalonado; flechas de punta a cola Verificado
Mano visible ninguna Verificado
Etiquetas tres palabras o menos, palabra clave en mayúsculas; nunca una frase que refleje la narración Heurístico
Ritmo de narración 140 to 160 words per minute, registro hablado, contracciones permitidas Heurístico
Estructura del guion gancho en los primeros 10s, analogía concreta, mecanismo, anclaje en el mundo real, momento de recuperación, resumen Verificado
Gramática narrativa actor, objetivo, obstáculo, resolución, siempre que el dominio lo permita Verificado
Analogía al menos una analogía concreta antes del primer término abstracto Heurístico
Visuales extraños cero elementos no referidos por la narración Verificado
Cierre pregunta de recuperación, una pausa de al menos 1.5s, luego un resumen de una línea Verificado
Transiciones de escena corte seco solo en un límite de idea, nunca a mitad de idea Verificado
Parte tres

El arnés de evaluación de tres capas.

Una regla solo es real si puedes probarla. Cada vídeo pasa por tres capas antes de que se le permita salir.

Layer A

Mecánica

Aserciones de JavaScript puro sobre el scene graph y los tiempos de las palabras. Coste cero, seguro para ejecutar en CI. Duración total bajo el techo, cada escena en su banda de duración, 3 to 7 elementos por escena, cada elemento lleva una palabra de revelado que cae dentro de ±500ms de la palabra hablada, una escena final con una pregunta y un resumen, y ningún elemento no referido por la narración. Pasa o falla, sin llamadas a modelos.

Layer B

Semántica

Una pasada de modelo como juez, puntuada de 1 a 5, muestreada y ejecutada en el lanzamiento, nunca en CI. Una idea por escena, fidelidad de los íconos, si la analogía realmente mapea al mecanismo, calidad del gancho, un escaneo de detalles seductores, y fidelidad al documento fuente. Cualquier dimensión por debajo de 3 falla la puerta de lanzamiento.

Layer C

Verificación de salida

Comprobaciones sobre el propio archivo renderizado. Una hoja de contactos confirma que no hay elementos superpuestos y que las etiquetas son legibles, una ráfaga de fotogramas confirma que el revelado contorno-luego-relleno está realmente presente, y el audio está normalizado en volumen sin frases recortadas en los cortes.

No un manifiesto, una puerta

Cómo lo impone Sketchie.

La especificación solo vale algo si un video que la rompe no puede salir. La Capa A se ejecuta en el momento de la generación, sobre el scene graph, antes de gastar un centavo en voz o renderizado. Un grafo que falla las comprobaciones mecánicas se devuelve para regenerarse con los fallos exactos inyectados en el prompt. Un grafo que sigue fallando nunca se convierte en video.

Cada comprobación de la lista de arriba mapea a una aserción real en nuestro motor: el techo de duración total, la banda de duración por escena, el conteo de elementos, la tasa de resolución de palabra de revelado, el silencio post-escena, las reglas de etiqueta y el cierre pregunta-más-resumen. Las flechas también se comprueban, así que un puntero nunca cruza un elemento con el que no está conectado. El mismo código corre en la puerta de regeneración del worker y en la integración continua, así que un cambio en el generador que regrese la calidad se bloquea a sí mismo.

El estándar abierto de evaluación en GitHub Lee el código fuente de la Capa A Empezar

Mascota de Sketchie

Hecho para ser recordado.

Empezar