La science

Le standard ouvert de la qualité des vidéos explicatives.

Nous avons lu la recherche publiée sur la façon dont les gens apprennent par la vidéo et transformé les conclusions qui ont résisté à l’examen en règles numériques que notre générateur doit respecter. Voici toute la spécification, citations comprises, avec ce que nous n’avons pas pu vérifier clairement indiqué. Elle est publique parce qu’un standard qu’on ne peut pas inspecter n’est pas un standard.

Comment lire ceci

Chaque règle porte son niveau de preuve.

N’importe qui peut prétendre être bâti sur la science. Nous notons chaque affirmation pour que vous distinguiez un effet vérifié d’une hypothèse de travail. L’honnêteté fait la crédibilité.

Vérifié A résisté à une vérification adversariale face à une source primaire.
Dérivé Une conséquence arithmétique d’une règle vérifiée.
Heuristique Canon de la pratique ou extrapolation des principes de Mayer, non vérifié ce tour-ci.
Produit Une décision produit, pas une affirmation de recherche.
Pipeline Une propriété mesurée de notre propre pipeline.
Partie un

Les onze lois de conception.

Ce que la science dit vraiment, avec les tailles d’effet et un lien vers la source primaire pour chacune.

L1 Vérifié

Le dévoilement progressif est obligatoire, et le plus grand levier que nous contrôlons.

Un contenu construit trait par trait bat de façon mesurable l’affichage de scènes finies. Rétention ηp²=0.13 to 0.17, transfert ηp²=0.10 to 0.16, répliqué sur deux expériences avec une narration identique.

Dans Sketchie : Ne coupez jamais vers un diagramme fini. Chaque élément se dessine. Ce n’est pas esthétique, c’est le mécanisme de rétention.

Source : PMC9898452
L2 Vérifié

La main visible est optionnelle. Le dessin ne l’est pas.

Dessiner à la main vs pousser à la main vs sans main a changé la motivation intrinsèque (p=0.033) mais n’a produit aucune différence sur les résultats d’apprentissage.

Dans Sketchie : Nous évitons de rendre une main et ne perdons rien de mesurable. C’est le dessin lui-même qui compte.

Source : Smart Learn. Env. 2023
L3 Vérifié

La signalisation achète rétention et transfert en baissant la charge cognitive.

Méta-analyse, 32 studies, N≈3,597 : le repérage donne rétention d=0.27, transfert d=0.34, charge d=−0.11. L’ampleur de la réduction de charge prédit le gain d’apprentissage (β=−0.70 rétention, −0.60 transfert).

Dans Sketchie : Les flèches, les touches de couleur et les révélations d’étiquette sont des repères, pas de la décoration. Chaque repère pointe ce que la narration dit à l’instant.

Source : PMC5576760
L4 Vérifié

Segmentez, et laissez des espaces de traitement.

Une méta-analyse de segmentation a trouvé des gains significatifs de rétention et de transfert, petits à moyens. Une partie du bénéfice vient du temps de traitement que créent les frontières.

Dans Sketchie : Les scènes sont des segments. Après la dernière révélation d’une scène, la narration reste silencieuse au moins 0.7 seconds avant la coupe.

Source : Rey et al. 2019
L5 Vérifié

La falaise des six minutes est réelle.

Sur 6.9 million sessions edX, l’engagement se situe près de 1.0 sous 6 minutes, tombe à environ 0.55 à 9 à 12 minutes, et chute à environ 0.2 au-delà de 12 minutes. Confirmé indépendamment dans une réplication de 2026.

Dans Sketchie : La sortie par défaut est 6:00 ferme. Les demandes plus longues deviennent une série de vidéos en chapitres, jamais une longue vidéo.

Source : Guo et al. 2014
L6 Vérifié

Le dessin façon Khan bat les diapositives à toute durée.

Environ 0.72 vs 0.52 d’engagement normalisé à 3 à 6 minutes, attribué au mouvement dessiné à la main plus une livraison parlée et improvisée.

Dans Sketchie : Le format est validé. La narration doit sonner parlée, pas lue. Les contractions sont permises, l’adresse directe est encouragée.

Source : Guo et al. 2014
L7 Vérifié

Narration et dévoilement progressif doivent être appariés.

Un script narratif a amélioré le transfert (ηp²=0.12 to 0.20) mais pas la rétention à lui seul. Apparié AVEC le dessin progressif, le narratif a battu l’informatif en rétention (p=0.021). Sur des visuels STATIQUES, c’est un script informatif qui l’a emporté (η²=0.21 to 0.24).

Dans Sketchie : Nos scripts utilisent une grammaire de récit, un acteur avec un but, un obstacle et une résolution, précisément parce que nous rendons toujours progressivement. Jamais de voix off narrative sur une image fixe.

Source : PMC9898452
L8 Vérifié

Pas de détails séduisants.

Un contenu intéressant mais superflu n’améliore pas l’apprentissage.

Dans Sketchie : Chaque élément visuel doit être repris par la narration. Une décoration non reprise est un échec, pas une fioriture.

Source : Mayer 2020
L9 Vérifié

Terminez par une production, pas juste un résumé.

Les invites qui font résumer ou expliquer l’apprenant améliorent l’apprentissage. C’est le principe de l’activité générative.

Dans Sketchie : Chaque vidéo se termine par un temps de rappel : une question apparaît, la vidéo se met en pause 1.5 to 2 seconds, puis un récap d’une ligne.

Source : Springer 2020
L10 Vérifié

Les frontières d’événement réinitialisent l’attention.

Plus de points de changement visuel et narratif signifient moins de vagabondage mental.

Dans Sketchie : Les changements de scène sont des réinitialisations d’attention. Placez-les aux frontières d’idées, jamais au milieu d’une idée.

Source : Nature HSSC 2026
L11 Vérifié

N’optimisez pas pour l’esthétique du nombre de vues.

La qualité explicative ne corrèle pas avec les vues une fois la taille de la chaîne contrôlée (r=0.23, non significatif). Seuls les likes, les commentaires pertinents et les interactions corrèlent.

Dans Sketchie : Nous notons le design pédagogique, pas les signaux de viralité.

Source : arXiv 2207.05872
Partie deux

Les chiffres que le pipeline doit atteindre.

Les lois ci-dessus deviennent des cibles concrètes. C’est le contrat contre lequel le générateur est vérifié à chaque rendu.

Paramètre Cible Niveau
Durée totale de la vidéo plafond ferme 6:00 ; zone idéale 1:00 to 3:00 par concept Vérifié
Granularité de la durée incréments de 30-second Produit
Durée de scène 12 to 30 seconds, une idée par scène Vérifié
Éléments par scène 3 to 7 visibles en fin de scène, titre inclus Heuristique
Cadence de révélation un nouvel élément toutes les 2 to 5 seconds ; jamais deux révélations à moins de 1.2s Dérivé
Synchro révélation-mot l’élément apparaît à ±500ms de son mot déclencheur Dérivé
Couverture de synchro-mot au moins 95% des éléments portent un mot de révélation qui se résout Pipeline
Écart post-scène au moins 0.7s de silence de narration après la dernière révélation, avant la coupe Vérifié
Style de révélation dessin de contour (0.3 to 0.5s), puis un remplissage échelonné ; flèches pointe à queue Vérifié
Main visible aucune Vérifié
Étiquettes trois mots ou moins, mot-clé en majuscules ; jamais une phrase qui reprend la narration Heuristique
Débit de narration 140 to 160 words per minute, registre parlé, contractions permises Heuristique
Structure du script accroche en 10s, analogie concrète, mécanisme, ancrage réel, temps de rappel, récap Vérifié
Grammaire narrative acteur, but, obstacle, résolution, dès que le domaine le permet Vérifié
Analogie au moins une analogie concrète avant le premier terme abstrait Heuristique
Visuels superflus zéro élément non repris par la narration Vérifié
Fin question de rappel, une pause d’au moins 1.5s, puis un récap d’une ligne Vérifié
Transitions de scène coupe franche seulement à une frontière d’idée, jamais au milieu d’une idée Vérifié
Partie trois

Le harnais d’évaluation à trois couches.

Une règle n’est réelle que si on peut la tester. Chaque vidéo passe par trois couches avant d’être autorisée à sortir.

Layer A

Mécanique

Des assertions JavaScript simples sur le scene graph et les timings des mots. Coût nul, sûr à exécuter en CI. Durée totale sous le plafond, chaque scène dans sa plage de durée, 3 to 7 éléments par scène, chaque élément porte un mot de révélation qui tombe à ±500ms du mot prononcé, une scène finale avec une question et un récap, et aucun élément non repris par la narration. Réussite ou échec, aucun appel de modèle.

Layer B

Sémantique

Une passe de modèle-juge, notée de 1 à 5, échantillonnée et exécutée à la sortie, jamais en CI. Une idée par scène, fidélité des icônes, si l’analogie mappe vraiment le mécanisme, qualité de l’accroche, un balayage des détails séduisants, et fidélité au document source. Toute dimension sous 3 échoue au portail de sortie.

Layer C

Vérification de sortie

Des contrôles sur le fichier rendu lui-même. Une planche-contact confirme l’absence d’éléments qui se chevauchent et des étiquettes lisibles, une rafale d’images confirme que la révélation contour-puis-remplissage est bien présente, et l’audio est normalisé en volume sans phrases coupées aux transitions.

Pas un manifeste, un portail

Comment Sketchie l’impose.

La spécification ne vaut quelque chose que si une vidéo qui l’enfreint ne peut pas sortir. La Couche A s’exécute au moment de la génération, sur le scene graph, avant de dépenser un centime en voix ou en rendu. Un graphe qui échoue aux contrôles mécaniques est renvoyé pour être régénéré avec les échecs exacts injectés dans le prompt. Un graphe qui continue d’échouer ne devient jamais une vidéo.

Chaque contrôle de la liste ci-dessus correspond à une vraie assertion dans notre moteur : le plafond de durée totale, la plage de durée par scène, le nombre d’éléments, le taux de résolution du mot de révélation, le silence post-scène, les règles d’étiquette et la fin question-plus-récap. Les flèches sont aussi contrôlées, ainsi un pointeur ne traverse jamais un élément auquel il n’est pas connecté. Le même code tourne dans le portail de régénération du worker et dans l’intégration continue, donc un changement du générateur qui régresserait la qualité se bloque lui-même.

Le standard d’évaluation ouvert sur GitHub Lire le code source de la Couche A Commencer

Mascotte de Sketchie

Fait pour être retenu.

Commencer