Vetenskapen

Den öppna standarden för kvalitet på förklarande videor.

Vi läste den publicerade forskningen om hur människor lär sig av video och omvandlade de fynd som klarade granskningen till numeriska regler som vår generator måste följa. Här är hela specifikationen, med källhänvisningar och allt, med det vi inte kunde verifiera tydligt markerat. Den är offentlig eftersom en standard du inte kan inspektera inte är en standard.

Så läser du detta

Varje regel bär sin evidensgrad.

Vem som helst kan påstå sig vara byggd på vetenskap. Vi graderar varje påstående så att du kan skilja en verifierad effekt från ett arbetsantagande. Ärligheten är trovärdigheten.

Verifierad Klarade adversarial verifiering mot en primärkälla.
Härledd En aritmetisk konsekvens av en verifierad regel.
Heuristisk Praktikerkanon eller extrapolering av Mayers principer, inte verifierad denna omgång.
Produkt Ett produktbeslut, inte ett forskningspåstående.
Pipeline En uppmätt egenskap hos vår egen pipeline.
Del ett

De elva designlagarna.

Vad vetenskapen faktiskt säger, med effektstorlekar och en länk till primärkällan för var och en.

L1 Verifierad

Progressiv avtäckning är obligatorisk, och den största spak vi kontrollerar.

Innehåll som byggs upp streck för streck slår mätbart att visa färdiga scener. Retention ηp²=0.13 to 0.17, överföring ηp²=0.10 to 0.16, replikerad i två experiment med identisk berättarröst.

I Sketchie: Klipp aldrig till ett färdigt diagram. Varje element ritas fram. Det här är inte estetik, det är retentionsmekanismen.

Källa: PMC9898452
L2 Verifierad

Den synliga handen är valfri. Ritandet är det inte.

Handritning kontra handskjutning kontra ingen hand förändrade den inre motivationen (p=0.033) men gav ingen skillnad i inlärningsresultat.

I Sketchie: Vi hoppar över att rendera en hand och förlorar ingenting mätbart. Själva uppritandet är det som spelar roll.

Källa: Smart Learn. Env. 2023
L3 Verifierad

Signalering köper retention och överföring genom att sänka den kognitiva belastningen.

Metaanalys, 32 studies, N≈3,597: signaler ger retention d=0.27, överföring d=0.34, belastning d=−0.11. Storleken på belastningsminskningen förutsäger inlärningsvinsten (β=−0.70 retention, −0.60 överföring).

I Sketchie: Pilar, färgutbrott och etikettframträdanden är signaler, inte dekoration. Varje signal pekar på det berättarrösten säger just nu.

Källa: PMC5576760
L4 Verifierad

Segmentera, och lämna bearbetningsluckor.

En segmenteringsmetaanalys fann betydande vinster i retention och överföring, små till medelstora. En del av fördelen kommer från den bearbetningstid som gränserna skapar.

I Sketchie: Scener är segment. Efter en scens sista avtäckning håller berättarrösten tyst i minst 0.7 seconds innan klippet.

Källa: Rey et al. 2019
L5 Verifierad

Sexminutersstupet är verkligt.

Över 6.9 million edX-sessioner ligger engagemanget nära 1.0 under 6 minuter, sjunker till cirka 0.55 vid 9 to 12 minuter, och sjunker till ungefär 0.2 efter 12 minuter. Bekräftat oberoende i en replikering från 2026.

I Sketchie: Standardutdata är strikt 6:00. Längre önskemål blir en kapitelindelad serie videor, aldrig en lång video.

Källa: Guo et al. 2014
L6 Verifierad

Khan-stilens ritande slår bildspel oavsett längd.

Cirka 0.72 kontra 0.52 normaliserat engagemang vid 3 to 6 minuter, tillskrivet handritad rörelse plus en spontan, talad leverans.

I Sketchie: Formatet är validerat. Berättarrösten ska låta talad, inte uppläst. Sammandragningar är tillåtna, direkt tilltal uppmuntras.

Källa: Guo et al. 2014
L7 Verifierad

Berättande och progressiv avtäckning måste kombineras.

Ett berättande manus förbättrade överföringen (ηp²=0.12 to 0.20) men inte retentionen på egen hand. Kombinerat MED progressivt ritande slog berättandet det informativa i retention (p=0.021). Över STATISKA bilder vann istället ett informativt manus (η²=0.21 to 0.24).

I Sketchie: Våra manus använder berättargrammatik, en aktör med ett mål, ett hinder och en lösning, just för att vi alltid renderar progressivt. Aldrig berättande voiceover över en statisk bildruta.

Källa: PMC9898452
L8 Verifierad

Inga förförande detaljer.

Intressant men irrelevant innehåll förbättrar inte inlärningen.

I Sketchie: Varje visuellt element måste omnämnas av berättarrösten. Icke omnämnd dekoration är ett misslyckande, inte flärd.

Källa: Mayer 2020
L9 Verifierad

Avsluta med generering, inte bara en sammanfattning.

Uppmaningar som får den lärande att sammanfatta eller förklara förbättrar inlärningen. Det här är principen om generativ aktivitet.

I Sketchie: Varje video avslutas med ett återhämtningsmoment: en fråga dyker upp, videon pausar i 1.5 to 2 seconds, sedan en enradig sammanfattning.

Källa: Springer 2020
L10 Verifierad

Händelsegränser återställer uppmärksamheten.

Fler visuella och berättande förändringspunkter innebär mindre tankevandring.

I Sketchie: Scenbyten är uppmärksamhetsåterställningar. Placera dem vid idégränser, aldrig mitt i en idé.

Källa: Nature HSSC 2026
L11 Verifierad

Optimera inte för visningsantalsestetik.

Förklaringskvalitet korrelerar inte med visningar när kanalstorleken kontrolleras (r=0.23, inte signifikant). Endast gilla-markeringar, relevanta kommentarer och interaktioner korrelerar.

I Sketchie: Vi graderar inlärningsdesign, inte viralitetssignaler.

Källa: arXiv 2207.05872
Del två

Siffrorna pipelinen måste nå.

Lagarna ovan blir konkreta mål. Det här är kontraktet generatorn kontrolleras mot vid varje rendering.

Parameter Mål Grad
Total videolängd strikt tak på 6:00; sweet spot 1:00 to 3:00 per koncept Verifierad
Längdgranularitet ökningar om 30-second Produkt
Scenlängd 12 to 30 seconds, en idé per scen Verifierad
Element per scen 3 to 7 synliga vid scenens slut, rubrik inräknad Heuristisk
Avtäckningstakt ett nytt element var 2 to 5 seconds; inga två avtäckningar närmare än 1.2s Härledd
Avtäckning-till-ord-synk elementet visas inom ±500ms från sitt utlösande ord Härledd
Ordsynk-täckning minst 95% av elementen bär ett avtäckningsord som löses upp Pipeline
Lucka efter scen minst 0.7s berättartystnad efter sista avtäckningen, innan klippet Verifierad
Avtäckningsstil konturuppritning (0.3 to 0.5s), sedan en staffad fylltvätt; pilar spets till svans Verifierad
Synlig hand ingen Verifierad
Etiketter tre ord eller färre, versalt nyckelord; aldrig en mening som speglar berättarrösten Heuristisk
Berättartempo 140 to 160 ord per minut, talat register, sammandragningar tillåtna Heuristisk
Manusstruktur krok inom 10s, konkret analogi, mekanism, verklighetsförankring, återhämtningsmoment, sammanfattning Verifierad
Berättargrammatik aktör, mål, hinder, lösning, när domänen tillåter det Verifierad
Analogi minst en konkret analogi före första abstrakta termen Heuristisk
Överflödiga bilder noll element som inte omnämns av berättarrösten Verifierad
Avslutning återhämtningsfråga, en paus på minst 1.5s, sedan en enradig sammanfattning Verifierad
Scenövergångar hårt klipp endast vid en idégräns, aldrig mitt i en idé Verifierad
Del tre

Utvärderingsramverket i tre lager.

En regel är bara verklig om du kan testa den. Varje video går igenom tre lager innan den får släppas.

Layer A

Mekanisk

Rena JavaScript-assertioner på scengrafen och ordtidpunkterna. Nollkostnad, säkert att köra i CI. Total längd under taket, varje scen inom sitt längdintervall, 3 to 7 element per scen, varje element bär ett avtäckningsord som landar inom ±500ms från det talade ordet, en avslutande scen med en fråga och en sammanfattning, och inget element som inte omnämns av berättarrösten. Godkänt eller underkänt, inga modellanrop.

Layer B

Semantisk

En modell-som-domare-genomgång, betygsatt 1 to 5, stickprovstagen och körd vid release, aldrig i CI. En idé per scen, ikontrohet, om analogin faktiskt motsvarar mekanismen, krokkvalitet, en genomsökning av förförande detaljer, och trohet mot källdokumentet. Varje dimension under 3 underkänns vid releasegrinden.

Layer C

Utdataverifiering

Kontroller på själva den renderade filen. Ett kontaktark bekräftar att inga element överlappar och att etiketterna är läsbara, en bildsalva bekräftar att kontur-sedan-fyllning-avtäckningen faktiskt finns, och ljudet är volymnormaliserat utan avklippta meningar vid klippen.

Inte ett manifest, en grind

Så här upprätthåller Sketchie detta.

Specifikationen är bara värd något om en video som bryter mot den inte kan släppas. Layer A körs vid genereringstillfället, på scengrafen, innan vi spenderar en cent på röst eller rendering. En graf som misslyckas med de mekaniska kontrollerna skickas tillbaka för att återskapas med de exakta misslyckandena inmatade i prompten. En graf som fortsätter att misslyckas blir aldrig en video.

Varje kontroll i listan ovan motsvarar en verklig assertion i vår motor: taket för total längd, längdintervallet per scen, elementantalet, upplösningsgraden för avtäckningsord, tystnaden efter scenen, etikettreglerna och avslutningen med fråga plus sammanfattning. Pilar kontrolleras också, så en pekare korsar aldrig ett element den inte är kopplad till. Samma kod körs i workerns återskapandegrind och i kontinuerlig integration, så en ändring i generatorn som skulle försämra kvaliteten blockerar sig själv.

Den öppna utvärderingsstandarden på GitHub Läs Layer-A-källkoden Get Started

Sketchie mascot

Byggd för att bli ihågkommen.

Get Started