CUT 01 / MÉTHODOLOGIE
Comment un site web
devient-il une vidéo terminée ?
sizzledraft capture le vrai site public, écrit une scène minutée à partir de cette matière, rend chaque frame sur une horloge virtuelle, synthétise et mixe la bande son, puis vérifie le MP4 final. L'interface du produit vient du navigateur, pas d'une supposition visuelle générée.
CUT 02 / CAPTURE
Que capture le navigateur ?
Le worker de capture ouvre l'URL publique dans un navigateur et lit ce qui est visiblement présent. Il extrait les textes utiles, les sections sémantiques, les appels à l'action, les couleurs, les familles de police, les candidats logo et les métadonnées de la page.
Il enregistre les captures d'écran approuvées et les polices web réellement utilisées par la page, lorsqu'elles peuvent être récupérées sans risque. Les zones hero, fonctionnalités, tarifs, preuve sociale et appel à l'action deviennent des plans source potentiels. Les scripts, contenus embarqués, audio, vidéo et SVG non sécurisés ne sont pas copiés dans l'élément logo capturé.
La capture conserve les preuves, mais elle ne décide pas de l'histoire. L'étape suivante choisit lesquels de ces éléments réels soutiennent un argument court.
CUT 04 / RENDU
Comment fonctionne le rendu déterministe des frames ?
Le moteur de rendu calcule le timestamp de chaque frame à 30fps, règle une horloge virtuelle sur ce timestamp, et appelle la fonction de rendu de la scène. Il attend la mise en page et le paint, enregistre la frame, puis avance au timestamp suivant.
Le temps de capture réel ne contrôle pas le temps d'animation. Une frame difficile peut prendre plus de temps à produire sans faire sauter la frame suivante en avant. Les images numérotées sont encodées dans l'ordre en vidéo h264 avec le format de pixel yuv420p.
Les scènes verticales sont rendues en 1080x1920. Les scènes horizontales en 1920x1080. Les deux utilisent 30fps : le canevas change, mais le contrat de timing reste le même.
CUT 05 / SON
Comment la voix et la musique s'ajustent-elles au montage ?
Les fichiers vocaux mesurés sont placés à leurs repères sur la timeline finale. Le tapis musical est synthétisé de zéro pour le rendu, en utilisant le pulse sélectionné et les vrais points de montage visuels plutôt qu'un enregistrement préexistant.
La voix et la bande son sont mixées ensemble, la musique restant en dessous de la piste parlée. L'audio combiné passe par une normalisation du volume avec une cible de -14 LUFS, puis devient un flux AAC stéréo dans le MP4.
Un lien audio natif distinct peut être utilisé lors de la publication sociale, lorsque ce son est éligible pour le compte et l'emplacement. Il n'est pas intégré au master exporté.
CUT 06 / VÉRIFICATION
Que vérifie-t-on avant la livraison ?
Le fichier final est analysé pour vérifier sa largeur, sa hauteur, sa fréquence de 30fps, sa durée, le codec h264, le format de pixel yuv420p et la présence d'un flux audio. La durée doit rester à moins de 100 millisecondes de la longueur de rendu prévue.
La scène est aussi inspectée à des timestamps échantillonnés pour repérer des éléments visibles qui dépasseraient la largeur du viewport. Des contrôles distincts décodent des frames du MP4 et comparent leurs hashs, pour qu'une scène censée bouger ne puisse pas passer pour une image répétée.
Un contrôle technique en échec arrête le pipeline avant l'envoi. La revue humaine continue de juger l'accroche, le cadrage, le rythme et la lisibilité, mais elle n'a plus à découvrir un flux audio manquant par accident.
CUT 07 / SPÉCIFICATIONS DE LIVRAISON
Que contient exactement le fichier livré ?
- VERTICAL
- 1080x1920
- HORIZONTAL
- 1920x1080
- FRÉQUENCE D'IMAGES
- 30fps
- CODEC VIDÉO
- h264
- FORMAT DE PIXEL
- yuv420p
- CIBLE AUDIO
- -14 LUFS
CUT 08 / QUESTIONS
Quelles sont les questions les plus fréquentes sur le processus de production ?
- Quels formats vidéo sizzledraft produit-il ?
- La sortie verticale est en 1080x1920 et la sortie horizontale en 1920x1080. Les deux sont rendues à 30fps et encodées en vidéo h264 avec le format de pixel yuv420p.
- sizzledraft invente-t-il l'interface du produit ?
- Non. L'étape de capture utilise un navigateur pour collecter du matériel public approuvé du site, dont des captures d'écran et des tokens de marque. La scène écrite anime et enchaîne ces éléments capturés, au lieu de demander à un modèle vidéo de redessiner l'interface.
- Comment la bande son est-elle fabriquée ?
- Les répliques vocales sont générées et mesurées individuellement. Une bande son originale est synthétisée sur les points de montage, mixée sous la voix, et l'audio combiné est normalisé sur une cible de -14 LUFS.
- Pourquoi le rendu est-il déterministe ?
- Le moteur de rendu fixe un timestamp virtuel exact pour chaque frame de sortie et demande à la scène de peindre cet état. La vitesse de capture peut varier sans changer le point de l'animation représenté par la frame.
- Que vérifie-t-on avant qu'une vidéo soit livrée ?
- Des contrôles automatisés vérifient les dimensions, la fréquence d'images, la durée, le codec h264, le format de pixel yuv420p et la présence d'audio. Le pipeline échantillonne aussi la scène pour détecter un débordement horizontal et décode des frames pour confirmer que le mouvement prévu est bien présent.