sizzledraft

TAGLIO 01 / METODOLOGIA

Come diventa un sito web
un video finito?

sizzledraft cattura il sito pubblico vero, scrive una scena temporizzata da quel materiale, renderizza ogni fotogramma su un orologio virtuale, sintetizza e mixa la colonna sonora, poi verifica l'MP4 finito. L'interfaccia del prodotto viene dal browser, non da un'invenzione visiva generata.


TAGLIO 02 / CATTURA

Cosa cattura il browser?

Il worker di cattura apre l'URL pubblico in un browser e legge ciò che è visibilmente presente. Estrae testi utili, sezioni semantiche, call to action, colori, famiglie di font, candidati al logo e metadati della pagina.

Salva le schermate di pagina approvate e i webfont effettivamente usati dalla pagina, dove possono essere recuperati in sicurezza. Le sezioni hero, feature, prezzi, prova sociale e call-to-action diventano possibili scatti sorgente. Script, embed, audio, video e contenuto SVG non sicuro non vengono copiati nell'asset del logo catturato.

La cattura preserva le prove, ma non decide la storia. La fase successiva sceglie quali di quegli elementi reali sostengono un unico argomento breve.


TAGLIO 03 / SCRITTURA

Come diventa una scena il sito catturato?

La fase di scrittura combina il brand kit catturato con un hook selezionato e scrive una breve sequenza di battute vocali, testo a schermo, asset sorgente e call to action. Ogni battuta diventa un beat con un inizio, una fine e un visivo corrispondente.

Le battute vocali sono sintetizzate separatamente e misurate. Le loro durate reali fissano un limite minimo non negoziabile per ogni beat. Un ritmo richiesto può aggiungere tempo di attesa, ma la timeline non accorcerà mai una battuta parlata per farla stare in una stima.

La scena è autonoma e usa gli asset locali catturati. Posizione, scala, opacità, maschere e contenuto attivo sono funzioni del tempo della timeline, non animazioni libere.


TAGLIO 04 / RENDER

Come funziona il render deterministico dei fotogrammi?

Il renderer calcola il timestamp di ogni fotogramma a 30fps, imposta un orologio virtuale su quel timestamp e chiama la funzione di render della scena. Attende layout e paint, salva il fotogramma, poi avanza al timestamp successivo.

Il tempo di cattura reale non controlla il tempo dell'animazione. Un fotogramma difficile può richiedere più tempo da produrre senza far saltare avanti il fotogramma successivo. Gli scatti numerati vengono codificati in ordine come video h264 con formato pixel yuv420p.

Le scene verticali renderizzano a 1080x1920. Le scene orizzontali renderizzano a 1920x1080. Entrambe usano 30fps, quindi la tela cambia mentre il contratto di temporizzazione resta lo stesso.


TAGLIO 05 / SUONO

Come vengono adattati voce e musica al taglio?

I file voce misurati vengono posizionati sui loro cue nella timeline finale. Il letto musicale viene sintetizzato da zero per il render, usando l'impulso selezionato e i punti di taglio visivi reali invece di una registrazione preesistente.

Voce e colonna sonora vengono mixate insieme, tenendo la colonna sonora sotto la traccia parlata. L'audio combinato passa attraverso una normalizzazione della sonorità con target di -14 LUFS, poi diventa uno stream AAC stereo nell'MP4.

Un link audio nativo separato può essere usato durante la pubblicazione social quando quel suono è idoneo per l'account e il posizionamento. Non viene incorporato nel master esportato.


TAGLIO 06 / VERIFICA

Cosa viene verificato prima della consegna?

Il file finito viene analizzato per larghezza, altezza, frame rate a 30fps, durata, codec h264, formato pixel yuv420p e traccia audio attesi. La durata deve restare entro 100 millisecondi dalla lunghezza di render prevista.

La scena viene anche ispezionata a timestamp campione per individuare elementi visibili che superano la larghezza del viewport. Controlli separati decodificano i fotogrammi dall'MP4 e ne confrontano gli hash, così una scena che dovrebbe muoversi non può passare come un'immagine ripetuta.

Un controllo tecnico fallito ferma la pipeline prima del caricamento. La revisione umana giudica comunque il claim, l'inquadratura, il ritmo e la leggibilità, ma non deve scoprire per caso una traccia audio mancante.


TAGLIO 07 / SPECIFICHE DI CONSEGNA

Cosa contiene esattamente il file consegnato?

VERTICALE
1080x1920
ORIZZONTALE
1920x1080
FRAME RATE
30fps
CODEC VIDEO
h264
FORMATO PIXEL
yuv420p
TARGET AUDIO
-14 LUFS

TAGLIO 08 / DOMANDE

Cosa chiedono le persone sul processo di produzione?

Quali formati video produce sizzledraft?
L'output verticale è 1080x1920 e quello orizzontale è 1920x1080. Entrambi renderizzano a 30fps e sono codificati come video h264 con formato pixel yuv420p.
sizzledraft inventa l'interfaccia del prodotto?
No. La fase di cattura usa un browser per raccogliere materiale pubblico approvato del sito, inclusi screenshot e token di brand. La scena scritta sposta e sequenzia quegli asset catturati, invece di chiedere a un modello video di ridisegnare l'interfaccia.
Come viene realizzata la colonna sonora?
Le battute vocali sono generate e misurate singolarmente. Una colonna sonora originale viene sintetizzata sui punti di taglio, mixata sotto la voce, e l'audio combinato è normalizzato a un target di -14 LUFS.
Perché il render è deterministico?
Il renderer imposta un timestamp virtuale esatto per ogni fotogramma di output e chiede alla scena di dipingere quello stato. La velocità di cattura può variare senza cambiare il punto dell'animazione rappresentato dal fotogramma.
Cosa viene verificato prima della consegna di un video?
Controlli automatici verificano dimensioni, frame rate, durata, codec h264, formato pixel yuv420p e presenza audio. La pipeline campiona anche la scena per individuare overflow orizzontale e decodifica i fotogrammi per confermare che il movimento previsto sia presente.
PARTI DAL TUO URL →