Quanto deve essere grande un volto in una thumbnail
Tutte le guide dicono di usare un volto. Nessuna dice quanto grande, che è l'unica parte decidibile — una thumbnail viene resa da 0,28× fino a 0,13×, e un volto che si legge a una scala all'altra è una macchia.
«Usa un volto» non è una misura
È il consiglio più ripetuto sulle thumbnail e il meno azionabile, perché si ferma esattamente dove comincia la decisione. Un volto di che dimensione? Stai disegnando su 1280 × 720 e l'interfaccia non ti mostrerà quello. Ti mostra una card larga 346 pixel nel feed della home su desktop, una riga da 360 pixel in ricerca e un elemento da 168 pixel nella colonna dei suggeriti accanto a un video in riproduzione.
È una riduzione a 0,27× su una card e a 0,13× nella colonna dei suggeriti — lo stesso file, reso a un settimo della sua dimensione lineare. La dimensione del volto è l'unica proprietà di una thumbnail che quella riduzione distrugge e che si può ancora sistemare gratis mentre disegni, perché ingrandire una testa non costa niente. Anche i consigli di YouTube su miniatura e titolo dicono di mostrare un volto, senza attaccarci nessun numero — ed è esattamente il vuoto che questa pagina esiste per riempire.
Quello che deve sopravvivere non è la testa
Una testa è una sagoma. A quasi qualsiasi dimensione dice che nel frame c'è una persona, il che vale qualcosa ma non è il motivo per cui qualcuno consiglia i volti. Il motivo è l'espressione — sorpresa, dubbio, sforzo, disgusto — e l'espressione vive in una fascia che attraversa gli occhi e la bocca.
Quella fascia è circa un terzo della testa. Nelle tre thumbnail reali che ho misurato su una griglia percentuale era il 34%, il 32% e il 40% dell'altezza della testa, quindi un terzo è la cifra di lavoro. Il che significa che qualunque cosa pensi di stare mettendo nel frame, la parte che porta il messaggio è alta un terzo di quanto credi.
Un metro che è già nella pagina
Invece di dichiarare una soglia in pixel oltre la quale un volto umano si legge — io non l'ho testata, e non l'ha testata nemmeno chi ti dice il 20% o il 30% — usa un confronto che puoi verificare da solo, sullo stesso schermo, nella stessa occhiata.
Accanto a ogni thumbnail YouTube rende il tuo titolo, e una sua riga è alta 20 pixel su una card, 23 in un risultato di ricerca, 18 nella colonna dei suggeriti su desktop e 16 nei suggeriti su mobile. Se la fascia occhi-bocca del tuo volto è più bassa di una riga del titolo che le sta accanto, non sta competendo per l'attenzione con quel titolo. È texture.
Quindi ecco quanto frame deve occupare la testa
Una riga di titolo come obiettivo per la fascia, e una fascia che è un terzo della testa, danno un'altezza di testa richiesta per ogni superficie. Queste sono le dimensioni rese dal mock di questo strumento, che segue il layout di YouTube:
| Superficie | Thumbnail resa | Una riga di titolo | La testa deve occupare |
|---|---|---|---|
| Risultato di ricerca | 360 × 203 px | 23 px | il 34% dell'altezza del frame |
| Card della home desktop | 346 × 195 px | 20 px | 31% |
| Card del feed mobile | 370 × 208 px | 20 px | 29% |
| Lista suggeriti mobile | 160 × 90 px | 16 px | 53% |
| Colonna suggeriti desktop | 168 × 94 px | 18 px | 57% |
Comanda la superficie più stretta, ed è la stessa che comanda la lunghezza del titolo: la colonna dei suggeriti accanto a un video in riproduzione, dove lo spettatore sta scegliendo cosa guardare dopo. Su una card un terzo del frame basta. Lì serve oltre la metà.
Tre thumbnail reali, lette su una griglia
Per tenere tutto questo fuori dal terreno delle affermazioni ho preso tre thumbnail dai pacchetti di questo strumento — un talking head di business, uno split screen politico, una dimostrazione di fitness — ci ho sovrapposto una griglia a intervalli del 5% e ho letto lì il box della testa e la fascia occhi-bocca. Poi ho moltiplicato per le altezze rese qui sopra.
| Thumbnail | Testa | Fascia | Dove la fascia scende sotto una riga |
|---|---|---|---|
| Talking head, volto sul terzo destro | 65% dell'altezza del frame | 22% | in nessun posto — 21 px anche nella colonna dei suggeriti |
| Split screen, due volti | 53% e 40% | 17% e 13% | in entrambe le colonne dei suggeriti (16 px contro una riga da 18 px) |
| Inquadratura dimostrativa, volto sopra il soggetto | 25% | 10% | ovunque tranne una card del feed, dove cade esattamente su una riga (20 px) |
Cosa significa in pratica
Il talking head è l'unico dei tre che funziona su tutte le superfici, e nell'editor sembra assurdo: una testa che occupa due terzi dell'altezza del frame, tagliata in cima, che si prende un terzo della larghezza. Non è un vezzo stilistico dei canali grandi. È quello che chiede l'aritmetica.
Lo split screen è il caso interessante, perché falla in un posto esatto — la colonna dei suggeriti — e quello non è un caso limite. È dove lo spettatore decide cosa guardare dopo il video che sta già guardando, ed è la superficie in cui nemmeno il resto della tua thumbnail è leggibile.
L'inquadratura dimostrativa è l'errore comune e il più perdonabile, perché il volto non è pensato per essere il soggetto: la lavagna lo è. Il problema è che il volto sta comunque spendendo un quarto del frame senza portare niente a dimensione di card — il dieci percento dell'altezza sono nove pixel di espressione in una colonna di suggeriti. Se il soggetto è il soggetto, quel quarto di frame è speso meglio sul soggetto.
Niente di tutto questo dice che un volto deve occupare un terzo del frame. Dice che un volto *pensato per portare un'espressione* deve, e che un volto sotto quella dimensione è decorazione di cui stai pagando l'area. Decidere che è decorazione è una scelta legittima; non decidere è quella costosa.
Due volti non sono due possibilità
Un frame diviso è il modo standard per segnalare un confronto, una comparazione, un prima e dopo, e vale la pena sapere quanto costa. Ogni volto prende metà della larghezza, quindi una testa che a piena larghezza sarebbe il 65% dell'altezza del frame in una metà sta tipicamente al 40–55% — che è quello che ho misurato in quella politica: 53% e 40%.
La più grande delle due sopravvive sulle card e muore nelle colonne dei suggeriti; la più piccola muore prima. Quindi un frame diviso in pratica cede la superficie più stretta in cambio di una relazione fra due soggetti. A volte quella relazione *è* il video e lo scambio è giusto. Quello che non è, è un modo per raddoppiare la quantità di volto nel frame.
Dove può stare davvero il volto
Decisa la dimensione, la posizione ha due vincoli, e nessuno dei due riguarda la composizione.
L'interfaccia disegna sopra il frame: il badge della durata nell'angolo in basso a destra, altri badge in basso a sinistra, la barra di avanzamento lungo il bordo inferiore. Un volto con la bocca o il mento in basso a destra è un volto con una pillola nera sopra in buona parte delle sue impression. Le zone sono mappate nella guida alla safe zone, con un template da sovrapporre al tuo design.
E uno Short è un'immagine completamente diversa, non un ritaglio di questa — lì YouTube serve un fermo immagine davvero verticale, ed è per questo che la guida agli Shorts lo tratta a parte. Se lo stesso volto deve funzionare in entrambi i formati, va composto due volte, e la versione verticale ha il compito più facile: un frame 9:16 dà a una testa molto più spazio per essere grande.
Un volto grande lascia meno spazio al testo, e va bene
L'obiezione a una testa a un terzo del frame è sempre la stessa: non resta spazio per le parole. Corretto, e non è una perdita, perché le parole che contano non stanno nell'immagine.
Il titolo accanto alla thumbnail lo rende YouTube a una dimensione che controlla lui ed è garantito leggibile — è lì che vanno numeri, nomi, modelli e anni. L'immagine porta una sola idea senza parole, e un volto a dimensione di lavoro è uno dei modi migliori per portarla. Quella divisione è l'argomento della guida sulla coppia thumbnail–titolo, ed è ciò che fa spazio a un volto grande invece di competerci.
Se il testo deve stare comunque nell'immagine, sta competendo col volto per la stessa area e si rimpiccioliscono entrambi. Tre o quattro parole a una dimensione che sopravvive alla riduzione sono il tetto; la guida sulla dimensione del testo ha la misura per quell'altra metà.
Quando un volto è la scelta sbagliata
Due casi in cui l'aritmetica argomenta contro un volto invece che a favore di uno più grande.
Quando il soggetto è un oggetto — un prodotto, un grafico, un luogo, uno schermo — un volto a dimensione di lavoro è un terzo del frame speso su una persona che lo spettatore ancora non riconosce. È il riconoscimento che rende prezioso un volto su un canale con un pubblico, e un canale senza pubblico ottiene solo l'espressione, che deve essere abbastanza forte da valere quell'area.
E quando l'espressione è neutra. Un volto calmo, ben illuminato e professionale al 65% del frame è una grande fotografia di uno sconosciuto. La regola sulla dimensione è un pavimento per la leggibilità, non l'affermazione che qualsiasi volto a quella dimensione funzioni; dice che se l'espressione vale la pena di essere mostrata, questo è quanto costa mostrarla.
Il controllo che dura un minuto
Tutto quanto sopra è un ragionamento su una riduzione, e una riduzione è una cosa che si può semplicemente guardare. Metti il file vero in un feed vero e vai nella colonna dei suggeriti — la superficie più stretta, quella che comanda — e guarda se il volto sta ancora facendo un lavoro o è diventato una forma.
È a questo che serve lo strumento di anteprima: la stessa immagine a tutte e cinque le dimensioni rese, accanto ai competitor con cui comparirà davvero. Un volto che sopravvive alla colonna dei suggeriti sopravvive per definizione a tutto il resto, quindi è l'unica vista che devi controllare per forza.
Le domande che fanno tutti
Quanto grande deve essere un volto in una thumbnail di YouTube?
Abbastanza perché la fascia occhi-bocca sia alta almeno quanto una riga del titolo che le sta accanto. Vengono circa un terzo dell'altezza del frame su una card del feed e oltre la metà nella colonna dei suggeriti, che è la superficie che comanda.
Le thumbnail con i volti funzionano meglio?
Un volto è un modo forte per portare una sola idea senza parole, ma solo a una dimensione in cui l'espressione sopravvive alla riduzione. Sotto quella dimensione hai pagato area del frame per una sagoma, ed è per questo che «usa un volto» senza una misura non è un consiglio utile.
Serve un volto su ogni thumbnail?
No. Quando il soggetto è un oggetto, un volto a dimensione di lavoro costa un terzo del frame per una persona che lo spettatore magari non riconosce. Su un canale con un pubblico il riconoscimento ripaga; su un canale nuovo lo fa solo l'espressione.
Posso mettere due volti in una thumbnail?
Sì, e dimezza la larghezza disponibile per ciascuno, quindi le teste finiscono attorno al 40–55% dell'altezza del frame invece del 65%. Misurato su uno split screen reale, il volto più grande sopravvive sulle card ed entrambi scendono sotto una riga di titolo nelle colonne dei suggeriti.
Dove va messo il volto nel frame?
Ovunque tranne l'angolo in basso a destra, dove viene disegnato il badge della durata, e via dal bordo inferiore, dove sta la barra di avanzamento. Bocca e mento in basso a destra sono la versione comune di questo errore.