La mayoría de los consejos sobre thumbnails comienzan con la legibilidad: texto grande, alto contraste, un punto focal. Ese consejo es correcto, y también es donde ya están los canales establecidos. En 642 thumbnails reales, nuestro puntaje de legibilidad apenas varió, y eliminarlo del puntaje general no cambió en absoluto la precisión con la que el puntaje clasificaba videos reales.
Conclusiones clave
- En 642 thumbnails de canales establecidos, nuestro subpuntaje de legibilidad solo varió entre 85 y 95. Todos los demás factores que medimos variaron más.
- Eliminar por completo la legibilidad del puntaje dejó su precisión de clasificación exactamente igual: 62.0% de 321 pares del mismo canal.
- La legibilidad sigue siendo importante como requisito mínimo. Un thumbnail que nadie puede leer en tamaño móvil falla antes de que se juzgue cualquier otra cosa — simplemente dejó de separar videos buenos de excelentes.
- Reducimos sustancialmente su peso en el puntaje, pero no a cero, porque la muestra no contenía principiantes.
- Una vez que el texto es legible, el título y la claridad de la promesa son donde residían las diferencias restantes.
¿La legibilidad del thumbnail afecta qué videos funcionan mejor?
La legibilidad decide si un thumbnail está en juego, no si gana. Entre canales establecidos, nuestro modelo calificó casi todos los thumbnails como fáciles de leer, por lo que la legibilidad no pudo distinguir los éxitos de los fracasos de un canal. Cuando la eliminamos de nuestro puntaje, este clasificó videos reales exactamente igual que antes: 62.0% de 321 pares.
Esa es una afirmación más limitada de lo que parece, y esa limitación importa. No dice que la legibilidad sea irrelevante. Dice que entre canales que han estado subiendo suficiente tiempo como para tener una base, el problema de legibilidad ya se ha resuelto, y un factor que todos aprueban no puede clasificar a nadie.
¿Cuánto varía realmente la legibilidad entre thumbnails reales?
Cada thumbnail en el estudio fue calificado en doce factores. Aquí se muestra cuánto variaron seis de ellos en los 642 thumbnails — los mismos 321 pares usados en nuestra prueba publicada del puntaje. La columna "dispersión" es la desviación estándar: aproximadamente, cuán lejos estaba un thumbnail típico del promedio.
| Factor | Puntaje más bajo a más alto | Dispersión |
|---|---|---|
| Legibilidad | 85 a 95 | 3.7 |
| Riesgo de clickbait | 3 a 44 | 5.4 |
| Curiosidad | 29 a 68 | 6.8 |
| Fuerza del título | 23 a 93 | 10.3 |
| Claridad de la promesa | 8 a 95 | 13.9 |
| Cliffhanger | 17 a 93 | 14.9 |
La legibilidad no es solo la columna más estrecha. Todo su rango, desde el más bajo hasta el más alto, es más pequeño que la distancia típica desde el promedio de los factores en la parte inferior de la tabla. El thumbnail más débil en toda la muestra aún obtuvo 85.
Estas son las calificaciones de nuestro modelo, no mediciones tomadas con una regla. Pero el modelo no fue indulgente en general: extendió la claridad de la promesa casi en toda la escala, de 8 a 95. Tenía el rango disponible y no lo usó para la legibilidad, porque los thumbnails frente a él no diferían mucho en ese aspecto.
Qué hace un rango estrecho a un puntaje
Un peso en un puntaje no mide cuán importante es algo. Decide cuánto se mueve el número final cuando ese factor cambia. Si un factor apenas cambia, un peso grande en él añade principalmente la misma cantidad a cada thumbnail. Eleva el puntaje de todos sin separar a nadie.
La legibilidad tenía uno de los pesos más grandes en el lado de clics de nuestro puntaje, mientras variaba menos que cualquier otra cosa que medimos. En la práctica, funcionó como un bono casi constante, y un bono constante comprime exactamente las diferencias entre thumbnails que el resto del puntaje existe para mostrar.
Qué ocurrió cuando eliminamos la legibilidad del puntaje
No tuvimos que adivinar. El estudio ya contiene todos los subpuntajes para cada thumbnail, por lo que el puntaje general puede volver a calcularse con cualquier conjunto de pesos sin pedirle nada nuevo al modelo. Clasificamos nuevamente todos los 321 pares con la legibilidad en su peso original, en varios pesos reducidos y en cero, comparando puntajes con precisión completa en lugar de como números enteros redondeados — por eso estas cifras están ligeramente por encima del 59.5% que publicamos originalmente.
Con su peso original, el puntaje eligió el video con mejor rendimiento en el 62.0% de los pares. En cero, con la legibilidad eliminada directamente, eligió el mejor en el 62.0% de los pares. Cada valor intermedio se mantuvo dentro de 0.6 puntos de ese. En la mitad de los canales que ninguno de nuestros experimentos con prompts tocó, el resultado se mantuvo: 59.4% con el peso original, y 59.4% en cero.
Por qué la redujimos en lugar de eliminarla
Los datos habrían permitido eliminar por completo la legibilidad. No lo hicimos, debido a quiénes estaban en la muestra. Cada canal en el estudio era establecido: largas historias de subidas, audiencias estables, thumbnails hechos por personas que ya habían aprendido a hacer texto legible. Esa es exactamente la razón por la que la legibilidad parecía inactiva.
No es quién usa un verificador de thumbnails. Un creador que sube su décimo video con un subtítulo diminuto sobre un fondo caótico es la persona a la que la legibilidad existe para atrapar, y para ellos varía mucho. Eliminarla basándose en una muestra que no contiene tales thumbnails sería responder una pregunta que los datos nunca hicieron. Por eso su peso se redujo sustancialmente, y la diferencia se distribuyó entre los demás factores de clic en proporción a sus pesos existentes, lo que deja su orden sin cambios.
Para un thumbnail típico, el puntaje general baja aproximadamente un punto. También probamos un reajuste estadístico completo de los doce factores; ganó 1.9 puntos, lo cual está dentro del ruido para una muestra de este tamaño, por lo que el resto de los pesos se dejaron como estaban.
La barra de legibilidad que todo thumbnail debe superar
Nada de esto significa que se pueda omitir la legibilidad. Significa que es una verificación de aprobado/reprobado para superar rápidamente, y luego dejar de pulirla. Una versión funcional de esa verificación:
- Reduce el thumbnail al tamaño aproximado en que aparece en una lista de videos sugeridos y míralo durante un segundo. Si no puedes leer cada palabra, hay demasiadas palabras o son demasiado pequeñas.
- Cuenta las palabras en la imagen. Tres o cuatro ya son muchas a ese tamaño, y una frase corta suele leerse mejor que una oración.
- Verifica el contraste en escala de grises. El texto que solo destaca de su fondo por color desaparece para algunos espectadores y en algunas pantallas.
- Encuentra la única cosa en la que el ojo aterriza primero. Si dos puntos focales compiten, el thumbnail le pide al espectador que elija antes de decidir hacer clic.
- Míralo junto a los thumbnails que realmente aparecerán a su lado. Legible sobre un lienzo en blanco no es lo mismo que legible en un feed concurrido.
Si un thumbnail pasa las cinco, es poco probable que más trabajo en legibilidad sea lo que lo separe del video a su lado.
Dónde invertir esfuerzo una vez que el texto es legible
En nuestra prueba original, el factor que más claramente separó los videos sobresalientes de un canal de sus subpar es la claridad de la promesa: cuán inequívocamente el empaque dice qué es el video. La señal de miedo a perderse y la urgencia vinieron después. Los tres viven principalmente en el título, y en cómo el título y la imagen trabajan juntos, más que en la legibilidad de la tipografía.
Eso encaja con el único experimento en el estudio que cambió el título manteniendo la imagen. Cuando cada thumbnail se volvió a calificar contra el título del otro video, su puntaje cambió en promedio más de once puntos — aproximadamente tres veces la dispersión total de la legibilidad. Desde la perspectiva de nuestro modelo, las palabras llevan más de la diferencia que la tipografía. Si quieres ver dónde se sitúa tu propio empaque, puedes calificar un thumbnail y título contra los mismos doce factores y ver cuáles lo están reteniendo.
Límites de este hallazgo
Todo aquí describe canales establecidos y en inglés, calificados por un solo modelo. La legibilidad pareció inactiva porque esos canales ya la habían resuelto, y este hallazgo no debe aplicarse a un canal nuevo sin esa advertencia adjunta.
Las cifras de legibilidad son calificaciones del modelo, no mediciones independientes, por lo que un modelo que sistemáticamente sobrevalorara la legibilidad produciría el mismo rango estrecho. Creemos que es poco probable, ya que el mismo modelo usó casi toda la escala para otros factores, pero estos datos solos no pueden descartarlo. Y como con el estudio original, todo esto es asociación: ningún thumbnail se cambió y volvió a publicar para ver qué ocurrió después.
Preguntas frecuentes
¿Importa el tamaño del texto en el thumbnail de YouTube?
Sí, como requisito mínimo. El texto que no se puede leer en el tamaño en que aparece un thumbnail en un feed desperdicia el espacio que ocupa. Lo que sugieren nuestros datos es que casi todos los canales establecidos ya han superado ese requisito, por lo que una vez que el texto es legible, hacerlo más grande o más grueso es poco probable que sea lo que separe un video de otro.
¿Por qué la legibilidad dejó de importar en tu puntaje?
No dejó de importar; dejó de separar. En 642 thumbnails de canales establecidos, varió solo entre 85 y 95, por lo que añadió casi la misma cantidad a cada puntaje. Eliminarla dejó sin cambios la capacidad del puntaje para clasificar videos reales, por eso se redujo su peso.
¿Debería dejar de trabajar en la legibilidad del thumbnail?
Solo una vez que pase una verificación rápida en tamaño de feed: cada palabra legible en aproximadamente un segundo, un punto focal claro y suficiente contraste para sobrevivir en escala de grises. Más allá de ese punto, el tiempo invertido en el título y en cuán claramente el empaque expresa su promesa es más probable que cambie cómo compara el video con sus vecinos.
¿Esto cambió mis puntajes de thumbnail existentes?
Ligeramente. Con el peso de la legibilidad reducido y los demás factores de clic aumentados para compensar, un puntaje general típico baja aproximadamente un punto. En los thumbnails de referencia que verificamos con cada cambio, ninguna calificación cambió y el movimiento más grande fue de un solo punto.
¿Se aplica esto a canales pequeños o nuevos?
No automáticamente. Cada canal en la muestra era establecido, que es exactamente por qué la legibilidad mostró tan poca variación. Un canal más nuevo es mucho más probable que tenga thumbnails genuinamente difíciles de leer, y para ellos, la legibilidad puede ser lo más importante a corregir primero.