badaniaminiaturyprojektowanie

Czytelnność miniatur to podstawa, nie czynnik rozstrzygający

W badaniu 642 miniatur czytelność zmieniała się niewiele — jej usunięcie z oceny nie wpłynęło na dokładność. Dlaczego czytelność to próg, a nie dźwignia do optymalizacji.

September 14, 20268 min read
Czytelnność miniatur to podstawa, nie czynnik rozstrzygający

Większość porad dotyczących miniatur zaczyna się od czytelności: duży tekst, wysoki kontrast, jeden punkt fokalny. Ta porada jest słuszna — i właśnie tam znajdują się już zaawansowane kanały. W 642 rzeczywistych miniaturach nasz wskaźnik czytelności ledwo się zmieniał, a usunięcie go z ogólnej oceny nie wpłynęło na dokładność rankingu rzeczywistych filmów.

Kluczowe wnioski

  • W 642 miniaturach z zaawansowanych kanałów nasz podwskaźnik czytelności oscylował jedynie od 85 do 95. Każdy inny czynnik, który mierzymy, zmieniał się bardziej.
  • Usunięcie czytelności z oceny w ogóle nie zmieniło dokładności rankingu: 62,0% z 321 par z tego samego kanału.
  • Czytelność nadal ma znaczenie jako próg. Miniatura, której nie da się przeczytać na telefonie, zawodzi zanim cokolwiek innego zostanie ocenione — po prostu przestaje rozdzielać dobre filmy od świetnych.
  • Zmniejszyliśmy jej wagę w ocenie znacznie, ale nie do zera, ponieważ próba nie zawierała początkujących.
  • Gdy tekst jest już czytelny, to tytuł i jasność obietnicy decydują o pozostałych różnicach.

Czy czytelność miniatury wpływa na to, które filmy lepiej się sprawdzają?

Czytelność decyduje, czy miniatura w ogóle wchodzi do gry, a nie czy wygrywa. Wśród zaawansowanych kanałów nasz model ocenił niemal każdą miniaturę jako łatwo czytelną, więc czytelność nie mogła rozróżnić hitów od porażek. Gdy usunęliśmy ją z naszej oceny, ranking rzeczywistych filmów pozostał dokładnie taki sam: 62,0% z 321 par.

To wąskie stwierdzenie — i właśnie ta wąskość ma znaczenie. Nie mówi, że czytelność jest nieistotna. Mówi, że wśród kanałów, które wystarczająco długo publikują treści, by mieć bazę, problem czytelności został już rozwiązany — a czynnik, który każdy spełnia, nie może nikogo rozdzielić.

Jak bardzo różni się czytelność między rzeczywistymi miniaturami

Każda miniatura w badaniu została oceniona pod kątem dwunastu czynników. Oto, jak szeroko sześć z nich się różniło we wszystkich 642 miniaturach — tych samych 321 parach, które użyliśmy w naszym opublikowanym teście oceny. Kolumna „rozrzut” to odchylenie standardowe: mniej więcej, jak daleko typowa miniatura była od średniej.

CzynnikNajniższy do najwyższego wynikuRozrzut
Czytelność85 do 953,7
Ryzyko clickbaitu3 do 445,4
Ciekawość29 do 686,8
Siła tytułu23 do 9310,3
Jasność obietnicy8 do 9513,9
Cliffhanger17 do 9314,9

Czytelność to nie tylko najwęższa kolumna. Jej cały zakres, od najniższego do najwyższego wyniku, jest mniejszy niż typowa odległość od średniej dla czynników na dole tabeli. Najsłabsza miniatura w całej próbie nadal uzyskała 85 punktów.

To oceny naszego modelu, nie pomiary wykonane linijką. Ale model nie był ogólnie pobłażliwy: rozłożył jasność obietnicy niemal na całej skali, od 8 do 95. Miał do dyspozycji zakres i nie użył go dla czytelności, ponieważ miniatury przed nim nie różniły się zbytnio pod tym kątem.

Co wąski zakres robi z oceną

Waga w ocenie nie mierzy, jak ważny jest dany czynnik. Decyduje, jak bardzo końcowa liczba się zmienia, gdy ten czynnik się zmienia. Jeśli czynnik ledwo się zmienia, duża waga na nim głównie dodaje tę samą wartość do każdej miniatury. Podnosi wynik wszystkich, nie rozdzielając nikogo.

Czytelność miała jedną z największych wag po stronie kliknięć w naszej ocenie, mimo że zmieniała się mniej niż cokolwiek innego, co mierzymy. W praktyce działała jak prawie stały bonus, a stały bonus kompresuje dokładnie te różnice między miniaturami, które reszta oceny ma pokazywać.

Co się stało, gdy usunęliśmy czytelność z oceny

Nie musieliśmy zgadywać. Badanie już zawiera wszystkie podoceny dla każdej miniatury, więc ogólną ocenę można przeliczyć przy dowolnym zestawie wag, bez zadawania modelowi nowych pytań. Ponownie uporządkowaliśmy wszystkie 321 par, z czytelnością przy oryginalnej wadze, przy kilku zmniejszonych wagach i przy zerze, porównując wyniki z pełną precyzją, a nie jako zaokrąglone liczby całkowite — dlatego te dane są nieco wyższe niż opublikowane wcześniej 59,5%.

Przy oryginalnej wadze ocena wskazywała lepiej sprawdzający się film w 62,0% par. Przy zerze, z czytelnością całkowicie usuniętą, wskazywała lepszy film w 62,0% par. Każda wartość pomiędzy utrzymywała się w odległości 0,6 punktu od tej wartości. W połowie kanałów, których żadne z naszych eksperymentów z promptami nie dotyczyły, wynik był taki sam: 59,4% przy oryginalnej wadze i 59,4% przy zerze.

Dlaczego zmniejszyliśmy wagę, a nie usunęliśmy jej całkowicie

Dane pozwoliłyby na całkowite usunięcie czytelności. Nie zrobiliśmy tego z powodu tego, kto był w próbie. Każdy kanał w badaniu był zaawansowany: długie historie publikacji, stabilna publiczność, miniatury tworzone przez osoby, które dawno już nauczyły się, jak robić czytelny tekst. To właśnie dlatego czytelność wydawała się bezczynna.

To nie jest to, kto używa sprawdzarki miniatur. Twórca publikujący swój dziesiąty film z małym napisem na zatłoczonym tle to właśnie ta osoba, dla której czytelność ma znaczenie — i dla niej różnice są ogromne. Usunięcie jej na podstawie próby, która nie zawiera takich miniatur, byłoby odpowiedzią na pytanie, które dane nigdy nie zadawały. Dlatego jej wagę znacznie zmniejszyliśmy, a różnicę rozłożyliśmy proporcjonalnie na inne czynniki kliknięć, pozostawiając ich kolejność bez zmian.

Dla typowej miniatury ogólna ocena spada o około jeden punkt. Przetestowaliśmy również pełną statystyczną ponowną wagę wszystkich dwunastu czynników; zyskaliśmy 1,9 punktu, co mieści się w zakresie szumu dla próby tej wielkości, więc pozostałe wagi pozostawiliśmy bez zmian.

Próg czytelności, który każda miniatura musi przekroczyć

Nic z tego nie oznacza, że czytelność można pominąć. Oznacza, że jest to sprawdzian „przeszedł/nie przeszedł”, który trzeba szybko przejść, a potem przestać polerować. Pracowalna wersja tego sprawdzianu:

  1. Zmniejsz miniaturę do około rozmiaru, w jakim pojawia się na liście sugerowanych filmów, i spójrz na nią przez sekundę. Jeśli nie możesz przeczytać każdego słowa, to za dużo słów albo są zbyt małe.
  2. Policz słowa na obrazie. Trzy lub cztery to już dużo przy tym rozmiarze, a zwykle lepiej czyta się krótkie zdanie niż całe zdanie.
  3. Sprawdź kontrast w odcieniach szarości. Tekst, który wyróżnia się z tła tylko kolorem, znika dla niektórych widzów i na niektórych ekranach.
  4. Znajdź jedno miejsce, na które oko ląduje najpierw. Jeśli dwa punkty fokalne rywalizują, miniatura każe widzowi wybrać, zanim zdecyduje się kliknąć.
  5. Spójrz na nią obok miniatur, obok których faktycznie się pojawi. Czytelność na pustym tle to nie to samo, co czytelność w zatłoczonym feedzie.

Jeśli miniatura spełnia wszystkie pięć warunków, dodatkowa praca nad czytelnością ma mało szans, by ją rozdzielić od filmu obok niej.

Gdzie warto poświęcić wysiłek, gdy tekst jest już czytelny

W naszym oryginalnym teście czynnik, który najwyraźniej rozdzielał nadperformujące filmy kanału od podperformujących, to jasność obietnicy: jak jednoznacznie opakowanie mówi, o czym jest film. Następnie szły sygnał „strach przed przegapieniem” i pilność. Wszystkie trzy żyją głównie w tytule i w tym, jak tytuł i obraz współpracują, a nie w czytelności liter.

To pasuje do jedynego eksperymentu w badaniu, który zmieniał tytuł, pozostawiając obraz bez zmian. Gdy każdą miniaturę ponownie oceniono w stosunku do tytułu innego filmu, jej wynik zmienił się średnio o ponad jedenastu punktów — około trzy razy więcej niż cały zakres czytelności. Z punktu widzenia naszego modelu słowa niosą większą różnicę niż literowanie. Jeśli chcesz zobaczyć, gdzie Twoje opakowanie się znajduje, możesz ocenić miniaturę i tytuł pod kątem tych samych dwunastu czynników i zobaczyć, które z nich Cię hamują.

Ograniczenia tego wniosku

Wszystko to opisuje zaawansowane, anglojęzyczne kanały, oceniane przez jeden model. Czytelność wydawała się bezczynna, ponieważ te kanały już ją rozwiązały — i ten wniosek nie powinien być automatycznie przenoszony na nowy kanał bez tej zastrzeżenia.

Wartości czytelności to oceny modelu, a nie niezależne pomiary, więc model, który systematycznie nadmiernie oceniałby czytelność, wyprodukowałby ten sam wąski zakres. Uważamy to za mało prawdopodobne, ponieważ ten sam model użył niemal całej skali dla innych czynników, ale te dane same w sobie nie mogą tego wykluczyć. I jak w oryginalnym badaniu, wszystko to to asocjacja: żadna miniatura nie została zmieniona i ponownie opublikowana, by zobaczyć, co się stanie.

Często zadawane pytania

Czy rozmiar tekstu w miniaturze ma znaczenie na YouTube?

Tak, jako próg. Tekst, którego nie da się przeczytać w rozmiarze, w jakim miniatura pojawia się w feedzie, marnuje zajmowane miejsce. Nasze dane sugerują, że prawie wszystkie zaawansowane kanały już ten próg przekroczyły — więc gdy tekst jest czytelny, zwiększanie jego rozmiaru lub pogrubienie ma mało szans, by rozdzielić jeden film od drugiego.

Dlaczego czytelność przestała mieć znaczenie w Twojej ocenie?

Nie przestała mieć znaczenia — przestała rozdzielać. W 642 miniaturach z zaawansowanych kanałów oscylowała jedynie od 85 do 95, więc dodawała niemal tę samą wartość do każdego wyniku. Usunięcie jej nie zmieniło zdolności oceny do rankingu rzeczywistych filmów — dlatego jej wagę zmniejszono.

Czy powinienem przestać pracować nad czytelnością miniatury?

Tylko gdy przejdzie szybki test w rozmiarze feedu: każde słowo czytelne w około sekundę, jeden wyraźny punkt fokalny i wystarczający kontrast, by przetrwać w odcieniach szarości. Poza tym punktem, czas poświęcony na tytuł i na to, jak jasno opakowanie formułuje swoją obietnicę, ma większe szanse na zmianę porównania filmu z sąsiednimi.

Czy to zmieniło moje istniejące wyniki miniatur?

Lekko. Zmniejszona waga czytelności i zwiększone wagi innych czynników kliknięć powodują, że typowa ogólna ocena spada o około jeden punkt. W odniesieniu do referencyjnych miniatur, które sprawdzamy przy każdej zmianie, żadna ocena się nie zmieniła, a największa zmiana to jeden punkt.

Czy to dotyczy małych lub nowych kanałów?

Nie automatycznie. Każdy kanał w próbie był zaawansowany — właśnie dlatego czytelność pokazywała tak mało zmienności. Nowszy kanał ma znacznie większe szanse na rzeczywiście trudne do odczytania miniatury — i dla nich czytelność może być najważniejszą rzeczą do poprawienia jako pierwsza.