risetjudulthumbnail

Judul YouTube vs Thumbnail: Mana yang Lebih Penting?

Kami menukar judul antara 321 pasang video dan menilai ulang setiap thumbnail. Peringkat tidak melemah, justru terbalik — bukti bahwa judul membawa lebih banyak sinyal paket.

September 4, 20268 min read
Judul YouTube vs Thumbnail: Mana yang Lebih Penting?

Setiap saran YouTube mengatakan thumbnail adalah yang membuat penonton mengklik. Kami membangun alat untuk menilai kedua elemen tersebut, lalu menjalankan eksperimen yang memisahkannya — dan ternyata judul membawa lebih banyak sinyal. Menukar judul antara dua video tidak hanya melemahkan kemampuan skor kami memilih performa terbaik, tapi justru membalikkannya.

Ringkasan utama

  • Memberi setiap video judul dari video tetangganya menggeser skor rata-rata 11,3 poin, dengan ayunan maksimum 60 poin dari 100.
  • Hanya 3,9% thumbnail yang mendapat skor sama ketika diberi judul berbeda, jadi judul bukan kesalahan pembulatan dalam model.
  • Setelah penukaran, skor memilih video dengan performa lebih baik hanya 42,7% dari waktu — di bawah peluang acak, artinya peringkat terbalik, bukan hanya melemah.
  • Skor yang murni didorong oleh thumbnail akan tetap di 59,5%; yang murni didorong judul akan turun ke 35,2%. Skor yang diamati 42,7% jauh lebih dekat ke judul.
  • Ini tidak membuat thumbnail tidak berguna. Eksperimen ini hanya memanipulasi judul, jadi mengukur bagian judul dan tidak mengatakan apa pun langsung tentang gambar.

Apakah judul atau thumbnail lebih penting di YouTube?

Berdasarkan bukti dari eksperimen ini, judul membawa lebih banyak sinyal yang membedakan video yang melebihi rata-rata channel dari yang justru di bawahnya. Ini bukan jawaban yang kami harapkan dari alat yang dibangun terutama untuk analisis thumbnail, dan muncul dari kontrol yang dirancang untuk memeriksa hal lain sama sekali.

Klaim ini perlu dibatasi. Ini mengukur apa yang menggerakkan skor yang telah terbukti mengikuti performa nyata — bukan pengukuran langsung perilaku penonton. Dan ini membandingkan packaging dalam satu channel, di mana audiens, topik, dan anggaran desain sudah konstan.

Tetap saja, arahnya jelas dan besarnya efek ini tidak halus.

Bagaimana kami mengisolasi kontribusi judul

Setup-nya adalah 321 pasang video, masing-masing pasang dari channel yang sama dan dipublikasikan rata-rata enam hari berbeda, satu jelas melampaui baseline channelnya dan satu jelas di bawahnya. Dinilai secara normal, model kami memeringkatkan mereka dengan benar 59,5% dari waktu, dibandingkan 50% jika dilempar koin.

Lalu kami menilai ulang setiap thumbnail untuk kedua kalinya — dengan menempelkan judul dari video lainnya. Byte gambar identik antara dua pembacaan. Tidak ada yang berubah di pipeline. Jadi setiap poin pergerakan skor antara pembacaan pertama dan kedua dapat dikaitkan hanya pada judul.

Dua pertanyaan dari satu eksperimen

Pertanyaan pertama adalah apakah judul menggerakkan skor sama sekali. Alat yang mengklaim menilai thumbnail dan judul bersamaan, tapi outputnya hampir tidak bereaksi ketika judul diganti, sebenarnya hanya menilai satu bagian dan mengiklankan dua.

Pertanyaan kedua lebih tajam: menjalankan ulang seluruh tes peringkat dengan input yang ditukar mengungkapkan bagian mana yang membawa daya pembeda. Tiga kemungkinan hasil ditulis sebelumnya, bersama artinya masing-masing.

Jika skor didorong olehAkurasi prediksi setelah penukaranInterpretasi
Hanya thumbnail59,5% — tidak berubahMenukar judul tidak mengubah apa pun yang penting
Kedua bagian sama rataSekitar 50% — acakKontribusi keduanya saling meniadakan
Hanya judul35,2% — terbalik sepenuhnyaMembalik judul membalik peringkat
Apa yang kami amati42,7%Dominan judul, tapi tidak eksklusif

Apa yang terjadi ketika kami menukar judul

Skor bergerak sangat jauh. Rata-rata pergerakan absolut adalah 11,3 poin pada skala 0-100, dengan median 8, persentil kesembilan puluh 26, dan satu ayunan maksimum 60 poin. Hanya 3,9% thumbnail yang kembali dengan skor identik di bawah judul berbeda.

Untuk skala, pergeseran rata-rata 11,3 poin ini lebih besar daripada celah biasa yang diberikan model antara dua video dalam satu pasang. Mengubah hanya judul bisa menggeser skor lebih jauh daripada jarak seluruhnya yang biasanya dilihat model antara video hit dan miss channel.

Lalu tes peringkat. Dengan input yang ditukar, skor memilih video dengan performa lebih baik di 137 dari 321 pasang — 42,7%, dengan interval kepercayaan 95% 37,2% hingga 48,3% dan nilai p 0,0101 terhadap 50%. Itu secara signifikan di bawah peluang acak.

Mengapa pembalikan ini tidak bisa jadi artefak pengukuran

Menukar judul juga merusak kecocokan antara judul dan gambar, dan koherensi itu sendiri adalah salah satu dari dua belas hal yang dinilai model. Itu adalah konfusi nyata dan layak disebutkan secara jelas, bukan disembunyikan. Namun, itu tidak bisa menjelaskan hasil ini.

Hukuman tidak sistematis yang diberlakukan pada kedua sisi setiap pasang menambahkan noise. Noise mendorong akurasi ke 50% — ia menenggelamkan sinyal, bukan membalikkannya. Mendarat di 42,7%, di bawah lemparan koin dan lantai 47,4% yang diimplikasikan oleh penanganan seri tes ini, memerlukan sesuatu yang menunjuk ke satu arah untuk dibalik. Itulah yang dilakukan oleh menukar fitur pembeda, dan noise ketidakcocokan saja tidak bisa menghasilkannya.

Apa yang akan membuat kami meragukan temuan ini

Tiga hasil akan membantah pembacaan ini, dan tidak satupun terjadi:

  1. Skor hampir tidak bergerak di bawah judul baru, yang berarti model mengabaikan judul daripada memberinya bobot tinggi.
  2. Akurasi setelah penukaran berada di atau sedikit di bawah 59,5%, yang menunjukkan thumbnail membawa peringkat sendiri.
  3. Akurasi setelah penukaran tepat di 50%, yang menunjukkan kedua bagian berkontribusi sama dan saling meniadakan.

Apa yang berubah tentang cara Anda menulis judul

Bacaan praktisnya adalah bahwa revisi judul adalah edit paling murah dengan pengaruh tinggi yang tersedia bagi Anda. Mendesain ulang thumbnail membutuhkan satu jam atau desainer. Menulis ulang judul hanya butuh dua menit, bisa dilakukan setelah publikasi, dan — berdasarkan bukti ini — menggerakkan sinyal packaging setidaknya sebanyak gambar.

Ini juga mengubah ulang fungsi judul. Dalam breakdown dimensi dari studi yang sama, faktor yang paling membedakan video performa tinggi dari rendah adalah kejelasan janji: seberapa jelas packaging memberi tahu penonton apa yang akan mereka tonton. Itu sebagian besar merupakan sifat judul. Intensitas emosional mentah, hal yang menjadi obsesi saran thumbnail, justru paling sedikit membedakan kedua kelompok.

Jika Anda ingin melihat bagaimana pasangan tertentu dinilai di seluruh dua belas faktor, Anda bisa menjalankan thumbnail dan judul Anda sendiri melalui pipeline yang sama yang digunakan eksperimen ini dan membandingkan dua opsi judul terhadap satu gambar.

Di mana thumbnail tetap bekerja

Eksperimen ini memanipulasi judul dan mempertahankan gambar tetap, yang berarti mengukur bagian judul secara langsung dan bagian thumbnail hanya secara inferensi. Eksperimen cermin — menukar thumbnail, pertahankan judul — belum dijalankan, dan sampai itu dilakukan, posisi jujur adalah bahwa kami telah mengukur satu bagian dengan benar dan yang lainnya melalui pengurangan.

Juga ada alasan struktural untuk tidak menyingkirkan thumbnail. Studi yang sama menemukan bahwa di channel yang menggunakan satu template thumbnail tetap untuk setiap unggahan, akurasi skor runtuh menjadi 48,7% dibandingkan 61,0% di tempat lain. Ketika thumbnail berhenti bervariasi, model berhenti membedakan — yang merupakan bukti bahwa gambar melakukan sesuatu, bukan tidak ada apa-apa.

Apa yang tidak kami uji

Eksperimen ini menunjukkan bahwa skor kami lebih responsif terhadap judul daripada gambar, dan bahwa skor ini mengikuti performa nyata. Ini tidak menunjukkan bahwa keputusan penonton untuk mengklik lebih didorong oleh judul daripada thumbnail. Itu klaim yang berdekatan, dan hanya yang pertama yang dibuktikan di sini.

Setiap pasang berasal dari channel berbahasa Inggris yang sudah mapan dengan riwayat unggahan cukup untuk menghitung baseline stabil. Judul dalam bahasa lain, dan channel yang terlalu baru untuk memiliki baseline, berada di luar cakupan sampel ini. Tidak ada di sini yang mengatakan bahwa bertindak atas judul yang disarankan meningkatkan video nyata — itu eksperimen berbeda, dan itulah yang belum kami jalankan.

Pertanyaan yang Sering Diajukan

Apakah judul lebih penting daripada thumbnail di YouTube?

Dalam eksperimen ini, judul membawa lebih banyak sinyal yang membedakan video performa tinggi dari rendah dalam channel yang sama. Menukar judul antara video berpasangan membalik peringkat, bukan hanya melemahkannya — yang terjadi ketika Anda membalik fitur yang benar-benar bekerja. Ini mengukur perilaku skor, bukan psikologi penonton secara langsung.

Berapa banyak perubahan judul mengubah skor thumbnail?

Rata-rata 11,3 poin pada skala 0-100, dengan median 8 dan ayunan maksimum yang diamati 60. Hanya 3,9% gambar yang mendapat skor identik dengan judul berbeda. Gambar itu sendiri identik byte-nya di kedua pembacaan, jadi setiap poin pergerakan itu dapat dikaitkan dengan judul.

Apakah mengubah judul setelah video dipublikasikan layak dilakukan?

Ini adalah edit packaging paling murah yang tersedia, dan bukti ini menunjukkan itu bukan hal kecil. Judul bisa ditulis ulang dalam hitungan menit tanpa mendesain ulang apa pun, dan menggerakkan skor packaging setidaknya sebanyak gambar. Bandingkan dua atau tiga opsi daripada menganggap yang pertama adalah yang terbaik.

Mengapa menukar judul membuat skor lebih buruk daripada acak?

Karena judul membawa informasi tentang video mana yang performanya lebih baik. Memberi setiap video judul tetangganya membalik informasi itu, bukan menghilangkannya, sehingga peringkat terbalik. Noise acak akan mendorong akurasi ke 50%; turun di bawah 50% memerlukan sinyal nyata yang menunjuk ke arah yang salah.

Apakah ini berarti thumbnail tidak penting?

Tidak. Eksperimen ini hanya mengubah judul, jadi mengukur kontribusi judul secara langsung dan gambar hanya secara tidak langsung. Secara terpisah, di channel di mana setiap thumbnail menggunakan satu template tetap, akurasi skor turun ke tingkat acak — bukti bahwa ketika gambar berhenti bervariasi, model kehilangan sesuatu yang nyata.

Apa yang membuat judul mendapat skor tinggi di kejelasan janji?

Kejelasan janji mengukur seberapa jelas packaging memberi tahu penonton apa yang akan mereka tonton. Judul yang menyebutkan hal spesifik yang dibahas, dan cocok dengan apa yang ditunjukkan gambar, mendapat skor lebih tinggi daripada judul yang dibangun di atas intrik kabur. Di seluruh studi, ini adalah faktor yang paling membedakan video performa tinggi dari rendah.