リサーチサムネイルデザイン

サムネイルの可読性は必須条件、勝敗を分ける要素ではない

642件の実際のサムネイルを分析した結果、可読性の差はわずかで、スコアから除外しても精度に変化はなかった。なぜ可読性は最低限の基準にすぎないのか。

September 14, 20268 min read
サムネイルの可読性は必須条件、勝敗を分ける要素ではない

ほとんどのサムネイルに関するアドバイスは、可読性から始まります:大きな文字、高いコントラスト、1つの焦点。このアドバイスは正しいですが、既に確立されたチャンネルはすでにこのレベルに達しています。642件の実際のサムネイルを分析した結果、可読性スコアはほとんど変動せず、スコアから可読性を削除しても、実際の動画のランキング精度には一切変化がありませんでした。

主なポイント

  • 確立されたチャンネルの642件のサムネイルにおいて、可読性サブスコアは85~95の狭い範囲にとどまり、他のすべての測定項目より変動幅が小さかった。
  • 可読性をスコアから完全に削除しても、ランキング精度はまったく変わらず、321組の同チャンネルペアの62.0%を正しく評価。
  • 可読性は依然として最低限の基準として重要。スマートフォンサイズで誰も読めないサムネイルは、他の要素を評価される前に失敗する。ただし、優れた動画と非常に優れた動画を区別する要素ではなくなった。
  • サンプルには初心者が含まれていなかったため、可読性の重みを大幅に減らしたが、ゼロにはしなかった。
  • テキストが読みやすくなったら、残りの差異はタイトルと「約束の明確さ」に集中していた。

サムネイルの可読性は動画のパフォーマンスに影響するか?

可読性は、サムネイルが「ゲームに参加できるかどうか」を決めるだけで、「勝つかどうか」は決めていません。確立されたチャンネルでは、私たちのモデルはほぼすべてのサムネイルを「読みやすい」と評価したため、可読性ではヒット動画とそうでない動画を区別できませんでした。可読性をスコアから削除しても、実際の動画のランキング精度は以前とまったく同じ:321組の62.0%。

これは一見すると広範囲に聞こえますが、その限定性こそが重要です。可読性が重要でないと言っているわけではありません。確立されたチャンネルでは、可読性の問題はすでに解決されており、全員がクリアしている要素は誰かをランキングできない、ということです。

実際のサムネイル間で可読性はどれくらい変動するか?

本研究のすべてのサムネイルは12の要素で評価されました。以下は、642件のサムネイル全体(公開済みテストで使用した321組と同じ)における6つの要素の変動幅です。スプレッド列は標準偏差:つまり、典型的なサムネイルが平均からどれだけ離れているかを示します。

要素最低~最高スコアスプレッド
可読性85~953.7
クリックベイトリスク3~445.4
興味喚起29~686.8
タイトルの強さ23~9310.3
約束の明確さ8~9513.9
クライマックス17~9314.9

可読性は単に最も狭い列というだけでなく、その全体の範囲(最低~最高)が、表の下部にある要素の平均からの典型的な距離よりも小さいのです。サンプル中最も弱いサムネイルでさえ85点を獲得しています。

これらは定規で測った数値ではなく、私たちのモデルによる評価です。しかし、モデルは全体的に甘く評価していたわけではありません:約束の明確さは8~95とほぼ全範囲にわたって広がっていました。モデルには範囲の余裕がありましたが、サムネイル自体に大きな差がなかったため、可読性にはそれを活用しませんでした。

狭い範囲がスコアに与える影響

スコア内の重みは、その要素の重要性を測るものではありません。その要素が変化したときに最終スコアがどれだけ動くかを決定します。要素の変動がほとんどない場合、大きな重みを付けても、ほぼすべてのサムネイルに同じ量を加えるだけです。誰も区別されずに、全員のスコアが上がります。

可読性は、私たちのスコアのクリック側で最も大きな重みの1つでしたが、測定したすべての要素の中で最も変動が少なかった。実際には、ほぼ一定のボーナスとして機能し、その一定のボーナスは、スコアの他の部分が示そうとしているサムネイル間の差異を圧縮していました。

可読性をスコアから削除した結果

推測する必要はありませんでした。研究にはすでにすべてのサムネイルのサブスコアが含まれているため、モデルに新たに質問することなく、任意の重みセットで全体スコアを再計算できます。321組すべてを、可読性を元の重み、いくつかの軽減された重み、およびゼロで再ランク付けし、丸められた整数ではなく完全な精度でスコアを比較しました — これが、公開された59.5%よりわずかに高い数値となっている理由です。

元の重みでは、スコアは62.0%のペアでよりパフォーマンスの高い動画を選びました。ゼロ(可読性を完全に削除)でも、62.0%のペアでより良い動画を選びました。その間のすべての値は、0.6ポイント以内で安定していました。私たちのプロンプト実験に触れなかったチャンネルの半分では、結果は同じでした:元の重みで59.4%、ゼロでも59.4%。

なぜ削除せず重みを減らしたのか

データ上では可読性を完全に削除することも可能でした。しかし、サンプルに含まれていた対象が理由でそうしませんでした。研究のすべてのチャンネルは確立されており、長いアップロード履歴、安定した視聴者層、テキストを読みやすくする方法をすでに学んだ人が作成したサムネイルでした。だからこそ、可読性が「不活性」に見えたのです。

これはサムネイルチェッカーの利用者を表しているわけではありません。10本目の動画をアップロードし、忙しい背景に小さなキャプションを配置するクリエイターこそ、可読性が役立つ対象であり、その人にとっては可読性の差は非常に大きいです。このようなサムネイルを含まないサンプルに基づいて可読性を削除するのは、データが問うていない質問に答えていることになります。そのため、重みを大幅に減らし、その差を他のクリック要素に既存の重みに比例して分配しました。これにより、他の要素の順位は変わりません。

典型的なサムネイルでは、全体スコアは約1ポイント下がります。また、12要素すべての完全な統計的再重み付けも試しましたが、1.9ポイントの向上にとどまり、このサンプルサイズではノイズの範囲内でした。そのため、他の重みはそのままにしました。

すべてのサムネイルがクリアすべき可読性の基準

これらは可読性を無視してもよいという意味ではありません。これは、素早くクリアする「合格・不合格」のチェックであり、その後は磨きをかける必要がないということです。そのチェックの実用的なバージョン:

  1. サムネイルを、おすすめ動画リストに表示されるサイズに縮小し、1秒間見てください。すべての文字が読めない場合、文字が多すぎたり小さすぎたりしています。
  2. 画像上の文字数を数えてください。3~4語でもそのサイズでは多いです。1つの短いフレーズは、文よりも読みやすいことが多いです。
  3. グレースケールでコントラストを確認してください。色だけで背景と区別されるテキストは、一部の視聴者や画面では見えなくなります。
  4. 目が最初に止まる1つのポイントを見つけます。2つの焦点が競合している場合、視聴者はクリックを決める前に選択を迫られます。
  5. 実際に隣に表示されるサムネイルの横に並べて見てください。白いキャンバス上で読みやすいからといって、混雑したフィードで読みやすいとは限りません。

サムネイルが5つすべてをクリアした場合、可読性にさらに手を加えても、隣の動画との差を生む可能性は低いです。

テキストが読みやすくなった後の努力の重点

元のテストでは、チャンネル内の「過剰パフォーマー」と「低パフォーマー」を最も明確に区別した要素は「約束の明確さ」:パッケージが動画の内容をどれほど曖昧さなく伝えるかでした。次に「見逃し恐怖」のシグナルと「緊急性」が続きます。これら3つは主にタイトルにあり、タイトルと画像がどのように連携するかに依存しており、文字の可読性ではありません。

これは、タイトルを変更して画像をそのままにした唯一の実験と一致します。すべてのサムネイルを他の動画のタイトルに対して再評価したところ、平均で11ポイント以上スコアが変動しました — これは可読性の全範囲の約3倍です。私たちのモデルの見解では、文字の「内容」が「書体」よりも差異を生む要因です。自分のパッケージがどこに位置するかを知りたい場合は、サムネイルとタイトルを12の要素で評価し、どの要素が足を引っ張っているかを確認できます。

この知見の限界

ここで述べていることはすべて、1つのモデルで評価された確立された英語チャンネルに関するものです。可読性が不活性に見えたのは、これらのチャンネルがすでにそれを解決していたからであり、この知見をこの注意点なしに新規チャンネルに適用してはいけません。

可読性の数値はモデルの評価であり、独立した測定値ではないため、視認性を系統的に過大評価するモデルであれば、同じ狭い範囲が得られます。同じモデルが他の要素にはほぼ全範囲を使用していたため、これはありそうにないと考えますが、このデータだけでは否定できません。また、元の研究と同様、すべての結果は相関関係であり、サムネイルを変更して再公開してその後の結果を観察したわけではありません。

よくある質問

YouTubeではサムネイルのテキストサイズは重要ですか?

はい、最低限の基準として重要です。フィードに表示されるサイズで読めないテキストは、占めるスペースを無駄にします。私たちのデータが示唆するのは、確立されたチャンネルのほとんどがすでにこの基準をクリアしているため、テキストが読みやすくなったら、さらに大きくしたり太くしたりしても、1つの動画と他の動画を区別する要因にはならない可能性が高いということです。

なぜあなたのスコアで可読性が重要でなくなったのですか?

重要でなくなったわけではなく、区別できなくなったのです。確立されたチャンネルの642件のサムネイルでは、85~95の狭い範囲しかなく、ほぼすべてのスコアに同じ量を加えていました。削除しても動画のランキング精度は変わらなかったため、重みを減らしました。

サムネイルの可読性に手を加えるのをやめてもいいですか?

フィードサイズで素早くチェックして、1秒ですべての文字が読み取れ、1つの明確な焦点があり、グレースケールでも十分なコントラストがある場合に限ります。それ以降は、タイトルやパッケージが約束をどれほど明確に伝えるかに時間を費やす方が、隣の動画との比較で効果的です。

これで既存のサムネイルスコアは変わりましたか?

わずかに変わりました。可読性の重みを減らし、他のクリック要素の重みを補正した結果、典型的な全体スコアは約1ポイント下がります。私たちが変更を検証する基準サムネイル全体では、グレードは変わらず、最大の変動は1ポイントでした。

これは小規模または新規チャンネルにも当てはまりますか?

自動的に当てはまるわけではありません。サンプルに含まれていたすべてのチャンネルは確立されており、だからこそ可読性の変動が非常に小さかったのです。新規チャンネルでは、本当に読みにくいサムネイルがはるかに多い可能性があり、その場合、可読性はまず修正すべき最も重要な要素です。