「ショート動画 構成 作り方」で検索したなら、結論から言うと、伸びる動画は「フック(0〜3秒)→本編(価値提供)→CTA(行動喚起)」の3段構成に、ジャンルごとの型を掛け合わせて作られています。構成テンプレートをコピーするだけでは伸びません。台本の順番(構成)と中身(ギャップ・意外性)の掛け算で初めて「最後まで見られる動画」になります。この記事では、構成の基本テンプレートから、秒数配分の具体サンプル、ジャンル別の型、そして「テンプレ通りに作ったのに伸びない」現場でよくある5つの落とし穴まで、数値と比較表で具体的に解説します。顔出しなしで動画制作を始めたい方でも迷わず台本に落とし込めるよう、コピーしてすぐ使えるチェックリストも用意しました。
この記事は2026年8月時点の情報をもとに、顔出しなしYouTube副業メディアShortyの編集部が、実際にショート動画を制作・検証した内容をまとめています。
なお、この台本をそのままキャラ動画に落とし込みたい場合は、無料で完結するずんだもん動画の作り方の全工程が具体的な作業手順になります。
ショート動画の構成とは?結論はフック・本編・CTAの3段構成
ショート動画の構成とは、15〜60秒という短い尺の中に「視聴者を止める」「価値を届ける」「次の行動を促す」という3つの役割を配置する設計図のことです。多くの解説記事が触れている共通点をまとめると、構成の役割は以下の3段に集約されます。
- フック(0〜3秒): 視聴を止めさせる一言・映像。「見る理由」を提示する
- 本編(3秒〜終盤): フックで約束した内容を届ける。情報密度を高め、間延びを削る
- CTA(ラスト1〜3秒): 「保存」「フォロー」「コメント」など、次の行動を1つだけ指定する
この3段構成が「型」として機能する理由は、視聴維持率のデータにあります。ショート動画は冒頭3秒以内に視聴者の意思決定が終わっており、複数の分析記事で「視聴者の3割以上が冒頭10秒以内に離脱する」「冒頭1〜2秒でユーザーの興味を引けるかが成功のカギ」という傾向が報告されています。つまり構成における最優先事項は「本編の作り込み」ではなく「フックの設計」です。この前提を後回しにして本編の情報量を詰め込む台本は、フックで離脱されて誰にも届きません。
フックの作り方には代表的な3つの型があります。台本を書く段階では、この3つを必ず全部書き出してから比較してください。
- 数字型: 「〇〇円節約できた方法」「たった3日で〇〇」のように具体的な数字を先出しする
- 疑問型: 「〇〇って実は間違ってた?」「知らないと損する〇〇」のように答えを知りたくさせる
- ビフォーアフター型: 結果の映像・状態を先に見せて「どうやって?」と思わせる
どの型が刺さるかはジャンルと視聴者層によって変わるため、1本の動画で1つの型に固定するのではなく、同じテーマでも週によって型を変えてテストする運用が現実的です。数字型は情報系・比較系のテーマと相性が良く、疑問型は「常識を覆す」系のテーマ、ビフォーアフター型は変化が目に見えるテーマ(片付け・料理・作業効率化など)と特に相性が良い傾向があります。
ショート動画の基本構成テンプレート:フック・本編・CTAの黄金比
まずは最も汎用性の高い基本テンプレートを、秒数配分つきで示します。60秒尺を基準にした黄金比は以下の通りです。この配分は雑学・ノウハウ・Vlogいずれのジャンルでも土台として使える汎用フォーマットなので、初めて構成を組む場合はまずこの比率通りに1本作ってみることをおすすめします。
| パート | 尺の目安(60秒中) | 役割 | NG例 |
|---|---|---|---|
| フック | 0〜3秒(5%) | 疑問・数字・ビフォーアフターで指を止める | 自己紹介から入る、前置きが長い |
| ブリッジ | 3〜6秒(5%) | 「この後〇〇を解説します」と予告し離脱を防ぐ | 予告なしにいきなり本題へ飛ぶ |
| 本編 | 6〜50秒(73%) | 約束した内容を、1カット3〜5秒でテンポよく展開 | 1カットが長すぎる、専門用語だらけ |
| CTA | 50〜60秒(17%) | 「保存して」「フォローして」を1つだけ指定 | 保存・フォロー・コメントを全部お願いする |
このテンプレートのポイントは、フックとCTAだけで尺の1割程度しか使わない点です。にもかかわらず、この2箇所の完成度が再生数の大半を決めます。本編に時間を割きすぎて冒頭フックが弱い台本は、そもそも本編まで見てもらえないため、構成を考える順番も「フック→CTA→本編」が効率的です。
台本を書く際は、次の3段の空欄をまず埋めてから撮影・編集に入るとブレません。
- フック:( )秒で伝える一言は?
- 本編:フックで約束した内容を、何個の情報に分解するか?
- CTA:視聴者にしてほしい行動は「保存」「フォロー」「コメント」のどれ1つか?
秒数配分シミュレーション:15秒・30秒・60秒の台本サンプル
構成テンプレートは尺によって配分が変わります。多くの解説記事は「フック・本編・CTA」という役割の説明で終わっていますが、実際に台本を書くときに迷うのは「では何秒ずつ話せばいいのか」という具体の秒数です。ここでは尺別に、実際の台本イメージをカット単位で示します。
15秒(日常Vlog・体験談向け)
- 0〜2秒:結果の映像を先出し(フック)
- 2〜4秒:「これ、〇〇しただけです」(ブリッジ)
- 4〜12秒:過程を3カットでテンポよく(本編)
- 12〜15秒:「コメントで感想教えて」(CTA)
30秒(雑学・豆知識向け)
- 0〜3秒:「実は〇〇って知ってた?」(フック)
- 3〜5秒:「今日はその理由を解説します」(ブリッジ)
- 5〜25秒:結論→理由→具体例を1カット4〜5秒で計4カット(本編)
- 25〜30秒:「保存して後で見返して」(CTA)
60秒(ノウハウ・How to向け)
- 0〜3秒:「〇〇の方法、実は間違ってます」(フック)
- 3〜6秒:「正しいやり方を3ステップで解説します」(ブリッジ)
- 6〜50秒:手順1・手順2・手順3を1手順あたり13〜15秒で展開(本編)
- 50〜60秒:「フォローして続きを見て」+要点の再掲(CTA)
3パターンに共通しているのは、フックとブリッジで尺全体の1割前後しか使っていない点と、CTAの直前に「行動する理由」を一言添えている点です。これは、CTAだけを単独で言うよりも、感情が動いた直後にCTAを重ねる方が行動率が上がりやすいという傾向を踏まえた配分です。
台本を書くときは、まずこの秒数配分の空欄に「何を話すか」を一言メモで埋めてから、実際のセリフに肉付けしていくと、尺オーバーやカット数の過不足に気づきやすくなります。特に60秒尺のノウハウ系は手順を欲張って4つ以上に増やしがちですが、1手順あたりの尺が10秒を切ると説明が駆け足になり理解が追いつかなくなるため、手順は3つまでに絞るのが安全域です。
台本作成の4ステップ:企画から撮影準備まで
構成テンプレートを実際の台本に落とし込む手順を、4ステップに分解します。慣れれば1本あたり30分〜1時間、テンプレートを使えばさらに短縮できます。
- ターゲットと悩みを1文で定義する: 「誰の」「どんな悩み」を解決する動画かを1文で書く。ここが曖昧だとフックもぼやける
- フックを3パターン書き出し、一番強いものを選ぶ: 「数字で驚かせる」「疑問形で始める」「ビフォーアフターを見せる」の3パターンを必ず書き出して比較する
- 本編を箇条書きで骨組みだけ作る: セリフを書く前に「伝える情報の順番」だけを箇条書きにする。この段階で情報を3〜5個に絞り込む
- CTAとテロップ位置を決めて台本を完成させる: 最後にCTAを1つ決め、カットごとのテロップ文言を割り振る
このステップで重要なのは、2番目の「フックを3パターン書き出す」という工程を省略しないことです。多くの初心者は本編のセリフから書き始めてしまいますが、それでは構成の主導権が本編側にあるままフックが後付けになり、結果的に弱いフックのまま公開してしまいます。台本の型を無料でダウンロードして使いたい場合は、ショート動画の台本テンプレートを先に埋めてから撮影に入ると迷いません。
なお、4ステップの所要時間の目安は「1:5分」「2:5分」「3:10分」「4:10分」の合計30分です。ここに撮影・編集の時間が別途30分〜1時間ほど加わるため、構成〜台本の工程だけで制作全体の3〜4割の時間を占める計算になります。裏を返せば、構成に時間をかけるほど撮影・編集の手戻りが減るということでもあり、台本を固めずに撮影から始めると、後から「セリフが長すぎた」「情報が足りなかった」といった修正で余計に時間がかかりがちです。
ジャンル別の構成パターン3選
構成の型は万能ではなく、ジャンルによって最適な配分が変わります。同じ「フック・本編・CTA」の3段構成でも、フックの引き方や本編での情報の見せ方、CTAで求める行動はジャンルごとに定石が異なるため、まず自分が投稿したいジャンルがどの型に近いかを把握しておくと、以降の台本作成がスムーズになります。代表的な3ジャンルの構成パターンを比較します。
| ジャンル | フックの型 | 本編の作り方 | CTAの型 | 平均尺 |
|---|---|---|---|---|
| 雑学・豆知識 | 「実は〇〇って知ってた?」の疑問投げかけ | 結論→理由→具体例の順で1情報に絞る | 「保存して後で見返して」 | 20〜40秒 |
| ノウハウ・How to | 「〇〇の方法、実は間違ってます」の否定形 | 手順を番号で提示、1手順3〜5秒 | 「フォローして続きを見て」 | 30〜60秒 |
| 日常Vlog・体験談 | ビフォーアフターの映像を先出し | 時系列ではなく「結果→過程」の逆順で見せる | 「コメントで感想教えて」 | 15〜30秒 |
雑学系のフォーマットで動画を量産する場合は、企画・構成のパターン自体をハブ記事として体系化しています。ジャンル選定から構成の作り方まで一通り知りたい場合は、雑学動画の作り方にジャンル横断の考え方をまとめているので合わせて確認してください。
3ジャンルとも共通しているのは「フックの型」と「CTAの型」を先に固定してから、本編の中身だけをテーマごとに差し替えるという作り方です。本編の中身を毎回ゼロから考えるのではなく、決まった型のスロットにテーマを当てはめていく方式にすると、1本あたりの構成作成にかかる時間を大きく短縮できます。逆に、ジャンルに合わない型を無理に使うと、テンポが噛み合わずに違和感が出やすい点には注意してください。例えば日常Vlog系のフックにノウハウ系の「否定形フック」を使うと、押しつけがましい印象になり離脱率が上がる傾向があります。
ここまでの手順、1本ぶんまるごと自動でやりますShorty はテーマを入力するだけで、台本・AI音声・字幕・BGMを揃えた雑学ショート動画を生成します。無料プランは30日5本まで。無料で作ってみる構成を作ったのに伸びない5つの原因
ここまでの型通りに構成を組んでも、思うように再生数が伸びないケースは珍しくありません。現場で見落とされがちな原因を5つ挙げます。特に1つ目と2つ目は「テンプレート通りに作ったから大丈夫」という一般論に対する反論です。
- フックの「型」は合っているが「中身」が弱い: 疑問形フックという型は正しくても、疑問の中身が視聴者の悩みとズレていれば止まりません。型よりもリサーチが先です
- 本編の情報量が多すぎる: 60秒に5個以上の情報を詰め込むと、1情報あたりの説明が3秒未満になり理解が追いつかず離脱されます。情報は3個までに絞るのが安全域です
- テロップと音声のタイミングがズレている: 無音視聴が前提のプラットフォームでは、テロップが1テンポ遅れるだけで内容が伝わらず、構成が良くても評価されません
- CTAが複数ある: 「保存してコメントしてフォローして」と欲張ると、どの行動も選ばれにくくなります。効果測定でもCTAを1つに絞った動画の方が行動率が高い傾向が報告されています
- 投稿本数が少なすぎて型の検証ができていない: 構成テンプレートは1本の結果では良し悪しを判断できません。同じ型で最低5〜10本投稿し、フックの初速(再生開始3秒の維持率)を比較して初めて「自分のジャンルに合う型」がわかります
特に5番目は見落とされがちです。「1本作って伸びなかったから構成が悪い」と判断するのは早計で、実際には型の問題ではなくジャンルとの相性や投稿タイミングが原因のケースもあります。構成テンプレートはPDCAを回す前提の道具であり、1本の正解を探す道具ではありません。
これは一般に言われる「構成テンプレートさえ使えば伸びる」という説明への反論でもあります。多くの解説記事は「型を守れば結果が出る」という前提で書かれていますが、実際の現場では同じ型を使った動画でも再生数が10倍以上ばらつくことが珍しくありません。差を生んでいるのは型そのものではなく、型の中に入れる「情報の選び方」と「言い回しの熱量」です。構成を学ぶ段階では型の暗記に時間をかけすぎず、型に何を入れるかのリサーチと検証に時間を使う方が結果につながりやすいというのが、実践してきた上での実感です。
また、投稿本数と初速の関係を数値で見ておくと判断がしやすくなります。目安として、同じ構成テンプレートで5本投稿した場合の「冒頭3秒維持率」を並べ、80%を超える本数が2本以上あれば型として機能している、全体的に60%を下回るならフックの中身から見直す、といった簡易的な合格ラインを決めておくと、感覚ではなく数値で改善判断ができます。
構成作成・台本制作を効率化するツール比較
構成を考えるところまでは頭でできても、台本化・テロップ入れ・BGM選定を全部手作業でやると1本あたりの制作時間が伸びてしまいます。代表的なツールを比較します。
| ツール | 得意なこと | 料金の目安 | 台本〜構成の自動化度 |
|---|---|---|---|
| CapCut | カット編集・テロップ・BGM | 基本無料(一部課金) | 低(構成は自分で考える) |
| Vrew | 音声からのテロップ自動生成 | 無料プランあり | 低(テロップ効率化がメイン) |
| Canva | サムネ・図解デザイン | 無料プランあり | なし(デザイン特化) |
| ChatGPT等の汎用AI | 台本の壁打ち・フック案出し | 無料〜月20ドル前後 | 中(プロンプト次第) |
| Shorty | フック・本編・CTAの型に沿った台本〜動画生成 | 無料プランあり(後述) | 高(構成テンプレートを内蔵) |
このうち当サイトが開発・運営しているツールが「Shorty」です。フック・本編・CTAという本記事で解説した3段構成のテンプレートをあらかじめ内蔵しており、ジャンルを選ぶと構成案から動画までの流れを短縮できます。ただし無料プランには「1本30秒まで」「30日で5本まで」「保存期間7日」「ショート形式のみ対応」という制約があるため、本数を量産したい場合や30秒を超える尺で作りたい場合は他の選択肢と組み合わせる、あるいは有料プランの検討が必要です。まずは構成の型を試したいだけなら、Shortyを選択肢の1つとして試してみるのも一つの方法です。
BGMや効果音を自分で選定して構成に厚みを出したい場合は、著作権フリーで使える音源を押さえておくと安全です。商用利用の条件を含めて確認したい場合はYouTubeオーディオライブラリの使い方も参考になります。
ツールを選ぶ際は「構成を考える工程」と「編集する工程」のどちらを効率化したいのかを先に分けて考えると失敗しにくくなります。CapCutやVrewは編集工程の時短には強い一方、構成そのものを考える部分は依然として自分の頭で行う必要があります。逆にAIツールやShortyのように構成テンプレートを内蔵しているサービスは、フックの型出しや情報の絞り込みまで含めて時短できますが、細かい編集の自由度は専用編集アプリに劣る場合があります。量産フェーズでは「構成案はAI・テンプレート内蔵ツールで時短し、仕上げの編集だけ手作業で整える」というハイブリッド運用が現実的な落としどころです。
構成テンプレートをそのまま使えるチェックリスト
台本を書き終えたら、撮影に入る前に以下のチェックリストで構成の抜け漏れを確認してください。
- [ ] フックは3秒以内に「見る理由」が伝わる内容になっているか
- [ ] フックの内容とサムネイル・冒頭カットが一致しているか(釣りタイトルになっていないか)
- [ ] 本編で伝える情報は3〜5個以内に絞られているか
- [ ] 1カットの長さは3〜5秒を超えていないか
- [ ] テロップは音声より早く、または同時に表示されるタイミングになっているか
- [ ] CTAは1つだけに絞られているか
- [ ] 全体の尺は15〜60秒に収まっているか
- [ ] 同じ構成テンプレートで最低5本分の投稿計画があるか(1本で判断していないか)
このチェックリストを満たしたうえで複数本を継続投稿し、初速の維持率を比較していくと、自分のジャンルに合った構成の型が見えてきます。台本作成そのものをAIで効率化しながら量産したい場合は、ショート動画のAI量産ワークフローで工程ごとのAI活用手順を解説しているので参考にしてください。
チェックリストは撮影直前だけでなく、投稿後の振り返りにも使えます。伸びなかった動画をこのリストに照らし合わせると、「フックとサムネイルが不一致だった」「CTAを2つ言ってしまっていた」など、感覚では気づきにくい原因が言語化しやすくなります。構成の改善は一度で完成させるものではなく、投稿→チェックリストでの振り返り→次の台本への反映、というサイクルを回すほど精度が上がっていきます。
よくある質問
ショート動画の構成で最も重要なパートはどこですか?
フック(冒頭0〜3秒)です。冒頭で離脱されれば本編もCTAも届かないため、構成全体の中で最優先で作り込む必要があります。
視聴者の3割以上が冒頭10秒以内に離脱するというデータがあり、特に冒頭1〜2秒での興味喚起が再生継続率を左右します。本編の情報量やCTAの言い回しを工夫する前に、まずフックの型を複数パターン書き出して比較することが、構成全体の完成度を上げる最短ルートです。
台本は全部書くべきですか?箇条書きだけでも大丈夫ですか?
初心者はセリフまで全部書く方が失敗しにくいですが、慣れたら箇条書きの骨組みだけでも問題ありません。
台本を一字一句書くメリットは、テロップのタイミングやカットの尺を事前に計算できる点です。一方で、話し慣れている場合は「伝える情報の順番」だけを箇条書きにして、セリフはアドリブで撮影する方がテンポの良い自然な動画になることもあります。まずは全部書く方式で5本ほど作り、自分のペースを掴んでから箇条書き方式に移行するのが現実的です。
ショート動画の尺は何秒がベストですか?
ジャンルによりますが、15〜60秒の範囲内で「伝えたい情報量に対して最短の尺」を選ぶのが基本です。
尺を長くすればするほど情報を詰め込めますが、視聴維持率は下がりやすくなります。雑学系なら20〜40秒、ノウハウ系で手順が多い場合は30〜60秒、日常Vlog系は15〜30秒が目安です。「尺を伸ばして情報を増やす」よりも「情報を削って尺を縮める」方が最後まで見られる動画になりやすい傾向があります。
構成テンプレートを使っても伸びないのはなぜですか?
型が合っていても中身のリサーチ不足、情報過多、CTAの複数指定など、型以外の要因が原因のことが多いです。
構成テンプレート自体は「順番」を整えるための道具であり、フックの中身が視聴者の悩みとズレていたり、本編に情報を詰め込みすぎたりすると、正しい型でも離脱されます。また1本だけの結果で判断せず、同じ型で最低5〜10本投稿してから型の良し悪しを検証する必要があります。
フックとタイトル・サムネイルは何が違いますか?
フックは動画内の冒頭カット、タイトル・サムネイルは動画外の入口です。どちらも一致させる必要があります。
タイトルやサムネイルで期待させた内容と、実際のフックの中身が違うと、クリックはされても即離脱されてしまいます。構成を考える際は、タイトル案とフックのセリフを同時に書き出し、内容が一致しているかを確認してから撮影に入ると、クリック後の離脱を防げます。
CTAは動画の最後だけに入れればいいですか?
最後だけでなく、動画中盤にも軽く入れる方が行動率が上がりやすいとされています。
感情が動いた直後にCTAを差し込むと行動につながりやすいという傾向が報告されており、「保存してね」を本編の途中と最後の2回に分けて言う構成もよく使われます。ただし種類を増やすのではなく、同じ1つの行動を2回リマインドする形にとどめるのがポイントです。
構成作成にAIツールを使うのはアリですか?
アリです。ただしフックの中身と最終チェックは人間が行う前提で使うべきです。
AIはフック案の壁打ちや情報の整理に強く、構成のたたき台を作る時間を大幅に短縮できます。一方で、ターゲットの悩みの解像度やジャンルごとの空気感の判断はAIだけでは精度が出にくいため、AIが出した構成案を自分の言葉で調整する工程を必ず挟むことをおすすめします。
顔出しなしでも構成の作り方は変わりますか?
基本の3段構成(フック・本編・CTA)は変わりませんが、フックの手段が「表情」ではなく「テロップ・図解・声」に限定される点が異なります。
顔出しなしの場合、視聴者の興味を引く手段が視覚的なインパクトよりもテロップの文言力・図解のわかりやすさ・声のトーンに偏ります。そのため、フックの台本を書く段階でテロップの文言だけで「3秒で止まるか」をテストする意識が、顔出しありの構成よりも重要になります。逆に言えば、顔を出さなくても台本と図解の質さえ高ければ十分に構成で勝負できるということでもあり、これは顔出しなしで動画制作を始めたい人にとってはむしろ有利な条件です。
構成テンプレートは何本くらい使い回して大丈夫ですか?
同じアカウント内であれば、視聴者が飽きるまでは使い回して問題ありません。目安は同じ型で10〜15本です。
構成の「型」はフレームワークであり、視聴者が意識的に認識するものではないため、中身のテーマが毎回違えば同じ型を繰り返しても不自然にはなりません。ただし、コメント欄で「またこのパターンか」といった反応が増えてきたら、フックの言い回しや本編の見せ方を少し変えるタイミングです。型を完全に変える必要はなく、同じ骨組みの中で表現のバリエーションを増やす程度の調整で十分なことが多いです。
あわせてショート動画の台本の書き方とテンプレ20選を読んでおくと、次の工程でつまずく箇所を先回りして潰せます。
まとめ
ショート動画の構成は「フック(0〜3秒)→本編(3〜5個の情報に絞る)→CTA(1つに絞る)」の3段構成が基本であり、この型はジャンルが変わっても土台として機能します。ただし型通りに作っても、フックの中身が弱い、情報を詰め込みすぎる、CTAを複数指定するといった要因で伸びないケースは珍しくありません。1本の結果で型の良し悪しを判断せず、同じ構成テンプレートで複数本を投稿してフックの維持率を比較検証すること、そしてリスクとして「テンプレート通りに作れば必ず伸びるわけではない」ことを踏まえたうえで、台本テンプレートやAIツールを活用しながら継続的に改善していくのが、現実的な進め方です。
まずは本記事の秒数配分サンプルとチェックリストを使って1本台本を書き、実際に撮影・投稿してみてください。型を知識として理解することと、型を使って実際に1本仕上げることの間には大きな差があります。構成に迷ったら基本の3段構成に立ち返り、フック・本編・CTAのどこが弱いのかを1つずつ切り分けて改善していくのが、遠回りに見えて最も確実な上達ルートです。
「必ずバズる構成」というものは存在しません。同じ型でも結果がばらつく前提を踏まえたうえで、数字で振り返りながら小さく改善を積み重ねていく姿勢こそが、顔出しなしでショート動画を続けていくうえでの一番の近道になります。