Product Hunt 本日Product Huntで公開中です。アップボートで応援してください →

ホワイトボードアニメーションの仕組み

動画生成モデルではなく、4つの一般的な工程を正しい順序で進めます。

更新日: 2026-09-10

ステップ1:台本が後工程のすべてを決める

最初にナレーションを書き込むか貼り付けます。その長さでボードの枚数が決まり、言葉の内容で各ボードに何を描くかが決まるためです。1枚につき約12〜16秒の音声にすると、細切れにも間延びにも感じないテンポになります。

ステップ2:1枚のボードに1つの絵

各ボードは、左右や4分割などのレイアウトを明示した1枚の完成イラストとして生成し、台本の各部分を対応する領域に割り当てます。ボード全体を一度に生成することで構図がまとまり、個別の素材を組み合わせる旧式ツールのようなコラージュ感を防げます。

ステップ3:線を抽出する

完成したイラストを二値化して紙と線を分離し、線を1ピクセル幅の骨格に細線化してから、ストローク経路へ変換します。そのため、絵には広い余白が必要です。背景が暗いと抽出する線を判別できず、描画結果がノイズになります。

ステップ4:描画表示のタイミングを合わせる

音声合成は単語ごとのタイムスタンプを返します。各ボードの領域は、ナレーションが対応部分の最初の単語に達した瞬間から表示され、同じ線を二度描かないよう後の領域を前の領域から除外します。

よくある質問

動画生成モデルで作っていますか?

いいえ。絵コンテ、静止画イラスト、音声合成、ストローク順レンダラーを、この順番で組み合わせています。

なぜ絵に余白が必要なのですか?

線画抽出では、明るい紙面上の暗い線を検出します。暗く塗りつぶした部分には、追跡できる線が残りません。

なぜ要素ごとに別々にアニメーション化しないのですか?

構図が崩れるためです。ボード全体を生成すれば、寄せ集めではなく、設計された1枚の絵になります。

4分間の動画でも描画と音声がずれないのはなぜですか?

固定フレームレートではなく単語単位のタイムスタンプでタイミングを決めるため、時間がたってもずれが蓄積しません。