よく使われるもの
その他すべて
動画生成モデルではなく、4つの一般的な工程を正しい順序で進めます。
更新日: 2026-09-10
最初にナレーションを書き込むか貼り付けます。その長さでボードの枚数が決まり、言葉の内容で各ボードに何を描くかが決まるためです。1枚につき約12〜16秒の音声にすると、細切れにも間延びにも感じないテンポになります。
各ボードは、左右や4分割などのレイアウトを明示した1枚の完成イラストとして生成し、台本の各部分を対応する領域に割り当てます。ボード全体を一度に生成することで構図がまとまり、個別の素材を組み合わせる旧式ツールのようなコラージュ感を防げます。
完成したイラストを二値化して紙と線を分離し、線を1ピクセル幅の骨格に細線化してから、ストローク経路へ変換します。そのため、絵には広い余白が必要です。背景が暗いと抽出する線を判別できず、描画結果がノイズになります。
音声合成は単語ごとのタイムスタンプを返します。各ボードの領域は、ナレーションが対応部分の最初の単語に達した瞬間から表示され、同じ線を二度描かないよう後の領域を前の領域から除外します。
いいえ。絵コンテ、静止画イラスト、音声合成、ストローク順レンダラーを、この順番で組み合わせています。
線画抽出では、明るい紙面上の暗い線を検出します。暗く塗りつぶした部分には、追跡できる線が残りません。
構図が崩れるためです。ボード全体を生成すれば、寄せ集めではなく、設計された1枚の絵になります。
固定フレームレートではなく単語単位のタイムスタンプでタイミングを決めるため、時間がたってもずれが蓄積しません。