INMU KINGコラ動画の作り方
広告はアフィリエイトを利用しています。
キャラクターにINMU KINGのダンスを踊らせるなら、動きを移す動画と、踊らせたい人物の画像を別々に用意します。Viggleでダンス素材を作り、編集ソフトで曲に合わせるのが一つの方法です。顔のアップで歌わせたい場合はHeyGen、短い台詞を作りたい場合はElevenLabsを使い分けます。
ここでは、自分の写真・自作キャラクター・使用許可のある素材を使って、まず8〜15秒の動画を作る例を紹介します。各サービスの公式ガイドを基にした手順で、当サイトによる生成結果の実測比較ではありません。画面の名称や利用枠は変更される場合があります。INMU KING本家の制作方法を再現・断定する記事でもありません。
目次
最初に用意する素材
全身のダンスと、顔だけの口パクでは必要な画像が違います。両方作るなら、同じキャラクターの全身画像と顔のアップを一枚ずつ用意してください。
- 人物画像:ダンス用は頭から足先まで入れ、腕や脚が他の物に隠れない画像。口パク用は顔が正面に近く、口がはっきり見える画像。
- 動きの参考動画:自分で振り付けを踊った動画や、使用許可のあるダンス素材。最初は一人が画面内に収まる短い動画を選びます。
- 曲・音声:使用できる音源。投稿先の音楽機能でINMU KINGを使う場合は、編集時にタイミングを決め、投稿時にその音楽を指定する方法もあります。投稿先での配信状況と利用条件を確認してください。
縦動画なら9:16、横動画なら16:9を先に決めます。制作例として、最初の2秒を顔のアップ、続く8秒をダンス、最後の2秒をポーズにすると、12秒で一つの流れになります。これは秒数の決まりではなく、最初に試すための構成例です。
Viggleでダンスを移す
ViggleのMixは、参考動画の人物の動きを、用意した人物画像に移す機能です。画像だけを入れて「INMU KINGのダンス」と指定する方式とは違い、振り付けの元になる動画を用意します。
- ログイン後、Mixを開きます。
- Add Motionで参考動画をアップロードします。練習ならLibraryの動きも使えますが、INMU KINGの振り付けを合わせたい場合は、その動きを含む素材を選びます。
- Add Imageに全身の人物画像を入れます。別のカットでも同じ画像を使うと、服装や人物の見た目を揃えやすくなります。
- 選択中の素材と利用枠を確認し、MIXで生成します。
- 生成結果で、手を頭の後ろへ回すところ、腕が顔を横切るところ、足先を確認します。使えるカットはダウンロードアイコンから保存します。
最初から曲全体を変換するより、目立つ振り付けを含む一つのカットで試す方が、失敗の原因を確認しやすくなります。顔や体が途中で切れる参考動画は、別の素材へ替えて比較してください。元の背景の見え方まで変わる場合があるため、人物だけでなく背景も確認します。
操作名はViggle公式のMix手順に基づいています。画像の明るさ、正面に近い向き、遮蔽物の少なさについては公式の画像準備ガイドも参考になります。
HeyGenで顔のアップを歌わせる
ダンスの全身カットとは別に、キャラクターがサビを歌う顔のアップを作るなら、HeyGenのPhoto to Videoを使う方法があります。写真に音声を合わせ、口の動きや表情を生成する工程です。
- ホームのPhoto to Video、またはToolsのAll Appsから該当機能を開きます。
- 正面に近い顔の画像をアップロードします。全身ダンス用と同じキャラクターでも、ここでは口が見える画像を選びます。
- 音声ファイルをアップロードします。台詞ならテキスト入力と声の選択もできます。歌に合わせる場合は、歌わせたい部分の使用可能な音声を用意します。
- 必要な設定と消費クレジットを確認してGenerateで生成します。
- 口が開くタイミングを音声と見比べ、完成動画を編集ソフトへ渡します。
HeyGenのAvatar IV公式ガイドでは、Photo to Videoへの画像・音声入力と、歌を音声として使う例が説明されています。全身の振り付けを正確に移す工程はViggle、歌っている顔を見せる工程はHeyGen、と分けると素材を用意しやすくなります。
速い歌詞や伴奏の強い部分が合わない場合は、短いフレーズで試します。無理に全編を口パクにせず、合った箇所だけ顔のアップにし、残りをダンスやポーズのカットでつなぐ編集もできます。これは当サイトの編集上の提案で、生成の成功を保証する設定ではありません。
ElevenLabsで台詞を足す
冒頭に「王の登場です」のような短い台詞を入れたいときは、ElevenLabsのText to Speechを使えます。INMU KINGの曲を用意する機能としてではなく、自作の台詞を音声にする用途で使います。
- Text to Speechを開き、台詞を入力します。最初は一文だけにします。
- 声を選び、日本語の発音や雰囲気を確認します。
- Generate speechで生成し、読み方と間を聞きます。数字や固有名詞が狙いどおり読まれない場合は、読み仮名に直して比較します。
- 生成結果やHistoryのダウンロードからMP3・WAVなどを保存します。
- 口パクさせるならHeyGenの音声入力へ、ナレーションとして流すなら編集ソフトの音声トラックへ入れます。
操作と読み方の注意はElevenLabs公式のText to Speechガイドを参照しています。生成には利用枠を消費するため、長い原稿を入れる前に短い台詞で確認してください。
CapCutで曲と映像を合わせる
ここからはCapCutデスクトップ版でまとめる例です。既に使っている編集ソフトがあれば、同じように映像と音声を別トラックに置いて編集できます。
- 新しいプロジェクトを作り、Importからダンス動画、顔のアップ、音声を読み込みます。
- タイムラインへ映像を置き、その下に曲の音声を置きます。元動画に不要な音が付いている場合は、その動画の音量を下げます。
- サビの始まりなど、合わせる場所を一つ決めます。音声の波形を拡大し、拍が立つ場所へダンスの開始位置を移動します。
- 前後の不要な部分をカットします。口パク動画を使う場合は、生成に使った音声と編集側の音声がずれないよう、同じ開始位置に合わせます。
- 字幕を足すなら、顔や手の動きを隠さない位置に置きます。スマホで小さく表示しても読めるか確認します。
- Exportから書き出します。最初の確認用は1080p・MP4を目安にし、フレームレートは元素材に合わせて選びます。
素材の読み込み・トラックの配置・書き出しはCapCut公式の動画と音声を合わせる手順を参照しています。拍への合わせ方や1080pでの確認は、この制作例での編集方針です。
崩れたときに見直す場所
- 顔が変わる:人物画像を一枚に揃え、顔が隠れる参考動画を避けて短いカットを比較します。
- 手や腕が崩れる:手を頭の後ろへ回す瞬間だけでなく、その前後も確認します。崩れが残るカットは別のポーズや顔のアップへ切り替えます。
- ダンスと曲がずれる:先に開始位置を動かします。位置で合わない場合は映像側の速度を少し調整し、口パクのカットは別に扱います。
- 口パクがずれる:生成へ渡した音声と編集に使った音声が同じか、冒頭の無音を片方だけ削っていないかを確認します。
- 縦動画で手が切れる:書き出し直前だけで切り抜かず、最初の素材選びから縦の画角を意識します。
これらは編集時の確認点です。ツールの設定だけで必ず直せるわけではないので、同じ素材で生成を繰り返す前に、画像・参考動画・編集のどこを変えるか一つに絞って比較します。
書き出す前の確認
人物画像・参考動画・音源は、使ってよい素材を選んでください。実在人物を使う場合は本人の了承を確認し、本人の発言や出演映像と誤解される見せ方を避けます。声は自分の録音や利用できる音声を使い、他人の声の無断複製を前提にしません。投稿時はAI合成であることが分かる説明を添え、投稿先のルールと音源の利用条件も確認します。
動画を保存したら、スマホで一度最後まで再生します。音量の急な変化、字幕の切れ、終わりの黒画面、画像の崩れがないかを見てから投稿します。有料プランの生成枠や出力条件は変わるため、制作を始める日に各サービスの画面で確認してください。
公式手順・関連する記事
上の各工程には、操作を確認した公式資料へのリンクを付けています。確認日は2026年10月11日です。