25個のAIリップシンクプロンプト:話したり歌ったりするアニメキャラクター
良いリップシンクとは、単に「音声に合わせた口の動き」だけではありません。視聴者は、顎の動きが音素に合っているか、間の中に呼吸が含まれているか、感情が目に伝わっているか、そして頭が安定しているかに注目します。歌う場合は、持続する母音、ピッチに基づく表現力、そして音楽のリズムが加わります。
この25のプロンプトは、ツールに依存しないブリーフィングの作成です。選択したアニメーションや動画モデルに応じて構文を調整してください。すべてのシステムが同じ方法でオーディオ、タイムスタンプ、顔参照、またはネガティブ制約を受け入れるわけではありません。
安定したキャラクターと固定された線から始めましょう。Elser AI は、クリエイターが1つのワークフローでアニメキャラクター、脚本、シーンを開発するのを支援します。エピソード全体を制作する前に、まず登録してクローズアップショットをテストしてください。
生成前準備:4つの入力
背景音楽のないクリアな会話、最終台詞、高解像度の顔の参考、そして短い演技の説明を使用。意図的に無音部分をカットするが、キャラクターの自然な呼吸を残すこと。
顔を評価に十分な大きさでフレームに収めてください。ロングショットよりもスリークォータービューの方が構造上のエラーを明らかにしやすく、完璧な正面顔は不自然に硬く見えることがあります。初回テストでは、髪や手が口を覆わないようにしてください。
会話ロールプロンプト
1. 中立的会話
このキャラクターに提供されたセリフを自然に読ませてください。正確な音素タイミング、わずかなあごの動き、穏やかなまばたき、リラックスした眉、2文目の前にひと呼吸。顔の形、髪型、服装、カメラ位置は変えずに。
2. 怒りを抑える
怒りを抑えた口の動かし方:子音は短く、顎を引き締め、頭の動きは最小限に、目を細める。口を大きく開けたり叫んだりしないこと。身分と光は変えない。
3. 興奮した発見
完全に声を合わせる。まず驚いて息を吸い、目を見開き、その後、速く表情豊かな発音で少し前傾する。最後の文で落ち着くこと。余計な言葉や気軽な笑みは不要。
4. のんびり朝のライン
口をわずかに開け、まばたきを遅らせ、セリフの前に軽くあくびのような呼吸をし、肩をリラックスさせることで、ゆっくりとした眠そうな話し方を作り出します。明瞭さを保ち、頬を歪めたり年齢を変えたりしないでください。
5. 秘密の囁き
ささやき声に近い音量でこの台詞を演じる:顎の動きを減らし、唇の発音に注意し、息を優しくし、視線を短く画面外に向ける。口の形の幅を低音量に合わせ、元の画面構図を保つ。
6. 涙の対話
キャラクターは泣くのを必死にこらえながら、一言一言を同期させる。フレーズの間だけ下唇が微かに震え、呼吸が浅く速くなり、目尻が潤み、声と同期した一度の嚥下。持続的な震えや表情の崩れはない。
7. 自信に満ちたスピーチ
落ち着いた自信に満ちた口調でこの会話を話す:明確な子音、安定したアイコンタクト、重要なフレーズの後に控えめな半笑いを浮かべ、最後の言葉で軽くうなずく。不必要な体の揺れを避ける。
8. クイックコメディ
正確な音節で口パクを同期させ、テンポの良いコメディの会話を表現する。笑いどころでは素早く2回まばたきし、反応的に眉を1回上げる。頭部は読み取りやすく保ち、過剰な口パクのループや無関係なジェスチャーは避ける。
9. 無線通話
キャラクターがハンドヘルドトランシーバーに向かって話している。提供された音声に合わせ、文の区切りで危険な方向をちらりと見ながら、口の動きをはっきりと保ち、トランシーバーを唇に近づける——ただし隠さないように。
10. 個人情報ダイアログ
横向きのキャラクターが自然に話すようにする。鼻、顎、唇の輪郭を維持し、控えめな顎の回転と目に見える頬の動きを使う。頭をカメラのほうに向けない。
複数話者とパフォーマンスプロンプト
11. 二人の交換
話者Aが最初の一文のリップシンクを行い、話者Bは口を閉じて聞き、微かな反応を示します。音声の切り替え時に、Bが話し始め、Aは静止したままです。音声が重ならない限り、決して同時に二人のリップシンクアニメーションを行わないでください。
12. 意図的な中断
音声の重なりに厳密に従ってください:Aが話し始め、Bが[タイムコード]の時点で遮ります。各キャラクターに独自の口の動きと視線の方向を割り当ててください。舞台の演出を維持し、アイデンティティの混乱を防いでください。
13. 肩の後ろの返信
前景の聴衆は基本的に静止しており、焦点が合っていない状態を保つ。背景の話者は、はっきりと識別できる顎と眉で台詞の口の動きを同期させる。レンズの焦点、構図、衣装、キャラクターの比率を固定に保つ。
14. グループ反応
中心のキャラクターのみが話す。他のキャラクターは口を閉じたまま、タイミングよく視線や姿勢で反応し、話す動作は行わない。各表情を維持し、話し手の表情を移さないようにする。
15. 歩きながらの会話
キャラクターが安定した歩調で歩行している際に会話を同期させます。顔の特徴を安定させ、呼吸を歩調と調和させ、頭部の揺れを最小限に抑えます。動きが口の動きの同期を妨げないようにします。
歌唱キャラクタープロンプト
16. 優しいバラード
人声トラックを抑制の効いたバラードスタイルでリップシンクさせる。長音では母音の口形を保ち、子音の閉鎖を弱め、フレーズ記号の箇所で息継ぎをし、視線で感情を伝え、下顎を過度に開かないようにする。
17. 活気あふれるポップ合唱
サビの部分で各歌詞とビートを合わせる。明確なリズム発音、音響的に合理的な場所で自信に満ちた笑顔を保ち、2つの計画された頭部アクセント、安定した表情。繰り返される一般的な口の開閉動作を避ける。
18. 持続高音
可視の呼吸準備から、徐々に下顎を開いて持続母音に入り、安定した口形を保ち、制御可能な顔の力を加え、解放時には自然に閉じる。唇の震えや顔の急な変化を避ける。
19. 高速ラップパート
コンパクトな発音で速い音節を正確に追跡します。誇張した表現よりもタイミングを優先し、顎の動きを最小限に抑え、出現時のみ短い呼吸を加え、歯と唇の解剖学的構造を保持します。
20. デュエット
歌手Aが最初のフレーズを歌う;歌手Bが応答する;二人はマークされたハーモニーパートのみを歌う。それぞれの顔の特徴と独立した呼吸のリズムを保つ。共有ボーカルパート以外では、二人の口の動きを同期させない。
21. 感情の終章合唱
フレーズ全体を通して表現を構築する:コントロールされたオープニング、中間部でのより強いアイコンタクト、クライマックスでの豊かで持続的な母音、そして疲れた解放。全体を通して衣装、照明、カメラを変えない。
高難度シュートのヒント
22. 極端なクローズアップ
正確なクローズアップリップシンク、自然に見える歯、安定した唇のエッジ、微妙な頬とあごの変形、そして正確な閉じ。肌の質感と線画を保持;口と鼻の周りにちらつきなし。
23. スタイル化されたQ版顔
リップシンクを簡略化したQ版プロポーションに適応させる:3~5のクリアな口の形、正確なタイミング、わずかな顎の動き、表情豊かな目。グラフィックの線の質を維持し、写実的な歯や唇を導入しないこと。
24. 風と髪の毛の揺れ
風が髪や衣服を揺らすのに合わせて、会話の口の動きを同期させる。顔を安定したアンカーとして使用し、唇が隠れないようにし、頭部の動きを制限し、二次的なアニメーションは発話時間とは独立させる。
25. 既存アニメへの声優アフレコ
提供された代替の会話に口の位置を再調整し、元の頭部、目、カメラ、身体のアニメーションを保持します。必要な下半顔の動作のみを変更し、間を維持し、カメラの長さを変更しないようにします。
リップシンク失敗の原因と具体的な修正方法
オーディオはまだプロダクション対応状態に達していません
ノイズ、強い残響、音楽、または重なった人の声が音素を隠してしまいます。クリーンな人の声のドライ音声を使用してください。もし演奏が合成されたものであれば、先に最終的な韻律リズムを生成してください。バイトダンスのSeed Audio 1.0ドキュメントでは、プロンプトレベルの対話タイミングが強調されていますが、生成された出力は依然として人間による試聴と著作権審査が必要です。
このプロンプトはパフォーマンスと再設計を組み合わせています
一度に新しい服、新しいカメラ、劇的な照明、リップシンクを要求すると、失敗のリスクが広がります。まずキャラクターとカメラアングルを固定しましょう。Elser AI はキャラクターとストーリーボードの確立を支援し、リップシンクの工程では一つのタスクに集中できるようにします。
口は動いているが、顔に表情がない
言語は顎、頬、呼吸、目、姿勢に影響を与えます。正確なタイミングで1つか2つの感情的なヒントを加えてください。ヒントが多すぎると動作が不安定になります。
このモデルは無声キャラクターにアニメーションを付与します
誰が話しているか、交代がいつ発生するか、聴衆が何をするかを説明する。重複部分についてはタイムコードを提供する。モデルが顔を確実に分離できない場合は、話者を個別に提示する。
歌う時に話す時の口の形を使う
歌うと母音が伸び、多くの子音が圧縮されます。呼吸と持続音をマークしてください。まず通常速度で同期を確認し、その後問題のあるフレームをチェックします。フレームごとに見ると、無害な違いを過度に強調する可能性があります。
五輪品質監査
- タイミングの把握: 口元と波形の対応のみを観察する。
- 認証: 顔の形、目、生え際、年齢を参照画像と照合します。
- パフォーマンス合格: キーワードで感情の変化を確認する。
- アーティファクトの通過: 歯、唇の縁、あご、および隠れた髪を確認します。
- context pass: スマートフォンのスピーカーとイヤホンで完全なシーンを視聴します。
無許可でパフォーマーの模倣作品を公開してはなりません。元の音声とキャラクターの肖像の同意を得て、関連する許可を記録し、必要に応じて合成メディアコンテンツを開示する必要があります。
信頼できるプロセスは、リップシンクの段階より前から始まります。Elser AI でキャラクターとシーンを作成し、ロックされたビジュアルをエクスポートしてから、最も短く、最も感情を表現する台詞をテストします。
よくある質問
AIリップシンクに最適なカメラアングルとは?
正面または斜め45度のクローズアップが最も評価しやすいです。横顔や遠くの顔も可能ですが、それらは視認性が低く、ピクセル数も少なくなります。
会話テキストと音声の両方を含めるべきですか?
ツールが両方を受け入れる場合、テキストは単語と話者の順番を明確にできます。製品ドキュメントに別途記載がない限り、音声は時間基準を維持する必要があります。
2つのキャラクターで口の動きを同期させるには?
話者をマークし、引き継ぎタイムコードを指定し、聞き手に口を閉じたままにするよう指示します。処理が難しい重複部分については、個別のチャンネルを作成して合成します。
AIは歌う際の口の動きを正確に同期できるか?
有用な結果を生み出せますが、持続母音、速い歌詞、ハーモニー、表現力豊かな動作はより処理が困難です。クリーンなドライボーカル、歌詞のタイムライン、手動レビューを使用してください。
顔の一貫性を保つには?
強参照を使用し、リップシンクを唯一の主要な変化とし、ショットを短く保ち、顔の構造、髪型、カメラ、照明を明確に保持する。
結論
最も効果的なリップシンクプロンプトは、タイミング、パフォーマンス、保持、除外を制御します。クリアな音声と安定したクローズアップから始め、重要なパフォーマンスプロンプトのみを追加し、無音プレビューに頼らずにシーン全体を確認します。
あなたが口頭テストをアニメーションシーケンスに変換する準備ができたら、Elser AIに登録し、脚本と絵コンテの同じキャラクターを最終シーンのワークフローに取り入れてください。




