漫画のキャラクターに話させたり歌わせたりするには、オリジナルの正面を向いたキャラクターの画像から始めて、テキストまたは音声から話すバージョンを生成してから、同じ画像を Make Photo Sing のクリーンなソング クリップとともに再利用します。 以下の 2 つの生の結果は、オーディオのみを変更した場合の影響を分離しています。
必要なもの
- ソース画像: ソースは、映画、ゲーム、フランチャイズのキャラクターではなく、このチュートリアル用に作成されたオリジナルのレッサー パンダ キャラクターです。 目と口がはっきりと分かれており、銃口のコントラストが十分で、頭のフレームが大きいです。
- この例で使用される入力音声: 会話入力は短い合成セリフです。 歌の入力は、クリアなボーカルと安定したリズムを持つ 18 秒のオリジナルのショップ ジングルです。 1 つの画像を再利用すると比較が便利になります。パフォーマンスが変化しても、アイデンティティ、トリミング、背景は固定されたままになります。
- 道具: Make Photo Sing
アニメーション化が許可されているオリジナルのキャラクターまたはアートワークを使用してください。 著作権で保護された有名なキャラクターが製品、メッセージ、または曲を推奨していると暗示することは避けてください。
ソース画像と入力
この例で使用される入力音声 1
共有デモ メディアで使用されている正確な英語のトランスクリプトまたは歌詞:
I started as one drawing.
Now I can talk, tell a story, and welcome viewers without filming a single frame.
The same character can even sing when you switch the audio.
この例で使用される入力音声 2
共有デモ メディアで使用されている正確な英語のトランスクリプトまたは歌詞:
Welcome to our shop today, step right in and stay a while.
Something special's on the way, handpicked just to make you smile.
Come on in, come on in, your new favorite starts right here!
生の結果
両方の結果を再生します。 1 つ目は通常の音声を示しています。 2 つ目は、メロディーと持続音節に続く同じ絵を示しています。 どちらのクリップも完全なチュートリアル ビデオではありません。ここでの価値は、未編集の製品証拠を見ることです。
段階的なワークフロー
- クリアなソース画像を 1 つ用意する — 口が見える正面向きの画像を 1 枚使用し、照明が均一で、手やマイク、唇を覆う大きな影がないようにします。
- 一致する FreeLipSync ツールを開く — このワークフローのリンクされたツールを開きます。 入力モードがソース (テキスト、アップロードされた音声、または歌のオーディオ) と一致していることを確認します。
- スクリプトまたはオーディオ入力を追加する — 短いクリーンな入力を追加します。 画像と音声が適切に一致しているかどうかを簡単に判断できるように、最初のテストは単純にしてください。
- リップシンク結果を生成する — 複数の変数を一度に変更せずに、1 つの生の結果を生成します。 制御された最初のパスにより、トラブルシューティングがはるかに迅速になります。
- 公開する前に完全な結果を確認する — 最初から最後まで音声付きでご覧ください。 口の見え方、タイミング、発音、そしてクリップがソースを忠実に表現しているかどうかをチェックします。
この設定が機能する理由
様式化されたキャラクターは、顔のデザインがモデルに読み取り可能なランドマークを提供している場合に機能します。 フォトリアリズムよりも、大きな口の領域、安定した正面図、シンプルな背景が重要です。
品質チェックリスト
- 複雑な銃口の中に隠された小さな線ではなく、目に見える口の形を持つキャラクターを選択してください。
- 孤立したわかりやすいボーカルを使用します。 強い影響や混雑した器具は診断を困難にします。
- 最初の曲のクリップは短くし、ボーカルの入り口が明確なセクションを選択してください。
避けるべきよくある間違い
- アニメーション化が許可されているオリジナルのキャラクターまたはアートワークを使用してください。 著作権で保護された有名なキャラクターが製品、メッセージ、または曲を推奨していると暗示することは避けてください。
- 長い脚本や歌から始めないでください。 短いファーストパスにより、より高速で有用な品質の信号が得られます。
- 必要な許可またはライセンスがない限り、顔、キャラクター、録音、または歌を公開しないでください。
人々が尋ねる質問
AI リップシンクは漫画でも機能しますか?
はい、顔が正面を向いていて、口、目、頭の輪郭が視覚的にはっきりとしている場合は可能です。 抽象度の高いデザインや横向きのデザインは、予測可能性が低くなります。
話すときと歌うときに別々のキャラクター画像が必要ですか?
いいえ。1 つの画像を再利用することは、スピーチと歌を比較するのに便利な方法であり、キャラクターのアイデンティティの一貫性を保つことができます。
有名な漫画のキャラクターをアニメーション化できますか?
必要な権利がある場合のみ。 商業出版の場合は、オリジナルのキャラクターまたは適切にライセンスを取得したキャラクターを選択する方が安全です。
独自のバージョンを作成する
まずトーキングワークフローを試してから、Make Photo Sing で受け入れられた画像を短いオリジナルソングクリップとともに再利用します。

