AIでサルの写真をしゃべらせる方法 — 完全なステップ別チュートリアル

0:00 / 1:17
AIでサルの写真をしゃべらせる方法 — 完全なステップ別チュートリアル
1m 17s|1920 x 1080

サルの写真に短い台本と日本語音声を組み合わせ、撮影や手作業の口パクなしで FreeLipSync のトーキング動画を作れます。 こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。

Transcript

真剣な顔に見えるけど、バナナを隠したのは誰か考えているだけだよ。 サルの写真に短い台本と日本語音声を組み合わせ、撮影や手作業の口パクなしで FreeLipSync のトーキング動画を作れます。 こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。 まず、今回のしゃべるサルのテストで使う正面向きのヒヒ画像を確認します。 同じ画像をアップロードし、バナナの台詞を貼り付け、確認済みの非著名人音声を選びます。 ヒヒ、台本全文、選択した音声、モデルがすべて表示されてから生成を始めます。 正面画像は比較しやすい一方、鮮明な横顔や軽い遮りも試せます。画像を替える前に短い台詞で確認してください。 こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。 毛の境界と鼻口部が安定し、間では口が元の閉じた状態に戻るかを確認します。 真剣な顔に見えるけど、バナナを隠したのは誰か考えているだけだよ。 正面画像は比較しやすい一方、鮮明な横顔や軽い遮りも試せます。画像を替える前に短い台詞で確認してください。 権利または許可のある画像と音声だけを使い、実写と誤認される場合は AI 生成と明記してください。