チュートリアル

AIでサルの写真をしゃべらせる方法

FreeLipSync TeamFreeLipSync Team|7 min read
まず、今回のしゃべるサルのテストで使う正面向きのヒヒ画像を確認します。

完全版動画チュートリアル

AIでサルの写真をしゃべらせる方法 — 完全なステップ別チュートリアル

サルの写真に短い台本と日本語音声を組み合わせ、撮影や手作業の口パクなしで FreeLipSync のトーキング動画を作れます。 こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。

0:00 / 1:17
AIでサルの写真をしゃべらせる方法 — 完全なステップ別チュートリアル

サルの写真に短い台本と日本語音声を組み合わせ、撮影や手作業の口パクなしで FreeLipSync のトーキング動画を作れます。 こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。

用意するもの

  • 元画像: まず、今回のしゃべるサルのテストで使う正面向きのヒヒ画像を確認します。
  • 実際の台本: 真剣な顔に見えるけど、バナナを隠したのは誰か考えているだけだよ。
  • 使用ツール: talking-pet

所有権または利用許可のある素材だけを使ってください。このチュートリアルの被写体は例示用に生成した架空のものです。

実際の元画像・台本・音声

まず、今回のしゃべるサルのテストで使う正面向きのヒヒ画像を確認します。

真剣な顔に見えるけど、バナナを隠したのは誰か考えているだけだよ。

トーキングフォト処理に送った生成音声

トーキングフォト処理に送った生成音声: 10代男性、元気な少年 (ja).

無編集の生成結果

こちらが生成音声をそのまま使った完全な無編集結果です。鼻口部、目、同一性、タイミングを元画像と比べます。

無編集結果の専用ページを開く

手順

ヒヒ、台本全文、選択した音声、モデルがすべて表示されてから生成を始めます。
  1. 元画像を準備 — 毛の境界と鼻口部が安定し、間では口が元の閉じた状態に戻るかを確認します。
  2. 専用ツールを開く — 下の FreeLipSync 専用ページを開き、テキスト入力を選びます。
  3. 台本と音声を設定 — 同じ画像をアップロードし、バナナの台詞を貼り付け、確認済みの非著名人音声を選びます。
  4. 短いテストを生成 — ヒヒ、台本全文、選択した音声、モデルがすべて表示されてから生成を始めます。
  5. 確認して明記 — 権利または許可のある画像と音声だけを使い、実写と誤認される場合は AI 生成と明記してください。

この用途の品質チェック

毛の境界と鼻口部が安定し、間では口が元の閉じた状態に戻るかを確認します。

正面画像は比較しやすい一方、鮮明な横顔や軽い遮りも試せます。画像を替える前に短い台詞で確認してください。

トラブルシューティング

  • 使える場合があります。短いテストで奥側の目、鼻口部の輪郭、同一性を確認してください。
  • 軽く固定された遮りなら可能ですが、口が完全に隠れる画像や動く遮蔽物は難しくなります。
  • 話者が明確になるよう一体ずつ切り抜くか、別々のクリップにするのがおすすめです。

よくある質問

どの種類のサルでも動かせますか?

はい。ヒヒ、ニホンザル、オマキザルなど、種類よりも鮮明さと単独の被写体が重要です。

横顔のサル写真でも使えますか?

使える場合があります。短いテストで奥側の目、鼻口部の輪郭、同一性を確認してください。

葉や檻の柵で顔が隠れていても大丈夫ですか?

軽く固定された遮りなら可能ですが、口が完全に隠れる画像や動く遮蔽物は難しくなります。

複数のサルを同時にしゃべらせられますか?

話者が明確になるよう一体ずつ切り抜くか、別々のクリップにするのがおすすめです。

無料で試せますか?

はい。無料生成は最大20秒で透かしがなく、画像と音声の相性を確認できます。

自分のバージョンを作る

同じ画像をアップロードし、バナナの台詞を貼り付け、確認済みの非著名人音声を選びます。 ヒヒ、台本全文、選択した音声、モデルがすべて表示されてから生成を始めます。

FreeLipSync の専用ツールを開く

Related