免费工具

文字控制动作与镜头的 AI 对口型

上传一张照片,用音频或文字驱动口型。描述人物动作与镜头运动,让人物边说边动,最长 30 秒。

  • 免费
  • 无需注册
  • 无水印
请上传图片或选择一个图片示例。
由 FreeLipSync 自研引擎驱动
文字控制动作与镜头的 AI 对口型

动作与镜头控制示例

人物边说边摘下眼镜,镜头缓慢推近。配音:ALLE。

素材

人物照片
动作: 她慢慢摘下眼镜,露出面容。 镜头: 镜头缓慢而轻柔地推近她的脸部,最后停在面部特写。 配音: ALLE (英语 · 女性 · 青年 · 活力)

ALLE 声音试听(非案例台词)

生成结果

边说边摘下眼镜

什么是动作控制对口型?

动作控制对口型把照片、语音和文字动作描述组合成视频。你可以分别描述人物动作与镜头运动,并用上传的音频或文字配音驱动口型。本工具使用 Super,单次最长 30 秒;动作来自文字描述,无需参考动作视频。

文字控制动作

输入动作描述,让人物说话时自然运动。

独立镜头描述

描述推近、拉远或构图变化。

音频或文字

使用录音或 AI 配音,最长 30 秒 / 150 个有效字符。

如何制作边说边动的视频

  1. 1

    上传人物照片

    选择单人、面部与嘴部清晰可见的照片。

  2. 2

    添加语音和提示词

    上传音频或输入配音文本,分别填写动作与镜头描述。

  3. 3

    生成并检查

    检查口型、动作与人物一致性,再下载视频。

适合哪些场景

人物短片

让人物在说话时摘眼镜、转头或做轻微手势。

讲解与演示

用手势和缓慢推镜头强化讲解内容。

输入限制

  • Super 最长支持 30 秒音频或 150 个有效文本字符,使用多镜头工具相同的字符计算方式。语速和停顿会影响实际时长。
  • 音频超限时可确认裁剪;文本超限需先缩短。复杂动作或遮挡嘴部可能影响口型,请检查生成结果。

常见问题

更多免费 AI 口型同步工具

所有 FreeLipSync 工具使用同一引擎,按你的素材类型选择合适的工作流。

对比 Free、Starter 和 Pro 套餐