AI 口型同步
这项 AI 口型同步功能通过 fal 调用 Sync Lipsync 2。上传一段最长 60 秒、包含一张清晰可见说话人脸的视频,以及替换语音(MP3、WAV 或 M4A,最长 60 秒、20 MB);两者时长需相差 0.25 秒以内,系统不会自动循环补齐,且需要你确认拥有人脸、视频与语音的使用权限。计价为每秒视频 12.5 积分,5.04 秒素材为 64 积分(向上取整)。登录后上传素材,服务器测量两份文件后给出五分钟内有效的准确报价,确认后才会扣费。结果是一份新的 MP4,列在“最近任务”(最新 20 条)中;供应商或输出校验失败会自动退款,重新登录后仍可找回。2026 年 9 月 27 日的测试将 5 秒人像与合成语音匹配,口型随语音变化并在尾部静音处闭合,使用前请务必自行检查口型与音频。本工具不得用于未经本人同意的形象冒用。
更新于 2026年9月9日
将视频口型与语音同步
上传视频与语音 → 确认授权 → 核对报价 → 下载 MP4。
检查服务状态…
登录以上传并找回结果Sync Lipsync 2 · 使用单个清晰可见的说话人脸。音视频时长差须在 0.25 秒内,不自动循环。输出需检查口型并试听。
3. 处理结果
处理完成后视频将在此显示;下方账户历史可找回最近任务。
尚无已验证口型同步样例;输出验收前不开放付费。
流程与限制
两份素材,时长需相差 0.25 秒以内
上传最长 60 秒、包含一张清晰可见说话人脸的视频,以及最长 60 秒、20 MB 以内的 MP3、WAV 或 M4A 替换语音。两者时长需相差 0.25 秒以内——系统不会自动循环补齐,请先裁剪好再上传。
每秒 12.5 积分,报价精确到位
计价为每秒视频 12.5 积分,一段 5.04 秒素材为 64 积分(向上取整)。服务器会测量两份文件并显示准确报价,五分钟内有效,确认后才会扣费。
实测证据:口型跟随合成语音变化
2026 年 9 月 27 日的测试将 5 秒人像与合成语音匹配,口型随语音变化,并在尾部静音处闭合。使用前请务必自行检查口型与音频是否同步。
使用方法
- 01
登录后上传含清晰说话人脸的视频与替换语音(MP3、WAV 或 M4A),并确认拥有人脸、视频与语音的使用权限。
- 02
核对准确报价(每秒视频 12.5 积分,五分钟内有效)。若时长相差超过 0.25 秒,请先裁剪匹配后重新上传。
- 03
下载新的 MP4 并检查口型与音频,或稍后从“最近任务”中找回。
提示词灵感
以下是未实测提示词草稿;真实生成样片请查看上方示例和测试记录。
“一段 5 秒、正对镜头的人像片段,嘴部清晰无遮挡。”
“替换语音裁剪到与视频时长相差 0.25 秒以内,且不带背景音乐。”
“稳定、光线充足的近景,而非远景,让嘴部区域足够大以便追踪。”
常见问题
证据、来源与测试范围
本地测试覆盖自有音视频检测、报价、扣费安全与结果保存,供应商响应为注入测试。尚无真实口型或语音质量验收结果,付费保持关闭。
Cicadas.ai 测试记录 · 审核于 2026-09-21
查看样片、测试方法、费用与限制