跳到正文
原文
r/StableDiffusion· /u/NewPhoneWhotiz·· 2 小时前AI 评分22

用九个失败案例压力测试口型同步模型

I'm stress testing lip sync models with nine failure cases.

AI 导读

有用户正在搭建一套口型同步/视频工作流的失败案例基准,涵盖手遮嘴、侧脸、远景小脸、胡须、大笑、说话时转头、多说话人、语速快、词中硬切九类场景。测试同时覆盖本地开源与托管工作流,用同一段源视频加音频跑通所有工具,并附模型版本、设置和源素材以便复现。

来源:r/StableDiffusion · reddit.com