视频换脸实战指南:素材挑对了,成片就稳了

October 11, 2026
一套跑通的视频换脸流程:怎么挑视频、怎么选脸照、怎么避开常见的跟踪失败,以及发布前该检查什么。

大多数换脸失败,一眼就能看出来。新脸浮在画面上,跟人物对不上;或者比头慢那么一点,人都转过去了,脸还在原地;最常见的则是转头那一瞬间原脸闪回一帧,整段效果当场崩掉。

大部分教程不会提这一点:换脸的结果,在你点“生成”之前基本就定了。整个流程只用两个文件:一段视频、一张人脸照。这两个里只要有一个不合适,模型手上就没有能用的东西。下面这套做法,都是从这些失败里倒推出来的。

你需要准备什么

两个文件:

  • **一段视频。**只支持 MP4。我们的工作台单条最大 200 MB、最长 10 分钟,而且大部分时间里,脸都要在画面里。
  • **一张人脸照。**JPEG 或 PNG。这张脸是要换进视频里去的。

要准备的就这些。不用装软件,不用把素材拖到时间线上,也不用设关键帧。

第一步:挑一段跟得住的视频

引擎会在每一帧里找出最大的那张脸,然后换掉它。这一句话就能解释大部分失败:

  • **画面里只留一个人。**双人镜头里,“最大的那张脸”每一帧都可能不一样,换好的脸就在两个人之间来回跳。单人出镜的素材最稳。
  • **脸要一直露着。**侧过去的半张脸、挡在嘴前的手、垂到眼睛上的头发,凡是脸被盖住的帧,跟踪都只能靠猜。
  • **留意光线。**画面暗、噪点多的素材,模型能读到的信息就少;白天拍的,或者灯开足的室内,都要好办得多。
  • **脸在画面里越大越好。**占画面比例大的人脸能留住细节,远景里的那张小脸,换出来会明显发虚。

动作快不是问题。舞蹈类素材的换脸效果经常好得出乎意料,这类片子里脸通常一直露着,光也不算差。

第二步:挑一张模型读得懂的人脸照

换成谁,最终由人脸照决定,所以喂进去的图越干净越好:

  • **要清晰,正脸对着镜头。**一张简单、光线均匀的正面头像,比一张拍得很讲究的四分之三侧脸更管用。
  • **脸上别挡东西。**眼镜、帽子、厚刘海、伸到嘴前的麦克风,模型都会当成脸的一部分读进去。
  • **角度和光线尽量跟视频对上。**左边打光的照片换进右边打光的视频,跟踪做得再准,出来的脸也会有点别扭。
  • **表情中性没关系。**证件照那种板正的表情,配一段大笑的视频也没问题,不过照片的情绪越贴近原片,融合越干净。

第三步:开始换脸

在 Molyin 上,整件事就是传两个文件、点一次生成。打开视频换脸,加上视频和人脸照,点下去就开始跑。按秒计费:每秒 5 积分,10 秒的片子就是 50 积分。跑完拿到的 MP4 保持你视频原本的分辨率,最高 1080p。

第四步:整段看完再用

别拿开头几秒就下结论。真正要看的是那几个难点:转头、大笑、光线突然变化。盯两件事:

  1. 漂移:新脸比头的动作慢一拍。
  2. 闪回:原脸回来一帧,一般出现在脸被挡得最厉害的地方。

这两个毛病的解法一样:把片子剪到换脸稳得住的那一段。

关于授权这件事

只用你有权使用的脸:你自己的、你团队的,或者事先答应过你的人。没经过同意就把真人的脸放进片子里,不只是不礼貌,在大多数地方这已经算法律问题。

接下来可以做什么

  • 结果有点糊、分辨率偏低?过一遍视频画质提升,导出会清楚不少。
  • 想让新脸开口说话?口型同步能把嘴型重新对上你的音轨。
  • 想搞懂背后的跟踪原理?什么是换脸讲得比较细。
  • 手边没有现成的素材?先用 AI 视频生成器生成一段基础视频,再把脸换进去。

拿自己的素材试一次

整套流程大概十分钟:一段视频、一张人脸照、点一次生成。打开视频换脸,把你看这篇文章时想到的那段片子传上去跑一遍。换到第二、第三次,你挑素材的判断就跟我们差不多了。

视频换脸实战指南:素材挑对了,成片就稳了 | Molyin