Fantom
1保持身份一致的动作迁移模型
关于 Fantom 1
Fantom 是一款高保真的身份保持与动作迁移引擎。仅凭一张人脸照片和一段音频流,它就能生成自然的面部表情与精准的口型同步,演绎出一个真实的人。

零延迟的人物合成
Fantom 完全在潜空间中运作,从而绕开了恐怖谷。它编码的是面部的运动机制,而非直接操作像素,因此能以 300 毫秒的首字节时间输出无瑕疵、时间上连贯的视频流
临场感的架构
潜空间中的情绪同步
Fantom 把表情与声音的语气对应起来。它不只是动嘴唇,更映照出意图,让画面表现与话语的分量相称。
毫无瑕疵的流畅
由于在潜空间中生成,Fantom 消除了像素噪点。转场流畅、画质高清,可直接用于播出。
无需权重文件即可部署
一张肖像即可立即上线。无需定制权重,无需微调,也没有耗费 GPU 的预处理。

