Fantom

1

保持身份一致的动作迁移模型

关于 Fantom 1

Fantom 是一款高保真的身份保持与动作迁移引擎。仅凭一张人脸照片和一段音频流,它就能生成自然的面部表情与精准的口型同步,演绎出一个真实的人。

关于 Fantom,移动端视图

零延迟的人物合成

Fantom 完全在潜空间中运作,从而绕开了恐怖谷。它编码的是面部的运动机制,而非直接操作像素,因此能以 300 毫秒的首字节时间输出无瑕疵、时间上连贯的视频流

临场感的架构

潜空间中的情绪同步

潜空间中的情绪同步

Fantom 把表情与声音的语气对应起来。它不只是动嘴唇,更映照出意图,让画面表现与话语的分量相称。

毫无瑕疵的流畅

毫无瑕疵的流畅

由于在潜空间中生成,Fantom 消除了像素噪点。转场流畅、画质高清,可直接用于播出。

无需权重文件即可部署

无需权重文件即可部署

一张肖像即可立即上线。无需定制权重,无需微调,也没有耗费 GPU 的预处理。

驱动下一波
内容浪潮