Fantom
1保持身份一致的動作遷移模型
關於 Fantom 1
Fantom 是一款高保真的身份保持與動作遷移引擎。僅憑一張人臉照片和一段音頻流,它就能生成自然的面部表情與精準的口型同步,演繹出一個真實的人。

零延遲的人物合成
Fantom 完全在潛空間中運作,從而繞開了恐怖谷。它編碼的是面部的運動機制,而非直接操作像素,因此能以 300 毫秒的首字節時間輸出無瑕疵、時間上連貫的視頻流
臨場感的架構
潛空間中的情緒同步
Fantom 把表情與聲音的語氣對應起來。它不只是動嘴唇,更映照出意圖,讓畫面表現與話語的分量相稱。
毫無瑕疵的流暢
由於在潛空間中生成,Fantom 消除了像素噪點。轉場流暢、畫質高清,可直接用於播出。
無需權重文件即可部署
一張肖像即可立即上線。無需定製權重,無需微調,也沒有耗費 GPU 的預處理。

