給 ClipNova 一張臉和要說的話:你自己的錄音,或一段輸入的腳本。它會讓這張臉動起來,嘴唇、頭部和表情都跟著語音走。影片已經拍好了?把它對嘴成另一種語言。
前三步在 AI 會說話的虛擬人物工具中完成,第四步在 AI影片翻譯中完成。下面跟著同一位主講人,從一張靜態照片到一支對好嘴型的影片。
從素材庫中選擇虛擬人物,根據描述生成新的肖像,或上傳你自己的照片。正臉、清晰、光線充足的人臉,嘴部動作最自然。
上傳一段語音,這張臉就會用你的聲音一字不差地說出來。也可以輸入腳本,選一個 ClipNova 聲音來朗讀。你還可以把人物放到新背景中,並選擇 16:9、9:16 或 1:1 畫面比例。
Kling AI Avatar v2(Base 和 Pro)或 OmniHuman(Ultra)依音訊驅動照片:嘴型對上每個音,頭部和臉部像真人說話一樣自然活動。較長的語音會被拆成多個對好嘴型的片段,再接成一支影片。
把 2 到 60 秒的說話影片上傳到 AI影片翻譯。它會用說話者自己的聲音配音成 18 種語言之一,再由 lipsync-2 在你的原始畫面上重繪嘴部,讓嘴型與新台詞吻合。
只動下巴的對嘴,一秒鐘就會露餡。人會讀臉:發 M 或 O 時的唇形,句尾的一個點頭,始終注視著觀眾的眼睛。ClipNova 使用會說話的虛擬人物模型,依音訊驅動整張臉,而不只是嘴巴。
台詞怎麼來由你決定。語氣表達很重要時,就上傳自己的錄音;或者輸入腳本,讓 ClipNova 的聲音來唸。無論哪種方式,節奏都來自音訊,嘴唇能對上每一個音節。
對於現有的素材,AI影片翻譯反過來運作:保留你的畫面,用說話者自己的聲音把語音配成另一種語言,再重新對齊嘴型。不必重拍,影片看起來依然是你的影片。
把產品腳本變成 9:16 直式、對著鏡頭講解的主講人影片,直接發 Reels 和 TikTok。
不用自己入鏡,也能為旁白配上一位固定的出鏡主持人。
把說明中心文稿和新手引導步驟變成簡短的口說影片。
把現有的說話影片重新對嘴到保留說話者聲音的翻譯配音上。
AI對嘴是讓人臉的嘴部動作與一段語音相符。在 ClipNova 中,你可以讓一張照片動起來說出你的音訊或腳本,也可以把說話影片重新對嘴到所說內容的譯文上。
可以。在 AI 會說話的虛擬人物工具中選擇或上傳一張臉,然後上傳你的語音片段,而不是輸入腳本。影片會逐字跟著你的錄音。
可以,對嘴成另一種語言。AI影片翻譯會用說話者自己的聲音,把 2 到 60 秒的說話影片配音成 18 種語言之一,再讓原始畫面中的嘴型對上新台詞。
虛擬人物說話影片在 Base 和 Pro 等級使用 Kling AI Avatar v2,在 Ultra 等級使用 OmniHuman。影片翻譯先用 ElevenLabs 配音,再用 lipsync-2 模型對嘴。
畫面中只有一個人,臉部可見並朝向鏡頭,光線均勻、畫面清晰。沒有背景音樂疊加的乾淨語音,嘴型最準確。
虛擬人物說話影片可以做成 16:9、9:16 或 1:1,也可以沿用照片本身的比例。翻譯後的影片保留你上傳片段的格式。
對嘴影片包含在所有付費方案中,每月 $19 起,每個方案都附帶完整的商業使用權。每支影片的費用會在生成前以點數顯示。