角色一致性 AI 视频生成器

参考图生成视频 AI,让你的角色在每个场景里都保持一致。上传角色照片,描述下一个场景,就能得到同一张脸、同样发型和同一身衣服的新片段。

适用于
制作你的第一个视频
深受创作者信赖
遍布全球
Picture of Consistent Character AI Video Generator — beforeYour character
Picture of Consistent Character AI Video Generator — afterNew scene
为任何领域生成视频
43.7k views▸
302k views▸
128k views▸
86.2k views▸
1.4M views▸
212k views▸
57.9k views▸
148k views▸
391k views▸
43.7k views▸
302k views▸
128k views▸
86.2k views▸
1.4M views▸
212k views▸
57.9k views▸
148k views▸
391k views▸
43.7k views▸
302k views▸
128k views▸
86.2k views▸
1.4M views▸
212k views▸
57.9k views▸
148k views▸
391k views▸
43.7k views▸
302k views▸
128k views▸
86.2k views▸
1.4M views▸
212k views▸
57.9k views▸
148k views▸
391k views▸
实例

让同一个角色贯穿每个场景。

一张诺拉的参考照片,她是一部短剧里虚构的夜间快递员,再加上四个新场景。只改了提示词:她的脸、辫子、眉间的疤和黄色夹克都没变。

Picture of 角色一致性 AI 视频生成器 — 诺拉,只上传一次
参考图

诺拉,只上传一次

在素色墙前拍的清晰半身照。这是 AI 拿到的唯一一张她的照片。

Picture of 角色一致性 AI 视频生成器 — 清晨的厨房
场景 1

清晨的厨房

提示词: 黎明时分,诺拉端着冒热气的杯子站在厨房窗边,俯视街道,柔和清冷的晨光。

Picture of 角色一致性 AI 视频生成器 — 雨夜骑行
场景 2

雨夜骑行

提示词: 雨夜,诺拉骑着载有快递箱的自行车穿过街道,镜头在车把高度跟在她身旁。

Picture of 角色一致性 AI 视频生成器 — 送达
场景 3

送达

提示词: 诺拉在一位年长邻居的门口递上一个小包裹,走廊里暖色的灯光,两人都在微笑。

Picture of 角色一致性 AI 视频生成器 — 屋顶日出
场景 4

屋顶日出

提示词: 日出时诺拉坐在城市屋顶上吃三明治,疲惫但开心,身后是金色薄雾中的天际线。

图片是每个场景的剧照。用同一张参考图生成每个场景,再配上配音、音乐和字幕,拼成一集。

如何用你的角色制作 AI 视频

— 01 —

上传你的角色

添加 1 到 9 张同一角色的清晰照片:肖像、全身照、其他角度。还没有角色?先在 ClipNova 的 AI Characters 里创建一个,再到这里使用。

— 02 —

描述新场景

写下发生什么、在哪里发生、镜头怎么移动。描述动作和地点,不用描述脸:外貌已经由参考图决定。

— 03 —

选择画幅、时长和画质

选择 9:16、16:9 或 1:1,片段时长,以及 Base、Pro 或 Ultra。生成前会显示所需积分。

— 04 —

生成并重复使用

加上配音、音乐和字幕后下载。下一个场景或下一集继续用同一组参考照片,角色就会保持不变。

你的角色,出现在你能想到的任何场景。

描述场景

我的角色在雨夜的街道上骑车,镜头在她身旁跟拍,湿漉漉的路面映着霓虹灯,她的脸、辫子和黄色夹克与参考图完全一致...拖入 1 到 9 张角色照片 (JPG, PNG):肖像、全身照或其他角度

Choose media type

Choose what media will be used to illustrate the video.

6 credits/sec日常使用 · 720p · 最多 7 张参考图

Voice, music & captions

Optional. Leave everything off for a silent clip.

Narrate the story
We write the voiceover from your idea.
Background music
Upload a track. It's lowered automatically under the voice.
Captions
Burned in, words light up with the voice.
Estimated cost48 credits?
▸ preview9:16 · 1080p
00:00 / 00:45▸
参考图生成视频 AI

角色一致性 AI 视频如何运作

普通的文本生成视频模型每次生成都会造出一个新的人。让它两次生成同一个穿黄色夹克的女人,你会得到两个不同的女人。这就是大多数 AI 系列在第一个片段之后就崩掉的原因。

角色一致性 AI 从图片而不是文字出发来解决这个问题。在 ClipNova 的图片生成视频模式里上传角色照片,每张照片都在告诉模型这个人长什么样。顺序不重要,它们也不是关键帧:它们是视频必须保留的身份。

接下来你只需描述新的部分:动作、地点、光线和镜头。ClipNova 会生成一个有你角色的新片段。下一个场景或下一集继续用同一组参考照片,脸、发型和衣服都会延续。需要更长的视频时,ClipNova 会按镜头逐个规划,每个镜头都用上你的照片。

关键参数

参考图
每个视频 1 到 9 张,取决于画质档位
画幅
9:16、16:9 和 1:1
片段时长
4、6 或 8 秒 (Base、Ultra),5 或 10 秒 (Pro)
长视频
最长 5 分钟,按镜头逐个规划
声音
配音、音乐和字幕;Ultra 带原生同步音效
训练
不需要,无需 LoRA 或自定义模型
价格
方案每月 $19 起
使用场景

大家用一致的角色做什么

根据 ClipNova 用户的创作和创作者在网上分享的内容,最常见的六种用法。

系列

短剧剧集

竖屏短剧或故事频道的每一集都用同一个主角,观众能在场景之间一直跟着同一个人。

儿童

儿童故事主角

每个睡前故事或学习视频都是同一个小主角,可以是 3D 卡通、Pixar 风格或动漫风格。

品牌

固定的品牌吉祥物

你的吉祥物开店、庆祝促销、挥手道别,在每条广告和帖子里都一模一样。

创作者

AI 网红人设

每天发布你的 AI 人设在市场、健身房或旅途中的视频,每个视频都是同一张脸。

广告

同一个模特展示你的产品

把角色和产品一起上传,在厨房、健身房或街头展示,做成 UGC 风格广告。

不露脸频道

旁白或主持人角色

给不露脸频道一个固定主持人,在每期冷知识、历史或恐怖节目开场。

画质档位

选择适合这个场景的档位

每个档位都能保持角色一致,区别在于参考图数量、片段时长和声音。

BaseProUltra
参考图1 到 7 张2 到 4 张1 到 9 张
片段时长4、6 或 8 秒5 或 10 秒4、6 或 8 秒
优势价格最低,参考图最多主体更清晰,把参考图合成到一个场景画质最佳
原生音频无无有,与片段同步
每段积分80130 (5 秒) 或 250 (10 秒)480 到 950

生成前会显示准确费用。配音、音乐和字幕在每个档位都能用。方案每月 $19 起。

技巧

让角色始终如一

  1. 从清晰的参考图开始

    脸部清楚、背景简单、光线充足的清晰照片,效果最稳定。

  2. 加角度,不加新造型

    额外的照片应展示同一角色的其他角度或全身,穿着同一套衣服。

  3. 描述场景,不描述脸

    写动作、地点、光线和镜头。用文字重复外貌,可能会让模型偏离照片。

  4. 每个角色一组参考图

    保存用过的照片,每个场景和每一集都用完全相同的一组。

  5. 两个主体?用 Pro

    Pro 能把多张参考图合成到一个场景,适合两个角色或拿着你产品的角色。

  6. 还没有角色?

    在 ClipNova 的 AI Characters 里创建一个,选写实或 Pixar 等风格,再上传到这里。

你将获得

足以撑起一整部系列的一致性。

图片生成视频模式能给你的,是只靠提示词永远做不到的。

同一张脸

可以直接发布的一致性

参考照片里的脸、发型和衣服会带进每个新场景。不用再反复生成十次,只为碰巧像一次。

1 到 9

照片变成视频

上传最多九张角色照片,ClipNova 就能做成视频。无需训练,无需 LoRA,无需设置。

5 分钟

完整剧集,不只是片段

需要更长的视频时,ClipNova 会按镜头逐个规划,每个镜头都用上你的参考照片,最长 5 分钟。

不确定是不是这一款?

告诉我们你想做什么,我们会为你推荐最适合你创意的 ClipNova 工具。

找到适合你的工具
对比

角色一致性 AI vs 纯提示词视频

文字提示词每点一次就会造出一个新的人。参考图生成视频从你认可的照片出发,让这个人出现在每个场景。

对比项
角色一致性 AI
纯提示词生成
输入
角色照片加场景描述
只有文字提示词,没有任何东西锁定外貌
脸和服装
每个场景都是同样的脸、发型、服装和比例
角色在不同片段和重试之间不断变化
系列和剧集
每一集都用同一组参考照片
每一集能否和上一集对上全靠运气
一个场景两个主体
两者都上传 (两个角色,或角色加产品)
很难用文字描述两个特定主体
迭代速度
换场景、留角色、再生成
每次尝试都可能丢掉已确定的样子
准备工作
上传照片即可,无需训练
想要一致性就得训练模型或 LoRA
常见问题

常见疑问。

什么是角色一致性 AI?

角色一致性 AI 能让同一个人、吉祥物或生物在不同图片或视频片段里保持一模一样。不用每次都用文字描述角色,只要把照片交给 AI 一次,之后每个新场景都保持同样的脸、发型、服装和比例。

怎么用我自己的角色制作 AI 视频?

在 ClipNova 打开图片生成视频模式,上传 1 到 9 张角色照片,描述新场景 (发生什么、在哪里、镜头怎么动),选择画幅、时长和画质档位,然后生成。下载前还可以加上配音、音乐和字幕。

能在多个视频和剧集里保持同一个角色吗?

可以,这正是这个工具的用途。保存用过的参考照片,每个新场景或新一集都上传同一组。无需训练自定义模型,角色在整部系列里都认得出来。

最多能上传多少张参考图?

Base 支持 1 到 7 张,Pro 支持 2 到 4 张,Ultra 支持 1 到 9 张。一张清晰照片通常就够;同一角色的更多角度有助于复杂场景。

能把两个角色,或角色和产品放进同一个场景吗?

可以。上传两个主体的照片,并描述他们如何一起出现。Pro 档位专为把多张参考图合成到一个场景而设计。

角色一致的视频能做多长?

单个片段根据档位为 4 到 10 秒。需要更长的视频时,ClipNova 会按镜头逐个规划,每个镜头都用上你的参考图,最长 5 分钟。

这和 AI 角色生成器有什么不同?

角色生成器负责创建角色图片。这个工具则是拿你已有的角色,在新的视频场景里保持不变。在 ClipNova 里两件事都能做:先在 AI Characters 创建角色,再上传到这里。

费用是多少?

方案每月 $19 起。每个视频消耗积分,生成前会显示准确费用。一个 Base 片段消耗 80 积分;Pro 和 Ultra 更高,Ultra 还带同步音效。

用我的角色做的视频归我所有吗?

是的。你生成的视频在所有方案中都附带完整的商业使用权。请确保你拥有所上传照片的权利或许可,未经本人同意不要使用真实人物的照片。

查看完整帮助中心

查找关于功能、工具和工作流程的100多个问题的详细解答

或查看我们为 LLM 优化的 Markdown 版本 →
工具

AI 视频工具。

选择工具,添加内容,几秒钟内产出视频。然后按你的喜好随意定制。

查看所有工具
今天就开始创作

用最快的方式让你的角色 在每个镜头中保持一致。

加入把想法变成让人停下滑动的视频的创作者行列,无需团队、无需软件、无需学习成本。

生成我的第一支视频