
你有没有过这种操作——为了做一条「高级」的 AI 视频,在提示词里激情写下「电影感、高级质感、大片氛围、光影丰富」,结果生成出来要么抖动,要么人物变脸,要么画面像 PPT 幻灯片?
问题往往不在模型,而在提示词没有结构。Seedance 2.0 对具体指令的响应远好于空泛形容词。社区把官方 6 元素公式压缩成 5 层结构,出片稳定性明显提升。这篇 Seedance 教程 按层拆解写法,帮你在 Seedance 中文版 工作台里把「抽卡」变成「可控出片」。
一、为什么「电影感」三个字不够用
「电影感」「史诗感」「高级感」是感受,不是指令。模型读不到你脑子里的画面,只能猜。猜多了,注意力分散,脸漂移、镜头乱晃、光影跳帧就全来了。
Seedance 2.0 把镜头方向当作一等信号——写清楚「谁、做什么、镜头怎么动、光从哪来、哪些不能崩」,比堆十个形容词管用得多。下面这套顺序,是大量实测后最稳的组合。
二、五层公式:顺序不能乱
记住这一行就够了:
主体 > 动作 > 镜头 > 风格 > 约束
| 层级 | 作用 | 要点 |
|---|---|---|
| 主体 | 视觉锚点 | 放最前,描述人物/产品细节 |
| 动作 | 动态指令 | 现在时,单一核心动作 |
| 镜头 | 构图与运镜 | 每次一种主运镜 + 节奏词 |
| 风格 | 灯光与调色 | 具体光位、胶片参考 |
| 约束 | 防崩兜底 | avoid jitter、maintain face consistency 等 |
顺序背后的逻辑很简单:先锁重心(主体),再给动态(动作),然后定构图(镜头),最后加风味(风格)和兜底(约束)。Seedance 2.5 延续同一套写法,只是参考素材上限更高——先把 5 层练熟,换版本不用重学。
三、第 1 层:主体——越具体越稳
主体放最前面,给模型一个视觉锚点。描述越细,跨帧漂移越少。
| 等级 | 示例 | 说明 |
|---|---|---|
| ❌ 差 | a woman | 太笼统,容易变脸 |
| ⭕ 还行 | a young woman with brown hair | 有基本特征 |
| ✅ 最好 | late 20s, dark curls at ear length, silver hoop in left ear, black turtleneck, neutral expression | 身份标记够细,漂移少 |
实操建议:单次生成尽量只放一个主要人物;头发长度、衣着质感、配饰、姿势都写清楚。有参考图时,用 @图片1 锁脸和服装,文字只补动作和镜头。
四、第 2 层:动作——写指令,别写状态
动作层用现在时、单一核心动作。很多人写的是「她很开心地在看日落」——这是状态,不是动作。
- ❌ 差:
she looks happy and is enjoying the sunset - ✅ 好:
she slowly turns toward the camera, breeze lifting the hem of her skirt, eyes narrowing against the light
铁律:主体运动和镜头运动分开写。
❌ spinning camera around a dancing person(一条指令,模型不知道谁该转)
✅ the dancer spins slowly, camera holds fixed medium shot(歧义拆开,抖动少一半)
五、第 3 层:镜头——每次只给一个主运镜
Seedance 2.0 对镜头语言识别率很高,但每次生成只给一个主要运镜,用 slow / smooth / gentle 这类节奏词,别堆 f 值、ISO 等技术参数。
静态镜头
| 术语 | 效果 | 适用 |
|---|---|---|
| fixed / locked-off | 完全不动 | 对话、产品定格 |
| static wide | 广角固定 | 建立场景 |
| locked tripod, zero shake | 锁死画面 | 环境有风/人群时 |
运动镜头
| 术语 | 效果 | 适用 |
|---|---|---|
| push-in / dolly in | 推近 | 张力、情感特写 |
| pull-out / dolly out | 拉远 | 交代环境 |
| pan left/right | 横摇 | 扫视空间 |
| tracking shot / follow | 跟拍 | 与主体并排移动 |
| orbit / arc | 环绕 | 产品、肖像 |
| handheld | 手持微晃 | 纪录片、UGC 感 |
| rack focus | 移焦 | 前景背景切换注意力 |
速度修饰词
| 修饰词 | 效果 | 备注 |
|---|---|---|
| slow / gentle / gradual | 最安全 | 默认推荐 |
| smooth / controlled | 自然节奏 | 品牌片常用 |
| dynamic / swift | 高冲击 | 慎用,只让一项快 |
| fast(无限定) | 全画面加速 | 几乎必抖,避免 |
六、第 4 层:风格——灯光比形容词重要
风格层管灯光、调色和电影参考。实测里,灯光描述对画质的影响最大,比「4K」「超清」这类词管用。
灯光关键词
| 关键词 | 效果 |
|---|---|
| golden hour | 性价比最高的单条改进 |
| rim light / dramatic rim light | 边缘分离,电影感轮廓 |
| soft key from 45 degrees | 访谈、口播 flattering 光 |
| overcast diffused light | 消除明亮场景闪烁 |
| backlit silhouette at sunset | 戏剧性剪影 |
| volumetric fog | 大气纵深,配背光 |
调色参考
| 关键词 | 效果 |
|---|---|
| teal and orange | 经典好莱坞对比 |
| warm tone / amber-tinted | 怀旧暖调 |
| crushed blacks | 深沉暗部 |
| pastel | 柔和时尚/动漫感 |
电影参考锚点
| 参考锚点 | 效果 |
|---|---|
| cinematic film tone, 35mm | 最稳万能锚点 |
| 16mm film, handheld | 独立电影 raw 感 |
| anamorphic lens flare | 宽银幕光晕 |
| national geographic quality | 自然纪录片质感 |
「cinematic」单独出现等于没约束。要写就写成 cinematic film tone, 35mm, warm golden lighting 这种交叉锚点,给模型三条可执行线索。
七、第 5 层:约束——防崩的最后一道墙
约束是护栏层,决定观众能不能一眼看出「这是 AI」。角色类提示词建议默认带上防崩词:
| 约束词 | 作用 |
|---|---|
| avoid jitter | 画面别抖 |
| avoid bent limbs | 肢体别扭曲,角色必加 |
| avoid identity drift | 跨帧别变脸 |
| maintain face consistency | 五官稳定 |
| no distortion, no stretching | 几何别变形 |
社区常用的质量后缀(正向表述比纯否定更稳):
sharp clarity, natural colors, stable picture, no blur, no ghosting, no flickering
八、这些词尽量别单独用
下面几个词看起来万能,单独写往往适得其反:
| 词汇 | 问题 | 改法 |
|---|---|---|
| cinematic(单独) | 无执行信息 | 加 35mm + 灯光交叉约束 |
| epic / amazing / stunning | 感受不是指令 | 换成具体光位或动作 |
| lots of movement | 触发全画面抖 | 写清一项具体运动 |
| fast(无对象) | 所有元素一起加速 | 只让主体或镜头其一快 |
| glow / glimmer | 镜面闪烁 | 改用 steady intensity |
九、15 秒里切多个镜头:时间轴写法
单次最长约 15 秒,可以用时间戳当分镜脚本,一次生成多段节奏:
15 秒四段升级弧示例
[0-4s] 大远景固定机位,建立场景
[4-8s] 中景缓慢推近,主体入画
[8-12s] 近景,情绪高点
[12-15s] 特写或戏剧性揭示,slow controlled
经典升级弧:远景 → 中景 → 近景 → 特写,四段填满 15 秒,叙事感立刻上来。上传分镜图时用 @图片1 标注角色,用 @视频1 锁运镜节奏。
十、三个可直接套用的示例
示例 1:产品展示(15 秒)
[0-4s] macro push-in on matte black headphones, locked tripod, soft key from 45 degrees
[4-9s] slow orbit around product, rim light against dark background
[9-15s] pull-out to hero frame, product centered, golden hour tone, avoid jitter, maintain face consistency
示例 2:人物情绪短片
a woman in her late 20s, dark curls at ear length, fitted black turtleneck, she slowly turns toward camera, breeze lifting skirt hem, medium shot slow push-in, cinematic film tone 35mm, warm golden hour lighting, avoid identity drift, stable picture
示例 3:动作场景(时间轴)
cinematic film tone 35mm, misty bamboo forest,
[0-4s] wide establishing shot, static camera, mist between bamboo
[4-8s] medium tracking shot, fighter in white lunges forward, slow controlled
[8-12s] close-up, orbit shot, strike in slow motion
[12-15s] pull-out reveal, avoid bent limbs, no distortion
十一、常见问题
问:必须按五层顺序写吗? 答:建议保持主体 → 动作 → 镜头 → 风格 → 约束。顺序乱了,模型容易先被风格词带跑,动作和构图反而失控。
问:中文写还是英文写? 答:运镜和约束用英文(dolly in、avoid jitter)识别略稳;场景和人物描述用中文完全没问题,混写是常见做法。
问:一次能写几种运镜? 答:一个镜头一种主运镜。推近 + 横摇 + 环绕写在同一句,抖动概率会明显上升。
问:Seedance 2.5 上线后这套还适用吗?
答:适用。2.5 主要提升时长和参考素材上限,提示词结构不变。五层练熟后,换 2.5 只是能塞更多 @ 参考,不必改写法。
小结
别再靠「电影感」碰运气了。Seedance 2.0 认的是结构化指令:主体定锚、动作给动态、镜头锁构图、风格靠灯光、约束防崩。五层按顺序写,出片率会稳定很多。
下面入口打开 Seedance 中文版 工作台,拿本文示例跑一条对比「堆形容词」和「五层写法」的差别: