# 一句顶一万句,Seedance2.0 提示词是有公式的
**作者**: 路飞 AI 研究员
**日期**: 2026-04-15T02:36:00.000Z
**来源**: [https://x.com/0xluffy_eth/status/2044243312916513173](https://x.com/0xluffy_eth/status/2044243312916513173)
---

我拆了上百条 Seedance 2.0 提示,终于找到 15 秒不出烂片的公式
大多数人用不好 Seedance 2.0,不是因为没创意,而是模型根本听不懂你在说什么
Seedance 要的不是感觉,是——镜头语言 + 约束 + 结构
看完这篇,你会直接拿走一套能发、能测、能稳定出片的 Seedance 2.0 提示系统。
【先说结论】
我先说最重要的一句:
Seedance 2.0 不是“文生视频工具”,它更像一个多模态电影片场。
你如果只往提示框里塞一段普通英文描述,基本只用了它 15% 的能力。
但你付的钱,和那些把参考图、视频、音频、时间编码全吃满的人,是一样的。
所以很多人不是不会写提示词。
是他们根本没按这个模型的“母语”来下指令。
【它吃什么】
我研究完之后,才意识到这玩意儿根本不是单线输入。
一代里,你最多可以给它:
9 张参考图、3 段参考视频、3 条音轨,再加你的文字提示。
也就是说,它一次最多同时处理 12 个参考文件。
而且它不是先做视频、再补音频,它是一轮推断里把视频和双声道音频一起生成。
这件事的意义很大。
因为你做的不是“剪一个 AI 片段”,而是在导演一个 4 到 15 秒、最高 1080p、音画同步的小型广告镜头。
【问题根源】
我看到 90% 的烂片,都不是模型太弱。
是提示词把“感受”写成了“指令”。
比如坏提示:
“她看起来很开心,正在享受日落。”
这个句子对人类有画面。
但对模型来说,几乎没有动作调度信息。
更好的写法是:
“她慢慢转向镜头,微风掀起裙摆,眼睛微微眯起抵御夕阳。”
差别就在这里。
前者是状态,后者是执行序列。

【5层公式】
我最后留下来的核心结构,只有 5 层:
摄像机 > 风格 > 约束 > 主体 > 动作
官方文档原本更散。
但社区反复测试后,压成这 5 层,反而更稳。
为什么这套顺序有用?
因为主体先把注意力钉住。
动作再给出动力锚点。
镜头负责构图,风格负责气质,约束负责兜底。
你可以把它理解成:
先告诉模型“谁”,再告诉它“在干嘛”,然后告诉它“你从哪看、看成什么味道、不能出什么错”。
【第1层:主体】
主体越具体,漂移越少。
我测试下来,“一个女人”这种写法几乎一定会糊。
因为模型会自动拿训练数据里的“平均女人”来补空白。
你要写到什么程度?
不是“年轻女人”。
而是“二十多岁女性,耳下长度紧密深色卷发,左耳小银环,黑色高领针织衫,中性表情”。
头发长度、衣服材质、配饰、皮肤状态,这些都别偷懒。
你少写一个,模型就会自己乱补一个。

【第2层:动作】
第二层不是“情绪”,而是“动作”。
这是最容易被忽略的一层。
也是出片差距最大的一层。
很多人写:
“她很兴奋。”
这不是动作。
我现在会强制自己写成:
“她把产品举向镜头,停顿半秒,随后抹开质地,最后向前倾身露出笑容。”
模型最怕模糊主语。
尤其是你把主体动作和镜头动作搅在一起时。
比如:
“围绕舞者旋转镜头。”
谁转?
舞者转,还是相机转?
更稳的写法是:
“舞者缓慢旋转,摄像机保持固定构图。”
或者:
“舞者站定,摄像机做缓慢弧线环绕。”
落地结论:
每条提示里,主体怎么动,镜头怎么动,要分开写。
【第3层:摄像机】
这是 Seedance 和一堆普通模型拉开差距的地方。
它对镜头语言非常敏感。
而且它更吃描述型语言,不太吃摄影器材参数。
我现在基本不写 ISO、F 值、毫米数。
我会直接写“slow push-in”“gentle orbit”“locked tripod”。
最稳的一条规则是:
一代只放一个主摄像机运动。
比如:
固定镜头:适合建立稳定感
缓慢推近:适合情绪加强
跟拍:适合动作镜头
弧线环绕:适合产品和英雄时刻
手持:适合 UGC 和纪录感
升降/无人机:适合环境揭示
速度词也很关键。
“fast” 是我见过最危险的词之一。
因为一旦你同时给“快速镜头 + 快速主体 + 复杂场景”,抖动和伪影几乎必出。
更稳的做法是:只让一个元素快,其余全部稳。
落地结论:
先用慢、柔和、平稳开局,再一点点加速度。
【第4层:风格】
这一层最值钱的,不是“电影感”。
而是光。
官方文档里提到,光影描述对视频质量的影响,甚至比很多风格词还大。
我自己测试下来也一样。
最常用、最稳的几个词:
golden hour
rim light
soft 45-degree key light
overcast daylight
volumetric fog
warm amber tone
35mm film tone
我已经基本不单独写“cinematic”了。
因为这个词太空,模型自由度太大。
你最好写成:
“35mm film tone, warm golden hour lighting, soft rim light, earthy palette”
还有一类坑词特别多:
“glowing”“sparkling”“flickering”
这些词很容易把镜面闪烁和时间不稳定一起带出来。
你本来想要柔光,最后得到的是闪屏。
更好的替代是:
“diffused light”
“stable intensity”
“soft ambient glow”
落地结论:
别写情绪词,写光线和质感。
【第5层:约束】
这一层就是护栏。
我现在几乎每条人物视频都会带这些约束:
avoid jitter
avoid bent limbs
avoid identity drift
avoid temporal flicker
maintain face consistency
stable picture
sharp clarity
这些词不优雅。
但真的有用。
尤其是“avoid bent limbs”和“avoid identity drift”。
前者能明显减少手脚变形,后者能防止人物拍到一半直接换脸。
还有一点很重要:
正向约束通常比一长串负面词更稳。
不是狂塞“bad hands, ugly, low quality”这种老派负面提示。
而是直接写“maintain geometry stability”“keep face consistent”。
落地结论:
约束不是装饰,它决定你的视频有没有 AI 味。

📌 保存这套 Seedance 2.0 提示框架
主体:年龄 + 发型 + 服装 + 配饰 + 表情
动作:只写现在时,只给一个主动作
镜头:每代一个主镜头运动,速度尽量慢
风格:优先写光,不要只写“电影感”
约束:avoid jitter / bent limbs / identity drift / temporal flicker
规则1:主体运动和镜头运动分开写
规则2:感觉词少写,视觉词多写
规则3:一次只改一个变量
规则4:先跑 2-3 个基线,再做单变量迭代
规则5:能上传参考文件,就别只靠文字硬扛
【时间编码】
这部分是很多人完全没用起来的隐藏大招。
Seedance 2.0 可以在同一条提示里,直接用时间戳导演一个 15 秒镜头。
这不是“生成一段视频”,而是在做镜头调度。
我最常用的结构是:
[0-4s] 宽镜头,交代环境
[4-8s] 中景,缓慢推近,张力上升
[8-12s] 特写,情绪或动作到峰值
[12-15s] 极近特写或戏剧性揭示
这个节奏为什么稳?
因为它完全符合电影里最常见的升级逻辑:
宽 > 更紧 > 最紧
观众的注意力会自然被你带进去。
而模型也更容易理解“每个阶段应该干什么”。
落地结论:
15 秒别乱铺,按“宽到紧”的节奏推进。
【参考系统】
真正把 Seedance 跑出“非 AI 感”的人,几乎都在用参考文件系统。
不是传一张图就完事。
而是每个参考文件都要有明确角色。
比如:
@Image1 角色外观
@Image2 环境氛围
@Video1 镜头运动参考
@Audio1 节奏和音乐
最被低估的一招,是“首尾帧法”。
把你想要的第一帧当 @Image1。
把你想要的最后一帧当 @Image2。
然后只描述这两帧之间发生了什么。
这样做的好处是,模型会自己去插值中间过程。
你不用手动画一堆分镜,也能拿到更连贯的过渡。
【迭代方法】
最后说一个最容易被忽视,但最赚钱的部分:
不要失败一次就把整条提示全改了。
很多人一出烂片,马上同时改主体、镜头、风格、灯光。
这样你永远不知道,上一轮到底是哪里出了问题。
我现在固定做法是:
先跑 2-3 个基线版本
然后一次只改一个变量
比如只改镜头、只改光、只改速度词
这个方法看起来慢。
但收敛速度反而更快。
因为你每一轮都知道:
到底是哪一个词在拉高稳定性,哪一个词在毁掉成片。
这也是为什么在 Higgsfield 上并排跑多个变体特别舒服。
你不用来回切标签页,直接在同一个工作区比较结果。
【我会直接套用的 3 个模板】
UGC 访谈模板
主体清晰 + 手机视角 + 自然窗光 + 手持轻晃 + 真实收音
适合测评、口播、种草
产品广告模板
微距 + 缓慢推近 + 边缘光 + 体积光 + 无硬切
适合香水、护肤品、3C、小众品牌广告
电影动作模板
时间编码 + 宽到紧推进 + 动作和镜头分离 + 稳定约束
适合武打、情绪高潮、剧情感短片
【最后总结】
Seedance 2.0 出不出好片,核心不是你会不会堆华丽形容词。
核心是你有没有按“主体、动作、镜头、风格、约束”这套语言去导演它。
## 相关链接
- [路飞 AI 研究员](https://x.com/0xluffy_eth)
- [@0xluffy_eth](https://x.com/0xluffy_eth)
- [5.4K](https://x.com/0xluffy_eth/status/2044243312916513173/analytics)
- [@Image1](https://x.com/@Image1)
- [@Image2](https://x.com/@Image2)
- [@Video1](https://x.com/@Video1)
- [@Audio1](https://x.com/@Audio1)
- [@Image1](https://x.com/@Image1)
- [@Image2](https://x.com/@Image2)
- [Upgrade to Premium](https://x.com/i/premium_sign_up)
- [10:36 AM · Apr 15, 2026](https://x.com/0xluffy_eth/status/2044243312916513173)
- [5,424 Views](https://x.com/0xluffy_eth/status/2044243312916513173/analytics)
---
*导出时间: 2026/4/15 20:04:03*