# AI短剧到底怎么做?我把2026最新工作流整理成了一套SOP
**作者**: 行者AI视频
**日期**: 2026-07-01T04:56:09.000Z
**来源**: [https://x.com/joshesye/status/2075068420098269643](https://x.com/joshesye/status/2075068420098269643)
---

今年的AI短剧热度还是非常高,诞生了《丧尸清道夫》、《钟馗嫁妹》、《万物生:问心》、《告别》等很多现象级的作品。
所以有句玩笑话是, AI 这东西 学的晚可以不用学了。刚把故事版搞清楚,Seedance 2.0来了,全能参考、资产库、白模、3D导演台又开始冒出来。
经常有朋友在咨询行者,现在的AI视频工作流程是怎样的。毕竟这半年来,工具的进化非常快,随着Seedance 2.0的横空出世,加上各大AI工具大厂在卷,相应的工作流迭代得也非常快。
传统的剧本,分镜,生图和视频,套起来还是这个逻辑,但是底层的制作模式变化非常大。
今天这篇文章,也是行者2026年度AI视频创作年中总结,我把今年视频创作的主要流程和逻辑进行了整理,分为了上下两篇,上篇是工作流程,下篇是实用技巧,这一套3600字的SOP送给大家。
## 选题
做视频首先是选题,视频内容题材上有重生逆袭、玄幻修仙、末日生存、宫斗复仇。从类型上3D漫剧,AI仿真人剧,AI猎奇剧。
在漫剧刚火的时候,我也试过用短剧创作大师来生成剧本,但是基本上数据都不行,着实是缺少了网感。
所以做选题,还是不要自己想,多从平台排行数据,爆款视频中去找。
比如现在《爱死机》系列,《孙悟空杨戬哪吒穿越山海经》系列,抖音火的情感生活短剧。在好的选题范围下,做内容延伸,这样也比较容易拿到正反馈。
找了选题之后,就是内容创意了。
在以前,学习AI视频,还需要去进行拉片,逐帧分析。现在LibTV、纳米、TapNow等平台,会把优秀创作者的作品工作流公开出来,你可以直接看到优秀作品的工作流。

这是学习AI视频最好的时代了,普通人但凡愿意下心思去学,2-3个月,技术提升会很大的。
## 剧本生成
剧本是短剧的灵魂,我们做内容,本质上是在讲好一个故事。
剧本创作有几种方式:
1、如果你的团队中有导演/编辑的角色,那么恭喜了,这是最省心的。我们此前参与北影AIGC创作项目时,仅剧本就打磨了一个多月。
2、小云雀,libtv等平台,都有剧本创作的能力,你的一个笼统想法,可以帮你丰富成完整的剧本,这种比较适合那种标准化产出。
3、第三种是使用内容创作者,如果你喜欢自己调试剧本,可以使用导演、短剧等各种封装好的skill,内置了专家角色,输入你的创作想法,来回沟通几轮,得到你的剧本。
下图是很标准的短剧 Agent,各大AI视频工具都有这个能力,差别在于谁的底层Agent能力比较强,写出来的剧本的质量。

剧本创作出来,通常就有完整的世界观,人设,剧情反差。
## 拆分镜
剧本出来后,接着就是拆分镜了。如果你用的是AI工具平台创作的,剧本完成后,通常会自动拆好分镜。
如果你是手搓的,通常要继续手搓。如果你要出精品,分镜得磨。
很多时候,我们都会习惯让AI来批量生成,但是这样做的后果经常会改的很痛苦,所以还是要仔细检查每个分镜。
分镜完成后,包括了人物描述,场景描述,景别和运镜,以及对应每个分镜的文生图提示词,以及每个分镜的Seedance视频提示词。
> **行者AI视频@joshesye**: [原文链接](https://x.com/joshesye/status/2072182448327430203)
>
> 末日打工人职业觉醒,你的专业能力能觉醒什么异能?
>
> 

分镜图还是很重要的,现在虽然SD有强大的导演能力,但是用图来控视频目前还是主流。
现在AI Agent工具已经可以根据分镜,批量出分镜图了。比如下面是我做末日求生的废品,图和场景图都是批量生成的,人物很油,风格过于暗系。

但是我用了那么多工具之后,还是习惯自己出每一张图。
**分镜阶段,**用 GPT-image2 做角色和分镜图。。


## 创作工具
这里要重点提下剧本生成和拉片工具。
OiiOii的剧情故事创作能力很强,一句话就能生成一个不错的故事,剧本,分镜,人物全都出来了。
> 输入:孙悟空,杨戬,哪吒,3人穿越到2500年未来世界,和AI控制的机器人大战,拯救人类,做20集科幻题材短剧。

生产过程中会和你对话确认,比如我觉得孙悟空和哪吒太Q版了,我希望的是3D国漫风格,重新生成这2个人物。
第二个好用的工具是小云雀的爆款复刻功能,解析参考视频的爆点原因并借鉴在视频中.

libTV的升级后的Storyboard 脚本工作流很好用。
输入剧本文本自动拆出镜头、提取角色、场景、道具,生成可编辑故事板,再批量生成分镜图和视频。

脚本节点可以前置接入人物角色图、场景图、风格图等作为参考图,控制视频的风格和人物特征。

脚本节点会自动把剧本文本拆成结构化 shot、 提取关键角色、场景、道具,整理每个 shot 对应的画面信息,为后续生图、生视频准备基础提示词。

这些工具,都是在简化创作门槛。当然,还是前面那句话,精品需要一个分镜一个分镜磨出来的,没有哪个精品是自动套出来的。
比如下面这个作品,太牛逼了。

## 故事版
再来说下故事版。
文生视频不可控,图生视频需要一个个分镜图出,效率低下,所以有了故事版玩法。
故事版解决的是分镜的问题,适用于你不懂、或不想一个一个分镜出,你告诉AI你想表达的故事,让它来帮你出分镜。
根据你的想法,帮你出好分镜图片让你预览,一个好的故事版的格式,包括了:
> 剧情分镜脚本、角色设定、场景设计、分镜镜头、运镜方式、灯光氛围、音乐设计、旁白,甚至镜头之间的节奏关系,都能直接标记清楚。
先用 GPT Image 2 把画面和叙事控制住,后面交给 Seedance 去做动态衔接和镜头生成,出片效率会高很多。
游戏故事版
行者之前做的一个科幻 MMORPG ,仿游戏实机画。

有人物角色,有对话,有NPC,有装备选择,有BOSS战。
这个案例最强的地方,是它不只是做“几张帅图”,而是真的把登录、组队、任务、跑图、战斗、Boss、结算这些完整游戏流程都串起来了,特别像一支真实的 AAA 游戏实机预告。
大城小事故事版
这是我之前做的一个情感短视频。
故事版很适合用来做 1 分钟左右的都市情绪短剧、反转微剧情,或者自媒体账号日更的小故事内容。
这个视频行者76万曝光。


是从剧情、分镜到成片衔接非常顺,人物和场景统一度高,特别适合批量化做连续故事内容。
## 资产管理
现在主流的视频玩法都是Seedance全能参考模式。人物,风格和动作,都可以用参考图来设定。
如果前面的分镜图、资产库没做好,后面烧的全是真金白银。
接下来以宗门大比这个视频做演示:角色、场景、道具。
> **行者AI视频@joshesye**: [原文链接](https://x.com/joshesye/status/2059283653734052153)
>
> 最近做了一支 AI 漫剧小样,题材很简单,但我自己还挺喜欢:
> 《她被嘲笑只有练气三层,结果一伞镇全场》
> 这种题材为什么好看?
> 因为它抓住了漫剧里最爽的那个点:
> 前面所有人都看不起你,
> 后面你一出手,整个场子瞬间安静。
> 我这次把它完整跑了一遍:
>
> 
首先是人物资产,有2种模式。如果使用的是短剧Agent,会给你自动出,但是说实再,自动出的总少了些感觉。
我都是手动出提示词,确定好之后,接着出个全套三视图做资产图。


场景图也很重要,如果不给做个设定,生成的分镜就会跳。一般给主场景,加上多个角度的图片。如果视频中有复杂场景,需要多张场景图来控场。

最后是道具资产了,小到茶杯,武器,扇子这种,都可以从剧本设定中提炼出来。
再说下三视图,像LibTV,已经内置了多种三视图模版。我写文章的时候去看了下,就有角色脸部三视图(右侧图一)、角色设定图(图二)、角色三视图。
这样在确定好人物设定后,很方便的建好资产。现在的SD2.0很强了,能读懂角色设定图的人物角色资料。

当天,如果你要手动的话,下面是一套目前比较实用的三视图指令。
> 基于参考图的角色设计概念艺术,全身多角度tumnaroundcharacter sheet,高度细节,专业角色表,包含正面、侧面、背面、45度角、俯视、头部特写(正面+侧面)带比例尺和材质标注,统一中性灰背景干净布局
## 视频生成
视频生成阶段,也不是年初的百花齐放了,现在不管哪个工具,底层基本上都是用Seedance 2.0视频模型.
普通短视频用参考图+提示词就够了。精准控制需要分镜图+人物资产+环境+提示词。

一条没控好的10秒视频,可能就是几块到几十块。
这里面有几个小技巧:
做视频之前先出一张分镜图,用来测试风格,免得出视频了作废。
开始出视频前,用720 P,5秒的跑一条片段,千万别直接肝1080 P/4K,15秒。
有些视频不一定要用满血2.0,Fast、Mini可以看场景用。
另外,注意检查分镜提示词,有些分镜其实6秒就可以了,AI生成的经常会给到10-12秒这种。可以简化提示词,剩下的都是money。
最后,如果你还没有商业化,可以去用一些平台/模型的免费额度,或者用豆包豆包,每天有免费的生成次数。
## 音色
声音是视频的灵魂,视频中都有哪些相关音效?
首先是环境音,在生成的分镜描述词中注明,基本上生成好的视频中会自带。然后是特殊音效,比如闪电,关门,海浪等。
第二种是最需要处理的人物台词。可以使用音色固定参考。
声音资产从哪里来呢,有几种方法。比较常规的是从影视动漫中获取人物的原视频,在生成视频的时候,作为参考音频。

第二种是在资产库中,上传音色,这种是推荐的方法。

如果你是自己设计的人物,也可以在视频生成后,导出成MP3作为音频资产。
最后是Bgm,一般是要找一个比较适合主题的,在后期添加。
## 剪辑合成
最后一步是剪辑,剪辑是神。
在前面的资产库完成后,最后是把素材合成在一起的。调整分镜的时长,动作衔接,音乐和特效。
## 工具篇
最后说一下大家经常问到的工具使用问题。
做 AI 短剧,不需要一上来装一堆工具。
新手先把工具分成 4 类就够了。

记住一句话:AI短剧不是工具越多越好,而是流程越清楚越好。
## 创作思考
这半年来,我更加明显地发现到。随着技术的成熟,未来AI短剧的竞争更多的选题和工作流了。
会写提示词的很多,会选题,会讲故事,管理好资产库,会控镜头,才会慢慢拉开差距。
但是不管工具如何进化,流程怎么优化,底层的逻辑还是不会变的。
做视频的逻辑,还是用导演思维,演一出好戏。管理好资产库,演员,场景,和道具。
对于我们玩家来说,灵活使用新的工具,来应用到我们的创作流程中,是很重要的。
所以行者花了2天,写了这一篇年中总结,这篇先把工作流讲完。
关于白模、3D导演台、拉片复刻等内容,我会在后续文章中陆续展开。
## 相关链接
- [行者AI视频](https://x.com/joshesye)
- [@joshesye](https://x.com/joshesye)
- [1.4K](https://x.com/joshesye/status/2075068420098269643/analytics)
- [Jul 1](https://x.com/joshesye/status/2072182448327430203)
- [1.5K](https://x.com/joshesye/status/2072182448327430203/analytics)
- [May 26](https://x.com/joshesye/status/2059283653734052153)
- [7.7K](https://x.com/joshesye/status/2059283653734052153/analytics)
- [Upgrade to Premium](https://x.com/i/premium_sign_up)
- [12:03 PM · Jul 9, 2026](https://x.com/joshesye/status/2075068420098269643)
- [1,445 Views](https://x.com/joshesye/status/2075068420098269643/analytics)
- [View quotes](https://x.com/joshesye/status/2075068420098269643/quotes)
---
*导出时间: 2026/7/9 17:26:28*