# 【六棱镜法系列】4张图怎么变成一段故事?聊聊分镜这件事
**作者**: 波妞PONYO
**日期**: 2026-04-05T11:46:38.000Z
**来源**: [https://x.com/ponyodong/status/2040758006011609408](https://x.com/ponyodong/status/2040758006011609408)
---

嗨,我是波妞😝,好久没有写教程帖了,今天再发个干货。
最近收到很多朋友的私下咨询,说的都是同一个问题:
图生得挺好看的。人物对,氛围对,光影也不差。
但一接成视频,就像 PPT。
问题不在图。
在于你只是把图排列了,没有连接它们。
## 这中间差的那一步,叫分镜。
很多人把 AI 视频理解成“把图做动”。这个思路会让你一直卡在素材层。
但如果你换个角度,用导演思路去想——你会发现,真正决定成片质感的,不是某一个 prompt 写得多华丽,而是你有没有先把镜头顺序、情绪递进、空间关系设计清楚。
今天这篇,我想用最不学院派、但足够专业的方式,带你建立一个适合 AI 创作者的分镜入门框架。
不玄乎。直接能用。
## 😟为什么 4 张好图,拼出来还是不像故事?

你可能很熟悉这种情况:
手里有 4 张图——
- 角色站在森林里的全景
- 角色脸部的情绪特写
- 关键道具的近景
- 角色转身离开的背影
单看都不错。
但一丢进工具生成,观众立刻会冒出几个问题:
为什么突然切近了?
那个道具为什么重要?
角色为什么下一秒就离开了?
你完成的是“排列”。不是“连接”。

## 分镜的本质,就是在生成之前,先把连接设计出来。
上一镜交代什么,下一镜承接什么。
哪个镜头负责建立空间,哪个负责推进情绪,哪个负责引爆信息。
很多人学 AI 视频,学的是怎么写更华丽的提示词。
但真正让作品开始像作品的,不是形容词。
是镜头之间有没有因果。
## 😥分镜到底是什么?别把它想得太玄

分镜不是高深术语。
你可以把它理解成:在视频真正生成之前,先把这几件事想清楚——
为什么拍这一镜?
这一镜拍给谁看?
它怎么把观众带到下一镜?
一个最低可用的分镜,至少要回答 4 个问题:
摄像机现在在哪儿?
它为什么在这个位置?
这一镜真正要让观众看到什么?
这一镜结束时,要把观众引到哪里去?
你会发现,分镜不是“把画面切碎”。
是“把观看顺序设计出来”。
所以这不是电影专业才需要的东西。
只要你想把静态图变成能被人理解、能被人代入、能被人记住的视频,你迟早要进入这个层。
因为 AI 工具会执行你的输入。
但不会替你做导演决定。
## 😃真正的入门:先学 4 个导演视角

很多人一提分镜,第一反应是景别、推拉摇移、电影术语。
它们当然重要。
但对初学者来说,更实用的入门顺序是这 4 个导演视角:
空间:观众先要知道“这是哪里”
主体:观众接着要知道“我在看谁”
变化:观众再知道“发生了什么”
结果:观众最后知道“这件事改变了什么”
这其实就是最朴素的叙事顺序。
一个好的分镜,不是每一格都很炸。
而是每一格都知道自己负责什么。
有人负责建立空间。
有人负责推进动作。
有人负责揭示细节。
有人负责落地情绪。
只要你开始这样想,哪怕暂时不会写很复杂的 prompt,视频也会立刻比以前更顺。
## 😄景别不是技术参数,它决定情绪距离

分镜里第一个必须理解的概念,是景别。
很多人以为景别只是远一点、近一点的拍法差异。
但真正重要的是:距离会改变情绪。
大全景 / 远景:让观众先理解环境和处境
→ 传递孤独感、渺小感、压迫感
中景:让观众看清动作、关系和状态
近景 / 特写:让观众进入人物情绪和关键信息
→ 传递情绪细节、内心状态、亲密感
局部细节:让故事的“针尖”真正扎进去
同样一个角色。
如果你一上来就给特写,观众可能知道她难过,但未必知道她为什么难过。
如果你先给环境,再给人,再推进到表情——观众就会自然地从“这是哪里”进入到“她怎么了”。
这就是为什么诺兰在《盗梦空间》开场,用了 5 个镜头从大全景一路推进到大特写。
他在用景别的变化,带你从“这是哪里”一步步走到“这个人怎么了”。
所以,选景别不是随便选的。
而是要问自己:这个镜头,我想让观众感受到什么?
## 😎切镜真正的标准:上一镜必须把下一镜叫出来

好的切镜,观众不会意识到你在切。
差的切镜,观众会立刻觉得“怎么突然跳了”。
切镜最实用的一条判断标准特别简单:
上一镜的最后一个信息,能不能把下一镜自然叫出来?
比如这些都是常见的连接方式:
- 角色看向某个方向,下一镜切到他看到的东西(视线切)
- 先给空间全景,下一镜切近让观众读人物状态
- 先给一个道具,下一镜切回角色反应,告诉观众它为什么重要
- 先给动作起势,下一镜给动作结果或后果

比如《教父》婚礼场景的经典视线切:
镜头 1:婚礼现场,人群欢笑跳舞(全景)
镜头 2:迈克尔坐在桌边,眼神望向某处(中景)
镜头 3:切到他在看的东西——父亲在暗处和人密谈(视线切)
镜头 4:回到迈克尔脸上,表情若有所思(近景)
观众会自然地跟着迈克尔的视线,从明亮的婚礼现场,走进黑暗的家族秘密。
这背后是一种很重要的导演意识:
每一次切镜,都不是“换一张更好看的图”。
而是“把观众的注意力继续往前推一步”。
一旦你带着这个意识去做镜头连接,视频就会明显减少那种“都很好看,但没讲明白”的断裂感。
## 🤓对 咱们AI 创作者最稳的起步结构:5 镜头,不是 5 张图

很多人最容易犯的错误:手里有 4 张图,就硬做成 4 个镜头。
更稳的思路是:先把图当素材,再重新设计成一个最小可执行的镜头结构。
如果你是初学者,我最推荐从这套 5 镜头结构开始:

建立:先告诉观众这是哪里,角色在什么处境里
靠近:让观众真正开始认识这个人
细节 / 关键物:抛出会触发故事变化的信息
反应:让人物情绪被看见,让意义落地
结尾:给出变化之后新的关系状态
注意,5 镜头不等于 5 张图。
你完全可以用同一张图切出不同景别。
也可以让某一张图只承担环境参考。
或者把最强的那张图专门留给转折点再出。
真正重要的不是图的数量。
而是这几个镜头能不能共同形成一个清楚的情绪弧线。
## 😃一个真实的例子:《千与千寻》为什么那么顺?

拿“千寻初见汤屋”这个经典场景来理解,会很直观。
如果把它拆成一个最小可执行的镜头序列,大概是这样:
建立:千寻站在汤屋大门外的全景图(环境压迫感)
靠近:千寻犹豫地走向大门(中景,展示动作)
关键物件:汤婆婆的契约书特写(命运转折的道具)
反应:千寻签下名字后的茫然表情(近景,情绪细节)
结尾:千寻站在汤屋内部,周围是忙碌的工作场景(全景,新关系建立)
这就是一个完整的情绪弧线:恐惧 → 被迫选择 → 接受现实。
5 个镜头,讲清楚了一个人的命运转折。
这 5 个镜头真正讲清楚的,不是“她走了几步”。
而是她从恐惧,走到了被迫接受。
这就是分镜最厉害的地方:它安排的不是画面数量,而是情绪推进。
## 写在最后
分镜思维,说到底就是在动手之前,先想清楚“我想讲什么故事”。
它不是什么高深的技术。
而是一种对故事的尊重——
尊重观众的观看体验。
尊重每一个镜头存在的理由。
尊重画面之间的因果关系。
当你开始用分镜思维去规划你的 AI 视频时,你会发现:
那些散乱的图片,终于变成了一个有呼吸、有节奏、有情绪弧线的故事。
这才是 AI 创作真正有意思的地方。
工具在变强。
但真正决定作品有没有生命力的,始终还是你的导演视角。
## 🚀想系统学习 AI 导演思维?
如果你看完这篇文章,觉得分镜思维很有用,但不知道怎么真正用起来——
我在波妞的 AI 研习社开了一门完整的课:《AI 导演思维(核镜世界)》
这门课会带你:
- 从角色资产、场景资产、首尾帧到镜头语言,系统解决角色一致性和画面专业感
- 让 AI 生成真正有质感、有统一性的作品
- 建立一套能反复复用的创作与商业方法
这里教的不是几个提示词。
而是一整套能反复复用的创作与商业方法。
除了《AI 导演思维》,还有《AI 广告课》——从创意表达、品牌内容、广告脚本到商业落地,建立 AI 时代真正能转化的内容能力,把内容变成品牌表达与商业结果。

扫码或者加v:ponyoassist了解课程详情 👆
我是波妞,咱们们研习社群里见。
## 相关链接
- [波妞PONYO](https://x.com/ponyodong)
- [@ponyodong](https://x.com/ponyodong)
- [19K](https://x.com/ponyodong/status/2040758006011609408/analytics)
- [Upgrade to Premium](https://x.com/i/premium_sign_up)
- [7:46 PM · Apr 5, 2026](https://x.com/ponyodong/status/2040758006011609408)
- [19.1K Views](https://x.com/ponyodong/status/2040758006011609408/analytics)
- [View quotes](https://x.com/ponyodong/status/2040758006011609408/quotes)
---
*导出时间: 2026/4/7 19:59:23*