如果你想让一条短 AI 视频看起来是有设计过的,工作要从动画前就开始。一个可用的 storyboard 能让你在修改成本还很低的时候,先验证镜头顺序、连续性、节奏和构图。所以真正好的 GPT Image 2 分镜提示,重点不是堆装饰,而是建立控制力。
你可以先打开 Image3,查看 GPT Image 2 模型工作区,或者直接进入专门的 GPT Image 2 storyboard generator。这篇文章只解决一个实际问题:把一个模糊想法整理成可读的 6 格或 9 格分镜,并为后续更稳的视频工作流打基础。
先从正确入口开始

先说结论
优秀的 GPT Image 2 分镜提示通常按顺序做到这五件事:
- 先定义故事节点。
- 写清楚分镜布局和阅读顺序。
- 重复那些必须固定不变的连续性锚点。
- 每一格只安排一个清晰动作。
- 预留一张干净的单帧用于后续视频衔接。
很多弱分镜的问题都出在:镜头逻辑还没稳,就先追求成片感。如果一套分镜都说不清楚谁在场、发生了什么变化、下一镜是什么,那视频阶段继承到的就不是清晰,而是混乱。
什么样的分镜提示才算可用
Storyboard 是一个规划资产,不是选美比赛。真正有价值的问题,不是某一格看起来够不够戏剧化,而是别人能不能一眼看懂整段顺序,以及这套分镜能不能自然衔接到下一步生成镜头、精修画面或动作测试。
下面这些部分,每次都值得明确写出来:
| 部分 | 需要描述什么 | 为什么重要 |
|---|---|---|
| 故事节点 | 场景目标和情绪变化 | 避免分镜退化成随机概念图 |
| 分镜数量 | 6 格或 9 格,以及阅读顺序 | 让节奏一眼可见 |
| 连续性锚点 | 人物、服装、道具、场景、色调 | 防止每一格都像不同项目 |
| 镜头推进 | 远景、中景、近景、特写、反应镜头 | 让序列有节奏 |
| 每格动作 | 一格里只保留一个可见动作或决策 | 提高整套分镜的可读性 |
| 约束条件 | 不加新角色、不加新道具、不出现随机文字 | 降低漂移 |
连续性锚点一定要写在前面。风格描述当然有用,但最容易先出问题的通常不是风格,而是一致性。
什么时候用 6 格,什么时候用 9 格
快速转化型内容,优先用 6 格
6 格分镜通常已经足够应对这些场景:
- 产品演示
- 社交广告
- 简短解释视频
- 角色亮相
- 前后对比结构
它的优势是快。只有 6 格时,你会被迫只保留关键节点:开场、触发、展示、证明、情绪转折和结尾。
需要更清晰节奏和更多镜头变化时,用 9 格
当你需要下面这些内容时,9 格会更合适:
- 更电影化的开场铺垫
- 中段有明显升级
- 单独的回报镜头
- 为道具、屏幕或手部动作预留插入镜头
- 在进入动画前做更细的连续性检查
9 格的价值在于它给了你更完整的镜头语法空间。你可以先交代环境,再介绍主体,再推进关键动作,最后给出结果,而不是把几个动作硬塞进一格里。
一个可复用的提示模板
如果你要的不是一张单独图片,而是一套完整分镜,可以直接套这个模板:
Create a readable [6-panel or 9-panel] storyboard for [scene or campaign goal].
Reading order: left to right, top to bottom.
Continuity anchors: [character appearance], [wardrobe], [main prop], [location], [palette], [must-preserve product or object details].
Shot plan:
Panel 1: [setup shot]
Panel 2: [new action]
Panel 3: [reaction or closer detail]
Panel 4: [turning point]
Panel 5: [proof or consequence]
Panel 6: [closing beat]
If using 9 panels, continue with panels 7 to 9 for escalation, insert detail, and final payoff.
Visual treatment: clean storyboard presentation, consistent framing logic, cinematic but readable composition, soft neutral background around panel borders.
Constraints: keep the same character identity, clothing, props, and scene logic across all panels. No random typography, speech bubbles, watermarks, extra characters, or duplicate panels.
这个结构有效,是因为它把镜头顺序逻辑和渲染风格拆开了。顺序不对,就先修 shot plan,而不是一开始就追求视觉效果。
可直接复制的 6 格分镜提示
做产品广告或落地页 teaser 时,可以直接用:
Create a readable 6-panel storyboard for a short AI video promoting a portable espresso maker. Reading order: left to right, top to bottom. Continuity anchors: the same matte black portable espresso maker with copper accents, the same young commuter in a sand-colored trench coat, a modern train platform at sunrise, warm amber and slate-gray palette, and a compact leather shoulder bag. Panel 1: wide shot of the commuter arriving at the platform with the bag visible. Panel 2: medium shot opening the bag and revealing the espresso maker. Panel 3: close-up of the machine brewing with visible steam. Panel 4: reaction shot of the commuter taking the first sip. Panel 5: insert shot of the compact device beside a phone and notebook on the bench. Panel 6: clean hero shot with the commuter boarding the train while holding the cup. Visual treatment: cinematic but clear storyboard panels, consistent character identity, realistic morning light, and readable framing. Constraints: no extra commuters as main subjects, no brand text, no random signage, no duplicated panels, and no costume changes.
这个例子之所以有效,是因为每一格都只承担一个任务。整套流程从开场到揭示、到证明、到回报逐步推进,没有让单格承担所有信息。
可直接复制的 9 格分镜提示
当你需要更完整的情绪推进或更多镜头变化时,可以用:
Create a readable 9-panel storyboard for a short AI video about a freelance designer using an AI image tool to finish a campaign pitch. Reading order: left to right, top to bottom. Continuity anchors: the same designer with a short black bob and forest-green overshirt, a warm studio desk with a silver laptop, sketchbook, and orange utility pouch, evening window light, and a calm green-orange-neutral palette. Panel 1: wide desk setup before work begins. Panel 2: medium shot of the designer reviewing rough sketches. Panel 3: close-up of the laptop showing a prompt input moment. Panel 4: over-the-shoulder shot reacting to the first generated result. Panel 5: insert shot of storyboard notes and panel thumbnails. Panel 6: medium shot refining the sequence with focused expression. Panel 7: close-up of the strongest storyboard frame on screen. Panel 8: wider shot showing the finished board beside the sketchbook. Panel 9: confident closing frame as the designer exports the final presentation. Visual treatment: clean storyboard board, consistent proportions, controlled shot progression, and readable panel separation. Constraints: keep the same face, hair, wardrobe, desk objects, and color palette in every panel. No random text blocks, no new accessories, no duplicated angles, and no extra people entering the story.
这个 9 格版本更适合展示过程。特别是当视频本身就是围绕工作流、变化过程或方法证明时,它会更好用。
如何让每一格保持连续
连续性锚点决定了一套图是分镜,还是拼贴。以下这些信息要在每一格里保持一致:
- 同一张脸或同一个主体
- 同一套服装或同一个产品外观
- 同一组道具
- 同一类场景环境
- 同一套配色
- 同一条故事逻辑
如果人物在不同格里换了衣服,道具比例变了,或者房间设计突然变了,那这套分镜作为生产规划的价值就会明显下降。你可以变换镜头距离和角度,但不应该无意中改掉主体身份。
这里就可以接上 character-sheet workflow。如果整套分镜依赖一个反复出现的人物,先把角色表定住,再围绕这个已确认身份写 storyboard,而不是每一格都重新发明一次角色。
用分镜反推出一张英雄帧
一套 storyboard 不需要每一格都完美,但它至少要提供一两张足够强的画面,能直接进入下一步生产。第一轮出来后,你可以优先挑:
- 轮廓最清楚的一格
- 故事转折最明确的一格
- 产品识别度最高的一格
- 即便进入动态也不会过于杂乱的一格
然后把这一格拿去 GPT Image 2 图片编辑 精修,或者接到更完整的 image-to-video workflow 里。
分镜的意义不是跳过下一步,而是让下一步更可控。
五种会让 AI 分镜失效的常见问题
1. 每一格都像不同广告
这通常意味着连续性锚点太模糊。服装、产品外观、场景类型和色调都要明确写出来。
2. 一格里塞了太多动作
如果同一格里既要动作、又要反应、又要产品特写、又要情绪回报,那就应该拆开。每一格只承担一个清晰决策时,整套分镜会更强。
3. 镜头推进太平
如果每一格都是中景,整套分镜读起来就会很重复。应该有目的地混用远景、中景、近景、插入镜头和反应镜头。
4. 重要文字不可读
不要依赖生成图里的文字去承担对白、字幕或精确界面标签。关键说明应该放在图外,分镜负责传达镜头意义,而不是最终排版。
5. 看起来精致,但没法用
一套分镜即使看起来很漂亮,如果回答不了这些实际问题,依然是失败的:开场镜头是什么,变化发生在哪里,信息卖点靠哪一格传达,哪一格会成为视频输入?
一个实用的审查清单
保存前,用同一缩放比例检查这些点:
- 第 1 格是否清楚交代了主体和场景?
- 后面的每一格是否都在推进新节点,而不是重复上一格?
- 角色、产品和道具是否在全套图里明显保持一致?
- 镜头变化是否足以形成节奏?
- 是否有一张非常明确的英雄帧可供下一步使用?
- 是否出现了文字脏点、多余手部、额外道具或误生成的新角色?
- 团队里其他人不听你解释,能不能也看懂这套顺序?
如果最后一个问题的答案是否定的,这套分镜就还没准备好。
在 Image3 里可重复执行的流程
当你的目标是视频规划,而不是随便探索几张图时,可以按这个流程走:
- 从 GPT Image 2 模型工作区 或 storyboard generator 开始。
- 先出一版 6 格分镜,用来验证第一层顺序逻辑。
- 只有在中段或结尾还不够清楚时,再扩展到 9 格。
- 保存最好的整版分镜,并标记最强的一格。
- 在 Image3 Workspace 里精修这一格。
- 把确认后的静帧继续送入 AI video cluster 或 image-to-video guide。
如果你在真正写 shot list 之前,还想先把提示结构整理干净,也可以同时打开 GPT Image 2 prompt guide。
GPT Image 2 在分镜场景里能做什么,不能做什么
GPT Image 2 很适合用来规划可读的镜头序列,也比一句概念型提示更容易保持连续性。但它并不等于逐格完全匹配,也不保证精确对白渲染,更不意味着一条提示就能直接产出可投入生产的 animatic。
这个边界很重要,因为 storyboard 的作用本来就是降风险。你如果把第一版分镜直接当成最终生产画面,小的连续性错误会一路传递到后面所有环节;但如果你把它当成规划表面,它的价值会非常高。
最稳妥的做法,是把下面三样东西一起保存:
- storyboard prompt
- 确认通过的整版分镜图
- 准备进入下一步的英雄帧
这样一来,哪怕一周后活动要返修,你也还有一套清楚的基线可以回退。
最后结论
真正强的 GPT Image 2 分镜提示,强调的是镜头顺序,而不只是风格。先锁定连续性锚点,让每一格只做一件事,再用整套分镜反推出最适合进入视频流程的那张静帧。
操作步骤
- 先锁定故事节点
在描述风格、镜头运动或氛围之前,先明确每一格之间真正发生了什么变化。
- 明确分镜布局
写清楚面板数量、阅读顺序、画面比例,以及每格是远景、中景还是近景。
- 保留连续性锚点
重复写出必须在所有分镜中保持一致的人物、服装、道具、场景和色调。
- 每格只承担一个任务
每一格只放一个主要动作,让整套分镜更易读,也更适合后续视频制作。
- 视频前先确定英雄帧
先挑出最强的一格,必要时单独重生为干净静帧,再进入图生视频或镜头生产。
常见问题
GPT Image 2 分镜提示的最佳结构是什么?
先写故事节点、分镜数量、阅读顺序、重复出现的人物锚点、镜头构图,再写每一格的具体动作。需要保持一致的内容应放在风格描述之前。
应该用 6 格还是 9 格分镜?
当你做短广告、解释视频或简短场景时,6 格通常够用。若你需要更清晰的开场、推进和收束节奏,9 格更合适。
GPT Image 2 能在分镜里保持同一角色吗?
如果你反复强调同一身份、服装和道具锚点,它能提升连续性,但不能视为绝对保证。进入视频前仍要逐格核对。
AI 分镜图里应该放多少文字?
尽量少。只有在确有必要时才放简短标签;关键对白、时序说明和制作备注应放在图片外。
如果只有一格效果对,其他格都漂了怎么办?
先保留最强的一格,减少同时变化的变量,再沿用同一套连续性锚点补生缺失镜头,而不是整套重写。
什么时候该从分镜切到视频生成?
当分镜顺序、角色连续性、镜头推进和至少一张干净英雄帧都确认后,再进入视频步骤。把分镜当成规划工具,而不是最终视频资产。