多格 AI 图像生成:漫画、分镜与角色设定表
为 AI 漫画和分镜规划画格、阅读顺序与角色简报;完成排版前核对格数、身份和文字。
本页目录
先定义整张版面,再定义每一格
制作漫画、分镜或角色设定表时,先说明整体网格、哪些内容保持一致,以及每格改变什么。输出后逐格检查。“同一角色”是一项要求,不是结果保证。
单张画布内的多格图,与多次独立生成时保持人物一致,是不同任务。本文提供规划方法,不报告格数成功率,也不评定最强模型。
把简报拆成三部分
- 版面: 格数、行列、阅读顺序和间隔。
- 共用主体: 需要一致的身份、服装、物体、媒介与光线。
- 每格指令: 按编号写动作或视角。
先保留叙事真正需要的变化。减少同时变化的项目,有助于判断问题来自哪里,但不保证模型遵守全部要求。
comic strip of a detective entering a room, finding a clue, and leaving
three equal vertical panels, same detective and brown coat in every panel; panel 1 enters the room, panel 2 lifts a red key, panel 3 exits holding that same key; fixed camera height and lighting

精选表情设定案例:分别检查身份、服装和分格边界;它不是受控测试。
查看提示词收起提示词
3D皮克斯风格动画年轻男性角色,以6格网格布局展示,每格呈现不同的面部表情和服装。明亮的纯色背景(黄、蓝、红、粉、紫、绿)。角色拥有柔软的棕色波浪卷发、富有表现力的大眼睛、光滑的皮肤和风格化的卡通比例。
根据最终用途决定格数
画布尺寸固定时,更多格子会分走每格的空间。按实际展示大小和每格需要的细节选择格数。本文证据不能支持通用的九格上限,也不能保证四格必然成功。
如果每格相同、没有间隔,共有 c 列、r 行,每格宽高比为 p,那么整体比例是 c × p : r。间隔和图注会改变计算。例如方格排成三列两行,不含间隔时需要 3:2 横幅,而不是竖幅。

精选九视图案例:应按最终展示大小判断每格细节是否足够。
查看提示词收起提示词
<instruction> (指令) 分析输入图像的整个构图。识别所有存在的关键主体(无论是单人、群体/情侣、车辆还是特定物体)及其空间关系/互动。 生成一个连贯的 3x3 网格“电影印样(Contact Sheet)”,展示在同一环境中完全是这些主体的 9 个不同镜头。 你必须调整标准的电影镜头类型以适应内容(例如,如果是群体,保持群体在一起;如果是物体,构图包含整个物体): 第 1 行(建立背景): 大远景 (ELS): 主体在广阔的环境中显得很小。 全景 (LS): 完整的主体或群体从上到下可见(从头到脚 / 从车轮到车顶)。 中远景 (美式镜头/四分之三): 构图从膝盖以上(针对人物)或 3/4 视角(针对物体)。 第 2 行(核心覆盖): 4. 中景 (MS): 构图从腰部以上(或物体的中心核心)。聚焦于互动/动作。 5. 中特写 (MCU): 构图从胸部以上。主要主体的亲密构图。 6. 特写 (CU): 紧凑构图于脸部或物体的“正面”。 第 3 行(细节与角度): 7. 大特写 (ECU): 强烈聚焦于关键特征(眼睛、手、标志、纹理)的微距细节。 8. 低角度镜头 (仰视/虫眼): 从地面仰望主体(壮观/英雄感)。 9. 高角度镜头 (俯视/鸟瞰): 从上方俯瞰主体。 确保严格的一致性:所有 9 个面板中是相同的人物/物体、相同的衣服和相同的光照。景深应逼真地变化(特写镜头中的背景虚化)。 </instruction> 一个包含 9 个面板的专业 3x3 电影故事板网格。 该网格以全面的焦距范围展示输入图像中的特定主体/场景。 顶行: 宽广环境镜头,全视图,3/4 剪辑(膝上景)。 中间行: 腰部以上视图,胸部以上视图,脸部/正面特写。 底行: 微距细节,低角度,高角度。 所有帧均具有照片般逼真的纹理,一致的电影级调色,以及针对所分析的主体或物体特定数量的正确构图。
把连续性与布局分开检查
| 检查项 | 观察内容 |
|---|---|
| 结构 | 格数、行列与阅读顺序是否正确 |
| 身份 | 各格脸型、头发、服装与识别特征是否一致 |
| 物体 | 同一道具的大小、颜色与设计是否延续 |
| 叙事 | 动作顺序正确,没有缺失或重复的情节 |
| 可读性 | 最终尺寸下细节与文字是否可辨认 |
网格正确不代表每格是同一个人;人物连贯也不代表布局正确。同提示词实测 中的一次三格任务展示了这种区别。

精选分镜参考:按顺序理解画面,而不只挑出最好看的单格。
查看提示词收起提示词
一张3x3的电影分镜脚本,由9个独立的分镜组成,呈网格状排列。画面描绘了一位有着铂金色头发的年轻女子,置身于冰天雪地的阿尔卑斯山冬季场景中。 这些面板展示了各种角度和镜头: 特写镜头:聚焦于她红润的脸颊、蓝灰色的眼睛和睫毛上的雪花。 中景镜头:她身穿黑色羊毛大衣,围着蓝色针织围巾,手捧一束白色干花。 广角镜头:捕捉她独自站在冰封的湖面上,背景是巍峨的雪山。 所有画面都呈现出一致的、略带忧郁的蓝调黄昏光线。高品质的胶片摄影美学,照片级真实感,8K分辨率,风格统一,色彩分级准确。
出现漂移时
可以尝试简化问题格,或减少变化项目。在支持参考图的功能中提供合适素材,并写清需要保留什么。如果某个区域持续出错,局部编辑或分别制作后排版,可能比不断重做整张图更适合。
这些是待尝试的办法,不是已经测得的修复成功率。保留失败结果,才能比较修改是否有帮助。对话框手工排字可以直接控制拼写与位置;让模型生成文字时,仍要逐字检查和核对阅读顺序。文字实测 提供了限定在短英文任务内的观察。
更多布局参考
下列是不同提示词的独立精选案例,不能用来比较模型可靠性。









