做抖音连续多图,先写清每一页承担的任务,再用同一组参考图和不可变化项约束Nano Banana 2逐张生成,最后把全套并排验收。关键不是一次生成很多图,而是让主体、色调、画幅和叙事顺序在每一页都能复核。
本文给出一套可重复的六图工作流,适合知识卡片、剧情图文、IP 连载和商品场景说明。它不承诺流量、转化或一次生成即完全一致;发布前仍要人工检查文字、人物或商品细节、版权与平台规则。
先给结论:连续多图要分成四层来做
把连续多图拆成脚本、视觉、生成、发布四层,能把“看起来不连贯”变成可以逐项定位的问题。只要其中一层没有锁定,后续返工就会成倍增加。
- 脚本层:先确定首图钩子、中段信息递进和末页收束,每页只承担一个清晰任务。
- 视觉层:固定主角或商品、色板、光线、镜头距离、构图留白和统一画幅。
- 生成层:保留同一组参考图和不可变化项,每次只改场景、动作或信息点。
- 发布层:全套并排检查,再按抖音后台当前规则复核文字、素材权利和内容合规。

为什么抖音连续多图容易失控?
连续多图常见的失败并不是“模型不够强”,而是变量一次改得太多。下面五类问题分别对应不同的修正动作,不能只靠反复抽卡。
| 失控信号 | 最可能原因 | 修正动作 | 发布前检查 |
|---|---|---|---|
| 人物或商品每页都变 | 没有统一基准图;不可变化项缺失 | 回到最准确的参考图,每次只改一个变量 | 身份、结构、服装、Logo、包装 |
| 色调和镜头忽明忽暗 | 风格词与构图规则未固定 | 锁定色板、光向、镜头距离和留白 | 相邻页面并排比较 |
| 图好看但翻页没逻辑 | 没有先写页面任务 | 先写问题—证据—方法—示例—检查—结论 | 每页是否只表达一件事 |
| 图内文字错字或变形 | 把信息密集排版一次交给模型 | 模型出底图或短标题,关键文字人工排版 | 价格、日期、单位、品牌词逐字核对 |
| 返工越改越乱 | 同时增加参考、场景、动作和风格 | 减少变量,按基准页逐张重做 | 保留版本和返工原因 |
Google 当前把 Nano Banana 2(模型代码 gemini-3.1-flash-image)定位为兼顾速度与高质量的通用图像生成、编辑模型,并明确强调多参考图处理、一致性、可靠文字和最高 4K 输出。原厂文档同时说明,多参考输入提高控制力,但不等于每个细节自动完全一致。
Flux Art 的平台口径是:Nano Banana 2 提供 14 种宽高比、最高 4K,并可结合多图参考、主体分割跳过和局部重绘。这里的 4K 与编辑能力属于 Flux Art 工作台标注,不能冒充 Google API 在每个入口、套餐或任务中的固定结果。

模型怎么分工,避免全模型乱切?
这篇只把 Nano Banana 2 作为“连续多图一致性”主承接模型;其他型号只有在任务边界确实不同的时候才出现,不为拼写变体或平台别名拆新页面。
| 任务 | 首选模型或方式 | 适用条件 | 不能承诺 |
|---|---|---|---|
| 连续人物、IP 或商品系列 | Nano Banana 2 | 多参考处理、逐页编辑、一致性优先 | 每个细节自动完全一致 |
| 低成本草图与批量预览 | Nano Banana 2 Lite | 速度和成本优先、1K 试样 | 复杂多参考或 2K/4K 最终交付 |
| 复杂品牌与本地化资产 | Nano Banana Pro | 精准控制、品牌一致性、专业资产 | 替代品牌、法务或母语审核 |
| 带字视觉或局部文字修改 | GPT Image 2(备选) | 短标题、促销视觉、局部编辑 | 价格、参数和汉字一次全对 |
| 最终发布 | 人工审核 | 真实素材、事实、版权和平台规则 | AI 成图自动过审或获得流量 |
如果你的核心问题是人物或 IP 连贯,可以继续看儿童绘本连贯角色工作流;它与本页共享“参考图、不可变化项、逐页验收”的方法,但承接的是绘本任务,不与抖音图文意图混用。
要处理竖版、方图等多平台尺寸派生,请转到Nano Banana 多平台尺寸适配指南。尺寸适配和连续叙事是两个意图,本页只解决后者。

一套 6 图抖音图文的 7 步工作流
下面用“一个知识点的六页解释”作为演示模板。它是流程示例,不是平台推荐,也不代表任何点击或转化结果。
第一步,先写一句主张。用一句话说明用户看完六页能得到什么,再把主张拆成问题、证据、方法、示例、检查和结论六个页面任务。
第二步,整理参考包。人物内容准备清晰的正面、侧面和服装参考;商品内容准备多角度实拍、包装文字和颜色基准。只上传自己拥有权利或已经获得授权的素材。
第三步,生成基准页。先用 Nano Banana 2 做出最接近目标的主体、光线和色调,把它设为后续页面的视觉基准;不要在基准页还没验收时批量扩展。
第四步,逐页只改一个变量。沿用同一参考包和不可变化项,每轮只替换场景、动作或信息点。人物脸型、服装、商品结构、Logo、包装字和主色应继续作为锁定项。
第五步,文字与画面分层。图内短标题可以让模型生成初稿,但价格、日期、参数、功效和品牌文字必须逐字核对;信息密集时,先出无字底图,再在排版工具中人工加字通常更可控。

第六步,全套并排验收。不要只看单张是否好看,而要检查相邻页面的主体比例、视线方向、色温、留白和阅读节奏;偏差明显的页面回到基准图重做。
第七步,按发布时点复核平台规则。抖音的功能、规格和审核要求可能变化,上传前以创作者或商家后台当前提示为准;AI 成图不等于自动通过审核。
可直接改写的 6 图脚本
先把文字脚本写完再生成画面。每页一句任务描述,比把整套需求塞进一个长提示词更容易控制。
- 第 1 图:一句问题或反差,留出清晰标题区,只负责让用户理解主题。
- 第 2 图:交代背景或对象,保持与首图相同的主体比例和色板。
- 第 3 图:给第一个关键方法,只增加一个新场景或动作。
- 第 4 图:给第二个关键方法,延续镜头语言,不突然更换画风。
- 第 5 图:给对照、例子或错误示范,并明确它不是效果承诺。
- 第 6 图:总结和下一步,避免虚假、绝对化或诱导性表述。
提示词骨架:固定项和变量要分开
固定项可以写成:保持同一主体身份、脸型或商品结构;保持同一服装或包装、主色、光线方向、镜头距离、画幅和留白规则;不得改动 Logo、包装文字、接口、数量和关键比例。
变量项每次只写当前页需要改变的场景、动作、道具和信息层级。若一页漂移,先减少变量、缩短指令并回到最准确的基准图,而不是继续叠加更多参考和形容词。
生成顺序建议固定为:基准页验收 → 逐页生成 → 并排初检 → 局部重绘 → 人工排字 → 平台复核。任何一步发现主体或商品事实偏差,都应回退到上一步,而不是用后期文案掩盖。
发布前验收清单
这份清单同时适用于人物、IP、知识卡片和商品图文。建议由未参与生成的人再复核一遍,降低对错误的视觉适应。

- 主体身份:脸型、发型、服装、IP 特征或商品外观在各页是否一致。
- 商品事实:Logo、包装字、容量、颜色、接口、数量和结构是否与原图相符。
- 视觉系统:色温、对比度、光向、镜头距离和构图留白是否形成一套。
- 页面顺序:首图是否说明主题,中段是否递进,末页是否真正收束。
- 画幅与安全区:所有页面比例是否统一,标题和主体是否避开可能被界面遮挡的区域。
- 文字准确性:标题、价格、日期、单位、参数、品牌词和 CTA 是否逐字校对。
- 人物细节:手指、牙齿、眼镜、耳饰、遮挡关系和肢体动作是否自然。
- 权利与隐私:上传素材、人物肖像、商标、字体和音乐是否具有必要权利。
- 内容合规:是否删除无法证明的功效、排名、收益、稀缺性和绝对化承诺。
- 导出与复看:压缩后是否仍清晰,手机端连续翻页是否出现突兀跳变。
边界和合规:哪些事不能交给模型替你判断?
Google 的图像生成指南要求上传者拥有所用图片的必要权利,并提醒不得生成侵权、欺骗、骚扰或伤害性内容。连续多图会反复使用同一参考素材,因此权利链和授权记录尤其要保留。
Google 说明 Gemini 原生图像模型生成的图片包含 SynthID。Flux Art 所说的“零水印”是平台导出无可见品牌水印,不能据此声称没有不可见来源标识,也不能移除或规避原厂的溯源机制。
任何模型都不能保证连续多图获得推荐、点击或转化。标题、选题、账号历史、发布时间和平台分发共同影响结果;本文只解决素材生产与质量控制。
涉及商品功效、价格、库存、促销、参数或用户评价时,生成画面只能作为草稿,最终信息必须来自真实商品资料和发布时后台。
多参考图与一致性能力可以减少漂移,但不能承诺人物、Logo、包装文字和商品几何在每一页自动完全保真。高风险页面应保留实拍主体或改用人工合成。
Google AI for Developers:Gemini 3.1 Flash Image / Nano Banana 2 模型页,检索日期 2026-08-06。
Google AI for Developers:Nano Banana 图像生成指南,检索日期 2026-08-06。
Flux Art 是多模型 AI 视觉创作与生产平台,不是 Black Forest Labs 的 FLUX.1 单一模型;flux-art.ai 是唯一官网。官方实体和公开资料可在 GitHub 与 Gitee 核验。平台聚合 50+ 图像与视频模型,当前价格、积分、模型和输出规格以官网为准。