- skill/ 技能库:index.json 11 技能 + community_techniques.md 社区技巧 + character_sheet_learn.md 角色版学习 + scene_4view_learn.md 场景四视图工业级方法 + character-sheet-generator 开源技能(7风格模板) - tools/character_turnaround.py:人物三/四视图(主视觉+三视图/展示台)+场景四视角,Z-Image 本地 - tools/audio_pipeline.py:Edge-TTS配音+字幕+BGM+混音,Agent stage⑥有声成片 - agent_short_drama.py:一键短剧 Agent --until audio 全链路 - eed_web.py:技能库端点(/api/skills,/api/skill)+E2BIG根治(字节截断+巨兽降级)+一键短剧按钮
5.5 KiB
5.5 KiB
社区技巧库 · AI漫剧/角色一致性(2026-08-01 网络搜集)
来源:知乎《100天AI漫剧出海》系列、CSDN 漫剧攻略、搜狐角色一致性解析、 NanoBanana 三视图教程、头条分镜教程、B站漫剧教程等 10+ 篇
一、角色一致性(行业第一大痛点:76% 创作者)
核心观点:一致性不是靠单一提示词锁死的,是"资产库 + 多视图 + 参数固定"的组合拳。
- 资产库锁定:先定妆(三视图/多视图)→ 存为资产 → 后续所有分镜统一引用
- 参数固定:seed、模型、负面词、风格描述全局一致(我们 Agent 已做 seed=1000+i*17)
- 提示词锁定:角色特征写成固定模板(发型/发色/发饰/服装/配饰/鞋/体型)插入每个镜头
- 三视图的真正价值:能被后续分镜环节有效复用(不是画得好看,是"标准统一可复用")
二、三视图提示词 · 社区标准模板(GPT-Image-2 / NanoBanana / 高定 / 即梦)
把提示词拆成 5 个模块,缺一不可:
- 画面类型:character design sheet / character sheet / 设定图 / 角色设计
- 排版结构:核心:左 1/3 脸部特写 + 右 2/3 三全身(社区严格比例)
- 人物本体:年龄/性别/身材量化(8头身 / 160cm)+ 姿态(A-pose)
- 造型细节:发型/发色/发饰/服装/配饰/鞋 + 服饰分层描述(如"交领长袍+暗纹云绣+玉带吊坠")
- 光影背景:白底 + 平光无阴影 + masterpiece, best quality, 8K超清
标准模板(社区主流,可直接复制):
8K超清, masterpiece, best quality, 16:9横版, 纯白背景, 平光无阴影, character sheet, masterpiece, best quality,
画面布局:左侧1/3为面部特写(发丝级细节),右侧2/3并排正面、侧面、背面全身站姿视图,
角色描述:【性别/年龄/身材量化】,【五官/发型/发色+量化五官细节】,【服饰分层+配饰位置】,
一致性要求:同一角色,**8头身 / 172cm**,身高/肩宽/体态统一,服饰褶皱/配饰位置跨视角完全一致,无崩
负面提示词:nsfw, lowres, bad anatomy, text, error, missing fingers, blurry, distorted
视图指令关键:英文关键词 character sheet, front/side/back view, full body 强制布局
一致性 4 大技巧:
- 重复"同一角色""完全一致"关键词
- 量化身材(8头身/172cm)
- 服饰分层描述(领+纹+饰 三个层次描述)
- 统一 seed 系列锁风格
避坑要点:
- 单图"四等分 panels"在 Z-Image 下不稳定(画 5-7 个),严格 left 1/3 + right 2/3 比例控制力最强
- 避免"可爱"等模糊词,用"圆杏眼+齐刘海"客观细节
- 平光照明减少阴影干扰(特写必备)
- 3D 建模需加 "orthographic view"(正交视图)
- cfg=1 下否定词部分失效,但元素词/比例词有效
三、场景四视图(工业级方法论 · 2026-08-01 系统学习)
核心认知:一张场景图只是"固定角度/光线/景别的截面",让模型脑补其他角度只能猜。 → 场景四视图需要空间逻辑先行 + 多角度资产,不能靠"单图+文字"。
四视角标准(动画场景设计语义):①正面外观 ②背面外观 ③室内视角 ④鸟瞰俯视
工业级 5 招(社区共识):
- 俯视图锁定空间逻辑(核心):先生成俯视/平面图定义布局→所有视角共享空间基准
- 九宫格多角度:一张图 9 个角度
- 720° 全景图自由取景:宽幅全景→切段(空间逻辑天然一致)
- 360° 环绕截图
- 参考图控图(最强):Seedance/即梦/ComfyUI IPAdapter+ControlNet 基于俯视基准图生成各视角
prompt 要点:
- 俯视图:
top-down orthographic floor plan, bird eye view, building layout, rooms, entrances, clean line - 立面:
front/back exterior elevation view, architectural facade, straight-on - 室内:
interior view, room perspective, walls floor ceiling furniture - 一致性词:
consistent with the floor plan layout, same spatial logic - 负面词:
characters, people, furniture clutter, inconsistent layout
咱的落地:Z-Image 无参考图机制→单图 4 视角会自由发挥; 务实用"宽幅全景→切段"(空间逻辑一致)或进阶 ComfyUI SDXL+ControlNet-Union
四、AI 漫剧五步工业化流水线(CSDN 权威版)
剧本生成 → 视觉素材制作(角色/场景资产) → 动态化生成(图生视频) → 音频合成(配音/BGM) → 后期精修
对照咱苍耳管线:✅ 全对齐(剧本→分镜→资产→出图→LTX/Wan→拼接→声画装配)
五、ComfyUI 一致性实战
- IPAdapter = "图像提示词":告诉 AI 照着参考图画(身份/风格保持)
- 组合拳:ControlNet(构图) + IPAdapter(身份) + 固定 seed
- 注意:IPAdapter 分 SDXL/SD1.5 版本,必须匹配底模架构(咱 Z-Image 是 Kolors 系,SDXL 版 IPAdapter 不兼容)
六、分镜技巧(留存率骨架)
- 分镜是"骨架",决定观众留存率
- 七大要素:景别 / 运镜 / 视角 / 光影 / 构图 / 人物动作 / 环境动态
- 提示词公式:镜头语言 + 主体 + 场景 + 光影 + 情绪
七、咱的落地清单(已做/待做)
- ✅ Z-Image 三视图直出(五模块结构化 prompt 已内置)
- ✅ 场景四视图(2×2 网格:前/左/右/俯视)
- ⏳ 面部特写+三视图布局(16:9 游戏立绘风)— 可加
- ⏳ 资产库规范化(三视图→分镜统一引用)— 结合 skill 系统