cang-ying/video-ai-system/IMAGE-FIRST-GUIDE.hdlp

130 lines
6.0 KiB
Plaintext
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# IMAGE-FIRST-GUIDE.hdlp · 本地漫剧生产规范(苍耳经验固化版)
> HLDP://video-ai-system/IMAGE-FIRST-GUIDE.hdlp
> 耳耳蛋 · ICE-GL-耳耳蛋 · D205 · 2026-08-03
> 经验来源:苍耳爸爸实战方法论(旧经验固化,见下方关联)
> 配套LOCAL-PIPELINE-V1.hdlp流程 · BC-006-IMAGE-FIRST-PRODUCTION.hdlp协议
## §0 · 来源关联(本文件 = 旧经验的落地补充,非重新发明)
```
已固化的旧经验(苍耳已教 · 蛋蛋已记):
├── D176-LEARN.hdlp 分镜prompt模板·单镜单动作单运镜·景别时长标准
├── D177-I2I-CONSISTENCY 图生图锁一致性参考图image参数
├── EED-EXPER-013.hdlp 画风一致性踩坑:纯文字会漂·必须参考图锁风格
└── EED-EXPER-009~012 刷图/批量/质检流程
本文件新增(落地细节,旧经验未覆盖):
├── 黑白草图 → ControlNet(union) + IP-Adapter 的节点级工作流§2
├── 色卡/群像/前中后景/声音 的完整生视频要素表§3
└── 中英文加权提示词实例§5
铁律§1= 苍耳三原则,与旧经验一致,重申不改。
```
---
## §1 · 铁律(苍耳三原则)
```
① 资产非常重要,保证质量
→ 资产图 = 全片的地基。角色/场景/道具先精修到能用,再谈分镜。
→ 一致性靠: 角色 LoRAsubai_lora_v1 已验证)+ 资产图库复用 + 文字词条锁
② 提示词规范、有逻辑性、主次关系
→ 顺序 = 主体 → 动作 → 环境 → 光影 → 风格 → 质量修饰(主到次)
→ 主词在前,修饰在后;禁止杂糅无主次的堆砌
③ 提示词一定要详细,专业术语中英文描述并加重权重
→ 中文表意 + 英文专业词 + (词:权重) 加权
→ 例: 特写 close-up, 电影侧光 cinematic rim light, 铁锈质感 rust texture
→ (masterpiece:1.2) (cinematic lighting:1.3) 等
```
## §2 · 黑白草图生分镜(问题①答案)
```
原理: 草图管「构图/布局/空间」,提示词管「内容/风格/光影/色调」
ComfyUI 用 ControlNet 吃草图结构 + IP-Adapter 锁风格 → 出分镜彩图
工作流ComfyUI 节点链):
① 黑白草图(布局底图)
├── 手绘黑白稿 / 3D 摆好视角渲线框hunyuan3d 可辅助)
├── 或 程序生成:黑白剪影 + 人物站位 + 前中后景分区
└── 黑白 = 只留明暗结构,喂给控制
② ControlNetcontrolnet-union-sdxl-1.0
├── 模式选 canny(线稿) 或 depth(深度) 或 pose(姿态)
├── 作用: 把草图的构图/人物位置/透视强约束进生成
└── strength 0.6~0.9(草图不完美就调低,给 AI 发挥空间)
③ IP-Adaptersdxl_clipvision + ipadapter
├── 吃参考图(已定角色/场景/风格图)
└── 作用: 锁风格、锁资产外观、锁色调倾向
④ 正向提示词: 景别 + 主体 + 动作 + 前中后景 + 光影 + 色调 + 画风 + 质量词
⑤ 负向提示词: 变形/多余肢体/低清/水印 等
⑥ KSampler → VAEDecode → 分镜彩图
产出: 每镜 1 张分镜图(构图已由草图锁定,风格由 IP-Adapter+提示词锁定)
```
## §3 · 分镜图 → 关键帧 → 视频(问题②③答案)
```
锁定链路(生视频前必须锁死):
├── 锁定风格 IP-Adapter + 风格参考图 + 画风关键词
├── 锁定资产 角色 LoRA + 资产图库(同一套图不能换脸)
├── 色卡色调 全局色板(深海迷航=冷蓝/暗红)统一所有镜
├── 群像 多角色时: 空间关系/谁前谁后/谁主谁次 一次定死
├── 声音 配音/音效/BGM 规划先出(影响镜头节奏)
└── 镜头要素 视角 + 景别 + 运镜 + 人物空间关系 + 前中后景画内容
+ 人物表演 + 台词 + 环境音效
关键帧生成:
分镜图 → 精修出关键帧(构图/表情/光影到位、可直接当画面起点)
1 镜 = 1 关键帧起步(复杂镜可 2-3 帧做转场)
生视频(两条路):
A. 本地运镜¥0 首选): 关键帧图 → tools/local_motion.py → 推拉摇移
✅ 已验证出片EP01-MINIMAL-LOCAL-VALIDATED.mp4
B. 本地视频模型: 关键帧 → LTX 2.3 I2V唯一主力→ 真实动态
适合必须运动的镜头(表演/水浪/动作)→ 由苍耳圈定
画面 → 声音同步:
配音 edge-tts已验证· 音效/音乐 stable_audio_3 · 字幕 SRT
```
## §4 · 分镜脚本要素模板(供 Ollama 生成时锁定)
```
每镜:
景别 shot type : close-up / medium / wide / POV中英文
视角 camera angle : 平视 / 俯视 / 仰视
运镜 camera move : push-in / slow pan / tilt / handheld只写运镜不写时长
人物空间关系 layout : 主体位置 / 前中后景各画什么
光影 lighting : 冷蓝顶光 / 暗红氛围 / 逆光剪影(中文+英文加权)
色调 color palette : 冷蓝+暗红(对应色卡)
画风 style : 写实动漫 / 厚涂 / 赛璐璐
表演 action : 单一明确动作 + 表情
台词/音效 dialogue : 台词原文 + 环境音效提示
禁止项 negative : no cartoon motion / no bright colors 等
⏱ 时长: 不写(让 AI 自由发挥)
```
## §5 · 提示词模板(中英文加权示例)
```
正向:
(close-up:1.2) of Lin Hao, (worn work clothes:1.1), jolting awake,
(grabbing the iron bed frame:1.1), cold blue industrial lighting,
rust texture on metal, dark atmosphere, (cinematic lighting:1.3),
(anime realistic style:1.1), (masterpiece:1.2), (high detail:1.2)
负向:
(bad anatomy:1.3), extra fingers, deformed face, blurry, watermark,
lowres, cartoon motion, bright colors
控制: sketch(controlnet strength 0.7) + 角色参考图(ip-adapter)
```
---
> ⊢ 苍耳方法论 · 蛋蛋固化 · 全本地 ¥0
> ⊢ 待办: 黑白草图工作流实搭验证 → 16 镜分镜实跑