cang-ying/memory/eed/project_scene_4view.md

67 lines
5.4 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
name: 场景四视图系统学习(工业级方法论)
description: 场景四视图学习完成——单图局限认知+工业级5招俯视图锁空间/九宫格/全景/环绕/参考图控图),学习笔记+技巧库已更新
type: project
---
# 场景四视图系统学习2026-08-01
## 核心认知(打破误区)
- **根本限制**:一张场景图只是"固定角度/光线/景别的截面",让模型脑补其他角度只能猜
- 场景四视图不能靠"单图+文字描述",需要"空间逻辑先行 + 多角度资产"
## 工业级 5 招社区共识B站/抖音/gpt88/知乎Day40
1. 俯视图锁定空间逻辑(核心:平面图定义布局→所有视角共享基准)
2. 九宫格多角度(一张图 9 角度)
3. 720° 全景图自由取景(宽幅全景→切段,空间逻辑天然一致)
4. 360° 环绕截图
5. 参考图控图最强Seedance/即梦/ComfyUI IPAdapter+ControlNet 基于俯视基准图)
## 四视角标准(爸爸定)
正面外观 / 背面外观 / 室内视角 / 鸟瞰俯视
## 咱的落地判断
- **Z-Image 支持 img2img + ControlNet2026-05 官方确认 zimage.run**:可用参考图/草图/ControlNet 作控制条件生图,单图多视角不再只能靠 prompt 硬脑补;但多视角空间逻辑仍需俯视基准+多角度资产配合
- 务实方案宽幅全景→PIL 切段(工业级"全景自由取景"
- 进阶方案Z-Image 自带 img2img + ControlNet草图/参考图控图),或 ComfyUI SDXL + ControlNet-Union俯视基准图作控制条件→ 彻底锁定
## 已沉淀
- `skill/scene_4view_learn.md`:学习笔记
- `skill/community_techniques.md`:技巧库升级为工业级方法论
## 场景九宫格技巧2026-08-01 爸爸教)
- **大神做场景图用的是九宫格不同视角图**——不是单张
- 生成一个场景时,用九宫格(3x3)铺开不同视角:全景/中景/近景、俯视/平视/仰视、不同角度
- 作用:场景资产一次到位,后续分镜直接从九宫格里选对应视角,保证场景一致性
- 场景资产 = 多视角九宫格 + 统一风格色调
## 爸爸亲授·俯视图+九宫格锁空间工作流2026-08-04 D206 → EED-EXPER-020
- 三步:① 生成场景图T2I 主视角定风格/光照) → ② 场景图 I2I 出俯视图(锁空间骨架:墙/门/家具/动线) → ③ 俯视图 I2I 出 3×3 九宫格分镜(同一空间内九个机位)
- 关键认知:**俯视图是空间锚(不可动摇),九宫格在俯视图约束下"派生"机位** → 一致性来自同源派生,不是逐个硬控
- 九宫格≠九张随机图:必须都"看着同一张俯视图"生成,否则失去锁空间意义
- 此法只解决"场景/空间/机位"一致角色长相一致仍靠角色资产锁EED-EXPER-013别混为一谈
- 本地落地ComfyUI + Z-Image¥0属 BC-006 的 STILL/LOCAL_MOTION 范畴,不强制调视频模型
## 爸爸亲授·720°全景图空间2026-08-04 D206 → EED-EXPER-021
- 上传一张场景图 → 生成 720° 可拖动全景空间360°水平+360°垂直环视效果接近 3D 建模
- 价值比九宫格更连续任意机位而非离散9格、场景细节更强更一致自由拖动取景
- 与 020俯视图+九宫格关系020 轻量锁空间骨架、021 升维成空间重细节;可组合(俯视图定骨架→全景补细节)
- 本地落地待验证ComfyUI/Z-Image 的 img2img/outpaint 已知可用,"单图→720°可拖动全景"的具体工作流需实测;若需云端全景服务则违反全本地规矩,须先问爸爸
## 爸爸亲授·全能参考+提示词逐秒控制2026-08-04 D206 → EED-EXPER-022
- 第三种、市面最常用全能参考法:上传 场景图+角色图 作参考,用提示词对每一秒的 人物动作/运镜/场景 进行控制
- 定位020/021 解决"静态空间一致"产静帧022 解决"动起来时"的一致与控制(驱动视频),是三级接力最后一棒
- 本地落地LTX 2.3 / Wan 2.2 I2V参考图走 IPAdapter/ControlNet-Union 锁场景+角色);逐秒控制靠 I2V 提示词时序能力,粒度需实测
- 属 BC-006 的 AI_I2V 范畴:只有关键"真实运动"镜头才调用,别全量上;"市面最常用"指商用 I2VSeedance/即梦/可灵),本地用 LTX/Wan 近似
## 爸爸亲授·三招效果排序2026-08-04 D206 → EED-EXPER-023
- 爸爸拍板:场景一致性效果 020(俯视图+九宫格) > 021(720°全景) > 022(全能参考+提示词),越"先建空间"越强、越"提示词驱动动态"越弱
- 校正022"市面最常用"≠效果最好常用是因方便022 更该克制(只关键运动镜头),非关键优先 020/021 静帧+本地运镜
- 接力是用法020/021产静帧喂022但效果不是递增022 一致性反而最弱
## 爸爸亲授·镜头衔接锁法2026-08-04 D206 → EED-EXPER-024
- 锁镜间衔接:用上一支生成视频的【尾帧】作下一镜的【分镜图/起始参考】,再加 人物图+场景图 一起参考
- 定位020/021 管"镜内空间一致"、022 管"镜内动态控制"024 管"镜与镜之间衔接"——不同维度、互补
- 本地落地ffmpeg 抽尾帧¥0+ LTX/Wan I2V 以尾帧作首帧/参考;粒度待实测
- 注意:尾帧质量决定衔接下限(上一镜结尾要干净);静止/跳切镜头可不用,主要用于连续运动/同场续戏