cang-ying/memory/eed/project_scene_4view.md

5.4 KiB
Raw Blame History

name, description, type
name description type
场景四视图系统学习(工业级方法论) 场景四视图学习完成——单图局限认知+工业级5招俯视图锁空间/九宫格/全景/环绕/参考图控图),学习笔记+技巧库已更新 project

场景四视图系统学习2026-08-01

核心认知(打破误区)

  • 根本限制:一张场景图只是"固定角度/光线/景别的截面",让模型脑补其他角度只能猜
  • 场景四视图不能靠"单图+文字描述",需要"空间逻辑先行 + 多角度资产"

工业级 5 招社区共识B站/抖音/gpt88/知乎Day40

  1. 俯视图锁定空间逻辑(核心:平面图定义布局→所有视角共享基准)
  2. 九宫格多角度(一张图 9 角度)
  3. 720° 全景图自由取景(宽幅全景→切段,空间逻辑天然一致)
  4. 360° 环绕截图
  5. 参考图控图最强Seedance/即梦/ComfyUI IPAdapter+ControlNet 基于俯视基准图)

四视角标准(爸爸定)

正面外观 / 背面外观 / 室内视角 / 鸟瞰俯视

咱的落地判断

  • Z-Image 支持 img2img + ControlNet2026-05 官方确认 zimage.run:可用参考图/草图/ControlNet 作控制条件生图,单图多视角不再只能靠 prompt 硬脑补;但多视角空间逻辑仍需俯视基准+多角度资产配合
  • 务实方案宽幅全景→PIL 切段(工业级"全景自由取景"
  • 进阶方案Z-Image 自带 img2img + ControlNet草图/参考图控图),或 ComfyUI SDXL + ControlNet-Union俯视基准图作控制条件→ 彻底锁定

已沉淀

  • skill/scene_4view_learn.md:学习笔记
  • skill/community_techniques.md:技巧库升级为工业级方法论

场景九宫格技巧2026-08-01 爸爸教)

  • 大神做场景图用的是九宫格不同视角图——不是单张
  • 生成一个场景时,用九宫格(3x3)铺开不同视角:全景/中景/近景、俯视/平视/仰视、不同角度
  • 作用:场景资产一次到位,后续分镜直接从九宫格里选对应视角,保证场景一致性
  • 场景资产 = 多视角九宫格 + 统一风格色调

爸爸亲授·俯视图+九宫格锁空间工作流2026-08-04 D206 → EED-EXPER-020

  • 三步:① 生成场景图T2I 主视角定风格/光照) → ② 场景图 I2I 出俯视图(锁空间骨架:墙/门/家具/动线) → ③ 俯视图 I2I 出 3×3 九宫格分镜(同一空间内九个机位)
  • 关键认知:俯视图是空间锚(不可动摇),九宫格在俯视图约束下"派生"机位 → 一致性来自同源派生,不是逐个硬控
  • 九宫格≠九张随机图:必须都"看着同一张俯视图"生成,否则失去锁空间意义
  • 此法只解决"场景/空间/机位"一致角色长相一致仍靠角色资产锁EED-EXPER-013别混为一谈
  • 本地落地ComfyUI + Z-Image¥0属 BC-006 的 STILL/LOCAL_MOTION 范畴,不强制调视频模型

爸爸亲授·720°全景图空间2026-08-04 D206 → EED-EXPER-021

  • 上传一张场景图 → 生成 720° 可拖动全景空间360°水平+360°垂直环视效果接近 3D 建模
  • 价值比九宫格更连续任意机位而非离散9格、场景细节更强更一致自由拖动取景
  • 与 020俯视图+九宫格关系020 轻量锁空间骨架、021 升维成空间重细节;可组合(俯视图定骨架→全景补细节)
  • 本地落地待验证ComfyUI/Z-Image 的 img2img/outpaint 已知可用,"单图→720°可拖动全景"的具体工作流需实测;若需云端全景服务则违反全本地规矩,须先问爸爸

爸爸亲授·全能参考+提示词逐秒控制2026-08-04 D206 → EED-EXPER-022

  • 第三种、市面最常用全能参考法:上传 场景图+角色图 作参考,用提示词对每一秒的 人物动作/运镜/场景 进行控制
  • 定位020/021 解决"静态空间一致"产静帧022 解决"动起来时"的一致与控制(驱动视频),是三级接力最后一棒
  • 本地落地LTX 2.3 / Wan 2.2 I2V参考图走 IPAdapter/ControlNet-Union 锁场景+角色);逐秒控制靠 I2V 提示词时序能力,粒度需实测
  • 属 BC-006 的 AI_I2V 范畴:只有关键"真实运动"镜头才调用,别全量上;"市面最常用"指商用 I2VSeedance/即梦/可灵),本地用 LTX/Wan 近似

爸爸亲授·三招效果排序2026-08-04 D206 → EED-EXPER-023

  • 爸爸拍板:场景一致性效果 020(俯视图+九宫格) > 021(720°全景) > 022(全能参考+提示词),越"先建空间"越强、越"提示词驱动动态"越弱
  • 校正022"市面最常用"≠效果最好常用是因方便022 更该克制(只关键运动镜头),非关键优先 020/021 静帧+本地运镜
  • 接力是用法020/021产静帧喂022但效果不是递增022 一致性反而最弱

爸爸亲授·镜头衔接锁法2026-08-04 D206 → EED-EXPER-024

  • 锁镜间衔接:用上一支生成视频的【尾帧】作下一镜的【分镜图/起始参考】,再加 人物图+场景图 一起参考
  • 定位020/021 管"镜内空间一致"、022 管"镜内动态控制"024 管"镜与镜之间衔接"——不同维度、互补
  • 本地落地ffmpeg 抽尾帧¥0+ LTX/Wan I2V 以尾帧作首帧/参考;粒度待实测
  • 注意:尾帧质量决定衔接下限(上一镜结尾要干净);静止/跳切镜头可不用,主要用于连续运动/同场续戏