guanghulab/video-ai-system/config/VOICE-LIPSYNC-ROUTER.hdlp

157 lines
2.5 KiB
Plaintext
Raw Normal View History

2026-06-23 22:02:51 +08:00
# 视频AI系统 · 角色对白/口型路由
> HLDP://video-ai-system/config/VOICE-LIPSYNC-ROUTER
> 类型: Voice/LipSync能力路由 · D143c
> 建立: 2026-06-23
> 铸渊 ICE-GL-ZY001
---
## 裁决
```
旁白不可替代角色对白。
不可验证的模型自带音轨不可直接批准为角色对白。
人物嘴巴可见且正在说台词时必须有独立Voice/LipSync链路。
```
---
## 本地可用状态
已检查:
```
/Users/bingshuolingdianyuanhe/Documents/guanghulab-local-secrets/video-ai-system.env
```
当前存在:
```
JIMENG_API_KEY: SET
JIMENG_BASE_URL: SET
JIMENG_MODEL: SET
```
当前缺失:
```
豆包语音/TTS专用配置: MISSING
视频改口型/LipSync专用配置: MISSING
本地Wav2Lip工具: MISSING
```
---
## 官方能力方向
### Route V1 · 豆包语音TTS
用途:
```
把原文台词生成角色对白音频。
```
官方信息:
```
火山引擎豆包语音支持语音合成TTS。
豆包语音合成模型2.0按字符计费官方计费页显示3元/万字符。
```
来源:
```
https://www.volcengine.com/docs/6561/1329505
https://www.volcengine.com/docs/6561/2528925
https://www.volcengine.com/docs/6561/1359370
```
状态:
```
NEED_API_CONFIG
```
### Route L1 · 视频改口型
用途:
```
输入单人口播视频 + 原文对白音频。
输出嘴型按音频修改后的视频。
```
官方信息:
```
火山智能视觉/图像生成大模型文档中有“视频改口型”能力描述。
该能力适合TEST-LINE-001这种正脸/中近景角色说台词镜头。
```
来源:
```
https://www.volcengine.com/docs/86081/1804521
https://www.volcengine.com/docs/85128/1462623
```
状态:
```
NEED_API_CONFIG_AND_ADAPTER
```
### Route S1 · Seedance音画同步模型测试
用途:
```
验证Seedance音画同步模型能否直接生成角色说台词镜头。
```
官方信息:
```
Seedance-1.5-pro提示词指南描述其面向音画同步创作需求。
```
来源:
```
https://www.volcengine.com/docs/82379/2168087
```
状态:
```
NEED_MODEL_ACCESS_TEST
```
---
## EP01执行顺序
```
1. 保留RUN-001火山Seedance画面测试结果作为苏白开口表演底片候选。
2. 补VOICE-CHAR-003真实角色对白音频不再使用旁白。
3. 对RUN-001或新生成的苏白说话底片执行LipSync。
4. 通过后再进入E1-SHOT03正片生产。
```
---
## 验收标准
```
原文逐字准确。
情绪为苏白“大声·自信”。
不是旁白腔。
不是读剧本腔。
嘴型与音频基本同步。
画面人物不换脸。
不因改口型导致画质糊、脸变形、牙齿异常。
```