Files
ai/docs/chatgpt/COURSE_SUMMARY_AI_SHORT_DRAMA.md

294 lines
8.3 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# AIGC仿真人剧课程拆解总结 V1
> 说明:本版基于已上传 6 个课程录屏的视频画面、目录、课件页和操作演示进行拆解,重点不是复述课程,而是提炼为你当前“AI仿真人短剧自动化流水线”可落地的系统规则。
## 0. 总体判断
这套课不是单纯工具注册教学,核心价值在于把“人工影视制作流程”拆成可迁移到系统的几个节点:
```text
剧本/小说
剧本改编
分镜头脚本
角色/场景/道具美术设计
图片/关键帧生成
视频提示词
视频模型生成
剪辑、音乐、音效、台词
成片
```
对你当前系统最有价值的部分不是“用哪个工具”,而是:
- 分镜规划方法
- 角色一致性方法
- Prompt结构化方法
- 镜头语言、运镜、动作、音效的拆分方法
- 手工流程如何转为自动化规则
你的系统架构已经具备:Story Bible、Character Library、Actor Profile、Actor Lock、Prompt Builder、AI Router、FFmpeg、Provider 抽象、质检和成本日志。课程应作为“导演经验库”和“Prompt模板库”的来源,而不是推倒重构系统。
---
## 1. 视频 1:整体流程与AIGC影视生产体系
### 主要内容
该视频展示完整 AIGC 影视/仿真人剧生产流程,从前期策划、剧本、角色、美术、视频生成到音频和后期。课程强调:
- 不能直接用一句剧情生成完整视频。
- 必须拆成前期策划、前期美术、中期分镜与视频、音频制作、后期剪辑。
- 各环节可以使用不同 AI 工具,而不是只依赖一个平台。
### 对系统的启发
你的系统应该继续保持多模块流水线:
```text
Story Bible
Episode Plan
Script
Shot Planner
Character/Scene/Asset Reference
Prompt Builder
Provider Router
QA
FFmpeg
```
### 可落地规则
1. 不允许“剧本直接进入视频生成”。
2. 每个镜头必须具备:角色、动作、场景、景别、运镜、情绪、时长、音效提示、负面约束。
3. 每个镜头只完成一个主要动作,避免一个 6 秒镜头塞太多剧情。
4. 特效镜头、人物特写、首次登场、高潮反转应被标记为高价值镜头。
---
## 2. 视频 2:神兽、道具、场景设计
### 主要内容
课程演示了神兽、道具、场景的设计思路,包括从文字描述到图像生成,再到素材复用。画面中涉及:
- 神兽形象生成与调整
- 道具细节,例如服饰、挂饰、玉佩等
- 场景图生成,例如中式书房/医馆/古风室内空间
- 参考图与一致性控制
### 对系统的启发
你当前系统不应只管理角色,还应该有资产库:
```text
Asset Library
├─ character_assets
├─ costume_assets
├─ prop_assets
├─ location_assets
├─ vehicle_assets
├─ vfx_assets
└─ sound_assets
```
对于都市短剧,最先沉淀这些资产:
- 豪车:劳斯莱斯、迈巴赫、商务车
- 酒店宴会厅
- 咖啡厅
- 集团大楼
- 总裁办公室
- 会议室
- 银行VIP室
- 黑金卡
- 股权文件
- 奢侈品/婚戒/合同
### 可落地规则
1. 道具必须单独建档,不能只在 prompt 里临时描述。
2. 关键道具需要绑定特写镜头模板,例如黑卡、合同、余额截图、婚戒。
3. 场景图应优先复用,避免每集重新生成导致风格漂移。
4. 场景资产应记录风格:现代豪华、都市夜景、商务冷色、温暖咖啡厅、压迫感会议室等。
---
## 3. 视频 3Seedance/视频生成实操与一致性优化
### 主要内容
课程展示视频模型实操,重点包含:
- 视频提示词如何保持角色不变
- Seedance 2.0 的主力使用方式
- 人物动作、镜头运动、视频延长、排队时间等问题
- 部分镜头使用参考图和多图保持一致性
- 真人无法上传/国内外工具限制的处理
### 对系统的启发
视频模型不适合一次生成完整剧情,应该按镜头生成。
```text
1集 60秒
≈ 10个 5~6秒镜头
```
你现有的 action beat 拆段和 clip 拼接方向是对的。
### 可落地规则
1. 默认每个镜头 5~6 秒。
2. 超过 8 秒的镜头优先拆为 2 个 action beats。
3. 动作复杂度 action_score > 5 时,必须启用高质量 provider 或降低动作难度。
4. 同一角色连续镜头必须使用 anchor image / actor profile / reference asset。
5. 生成失败时优先修改 prompt,而不是盲目重试同一 prompt。
6. 如果模型排队时间过长,应允许 Router 自动切换 fallback Provider。
---
## 4. 视频 4:视频提示词编写技巧
### 主要内容
课程展示了从文本/剧情到视频提示词的写法。画面中明显体现出:
- 先让 AI 帮助拆镜头。
- 再把镜头转成可用于视频模型的提示词。
- 提示词要包含镜头、动作、画面、情绪、场景、角色一致性。
- 会使用角色六视图/定妆图辅助人物稳定。
- 后续进入剪辑流程。
### 对系统的启发
这是最适合转化为 Prompt Builder V2 的部分。Prompt 不是一句话,而是结构化对象:
```json
{
"character": "顾辰",
"action": "从酒店门口走出,停下,回头看向镜头",
"scene": "雨夜,高端酒店门口",
"camera_shot": "medium close-up",
"camera_move": "slow dolly in",
"emotion": "隐忍、失望、压抑",
"lighting": "cinematic night lighting",
"style": "vertical short drama, realistic",
"negative": "no face change, no outfit change, no extra characters"
}
```
### 可落地规则
1. Prompt Builder 必须支持:角色块、动作块、场景块、镜头块、光影块、情绪块、音效块、负面块。
2. Hailuo 专项 Prompt 应避免复杂连贯动作,强调“single main action”。
3. 正脸说话镜头如果没有 Lip Sync,应使用半侧脸、远景、反应镜头、背影镜头规避。
4. 每个 Provider 应有自己的 Prompt Profile。
---
## 5. 视频 5:人物设计全流程
### 主要内容
课程重点是前期美术和人物设计,内容包括:
- 角色核心设定
- 主视觉参考
- 服装、发型、气质
- 多视角人物图
- 使用图生图工具生成一致人物
- 人物动作图/动态参考
- 将人物图转视频
### 对系统的启发
你目前已经有 Character Library、ActorProfile、ActorLock。下一步不是重构,而是强化“角色定妆质量”和“一致性测试台”。
### 可落地规则
1. 每个主角必须有:正脸、侧脸、半身、全身、常服、正式服。
2. 不同剧情阶段可有不同 wardrobe,但必须显式绑定。
3. 角色首次出现必须生成或选择标准定妆图。
4. 角色一致性测试应独立于剧情,先生成 5 个动作镜头:走路、坐下、转头、打电话、上车。
5. 通过一致性测试后再进入正式短剧生成。
---
## 6. 视频 6:剧本创作、剧本改编与分镜思路
### 主要内容
课程展示了:
- 自创短篇剧本
- 小说/文本改写为分镜剧本
- AI辅助重写剧情
- 分集结构、人物关系、剧情摘要
- 将剧本拆成镜头文本
### 对系统的启发
你当前 scripts / storyboard_shots 的设计方向正确。需要强化的是:剧本阶段不直接追求视频化,而是产生“可拍性强”的镜头。
### 可落地规则
1. 每集应先生成“剧情摘要”和“爽点列表”。
2. 再生成“镜头列表”。
3. 每个镜头必须具备 shot_role:开场钩子、冲突、反应、反转、爽点、结尾悬念。
4. 每集前 3 秒必须是强钩子镜头。
5. 都市短剧优先选择:酒店、办公室、车内、街道、咖啡厅、银行、会议室等低成本场景。
6. 古装、战争、大规模群像、复杂打斗应暂缓。
---
## 7. 总结:课程对你系统的真正价值
### 不需要学的部分
- 工具注册
- 手工点击流程
- 基础剪映操作
- 平台充值
### 应该吸收的部分
- 分镜拆解方法
- 视频提示词结构
- 角色定妆流程
- 资产复用意识
- 6秒镜头化生产思路
- 角色一致性先测后用
- 高价值镜头和普通镜头分级
### 对现有系统的结论
你的代码架构已经超过课程本身的工具工作流。课程应该转化为:
```text
Prompt Library
Camera Rules
Emotion Rules
Scene Templates
Asset Library
Character Consistency Test
Provider Test Matrix
```
而不是再新增一堆基础功能。