# 剧本与分镜规范 (Script & Storyboard) ## 视频格式配置(必填) > 在开始创作前,请先确定视频格式。这将影响每场戏的时长和内容密度。 | 配置项 | 选项 | 当前设定 | |--------|------|----------| | 视频类型 | 单集 / 连续剧 | (请填写) | | 视频长度 | 短视频(1-3分钟)/ 中视频(5-15分钟)/ 长视频(20分钟+) | (请填写) | | 单场时长 | 短视频:15-30秒/场;中视频:30-60秒/场;长视频:1-3分钟/场 | (请填写) | | 每集场次数 | 建议:短视频3-5场;中视频5-10场;长视频10-20场 | (请填写) | **示例配置**: ``` 视频类型:连续剧 视频长度:短视频(2-3分钟/集) 单场时长:20-30秒 每集场次数:4-6场 ``` --- ## Seedance 2.0 Prompt 优化指南 > 基于 Seedance 2.0 论文核心分析,以下是针对音视频联合生成的最优 Prompt 策略。 ### Prompt 结构框架(必填六要素) ``` 【主体描述】+ 【动作/表演细节】+ 【环境/氛围】+ 【镜头语言】+ 【音频/声音设计】+ 【风格/影调】 ``` ### 各维度优化技巧 #### 1. 主体描述(利用强语义理解) - ✅ **具体明确**:"一位穿着暗红色羊绒大衣的40岁女性" 优于 "一个女人" - ✅ **多模态细节**:同时描述视觉外观和声音特征 ``` 例:"一位嗓音略带沙哑的中年男性,穿着磨损的皮夹克,说话时带有明显的四川方言口音" ``` #### 2. 动作与表演(避免慢动作陷阱) - ⚠️ **避免**:仅写 "缓慢行走"(模型可能用慢动作糊弄) - ✅ **推荐**:明确动作意图和情绪强度 ``` 例:"她快步穿过人群,肩膀微微颤抖,表现出压抑的愤怒,步伐急促但保持平衡" ``` #### 3. 镜头控制(利用原生运镜能力) | 运镜类型 | Prompt 写法 | |---------|------------| | 希区柯克变焦 | "Dolly zoom effect: camera pulls back while zooming in" | | 环绕镜头 | "360-degree orbital shot around the subject" | | 跟踪镜头 | "Handheld tracking shot following the character" | | 长镜头 | "Continuous long take without cuts" | | 特写转场 | "Push-in to extreme close-up on eyes" | | 推镜头 | "Slow push-in from medium shot to close-up" | | 拉镜头 | "Pull-back shot revealing the environment" | #### 4. 音频设计(核心差异化能力) **必须显式描述音频**,因为模型是音视频联合生成: ``` 【人声细节】 - 语言:"普通话/粤语/四川话/英语" - 音色:"清脆的少女音/浑厚的男低音/沙哑的烟嗓" - 情绪语调:"颤抖的哭腔/抑扬顿挫的朗诵/冷漠的平淡语气" - 内容:直接写出台词或描述说话内容 【环境音效】 - "海浪拍打礁石的声音,海鸥远处鸣叫" - "雨声从轻柔转为倾盆,配合雷声渐近" 【音乐氛围】 - "低沉的大提琴独奏,逐渐加入弦乐,营造悬疑感" ``` #### 5. 风格与影调 - ✅ 描述具体视觉特征而非空泛词 - ❌ 避免:"高质量"、"4K"、"精美" - ✅ 推荐:"冷色调,高对比度,电影级调色" ### 中文场景特化技巧 1. **方言使用**:直接指定 ``` "角色用上海话交谈,语调软糯,带有老派弄堂口音" ``` 2. **文化元素**:模型对东方表演有理解 ``` "京剧旦角,兰花指手势,眼波流转,念白带有韵白节奏" "武侠风格,抱拳行礼,衣袂飘动,配乐是古筝与笛子" ``` 3. **短剧节奏**:指定快节奏叙事 ``` "短剧风格,快节奏剪辑感,每3秒一个情绪转折,配合紧张的音乐节拍" ``` --- ## 场次文件格式标准 ### 文件结构(Seedance 2.0 优化版) ```markdown 【主体描述】 角色外观、服装、体型、年龄等具体描述 声音特征:音色、语调、方言口音 【动作与表演】 具体动作描述,包含情绪强度和动作意图 避免模糊描述,明确动作节奏 【环境与氛围】 场景地点、时间、天气、光线 环境氛围关键词 【镜头语言】 运镜方式:推/拉/摇/移/跟/升降 景别:远景/全景/中景/近景/特写 特殊效果:慢动作/快进/定格 【音频设计】 人声:语言、音色、语调、台词内容 环境音:具体的环境声音描述 音乐:背景音乐风格和情绪 【风格影调】 整体视觉风格 色调和光影特点 参考作品风格(可选) 【剧本内容】 对白和动作描写 ``` --- ## 文件命名规范(简体中文) > **重要**:所有目录和文件名必须使用简体中文,便于用户识别和管理。 **剧集目录命名**:`第{集数}集_{中文标题}` **场次文件命名**:`场次{序号}.txt` **封面图片命名**:`场次{序号}_封面.png` 或 `场次{序号}_封面.jpg` **示例目录结构**: ``` 输出/ ├── 项目配置.md # 视频格式配置 ├── 全局上下文.txt # 角色设定、世界观 ├── 第1集_系统觉醒/ │ ├── 剧本.md # 完整剧本 │ ├── 场次1.txt # 可粘贴到视频生成工具 │ ├── 场次1_封面.png # 场次1封面图片 │ ├── 场次2.txt │ ├── 场次2_封面.png │ └── 上下文摘要.txt # 本集结尾状态 ├── 第2集_一剑开天门/ │ └── ... └── ... ``` --- ## 封面图片生成规范 > 每个场次视频都应有对应的封面图片,用于视频封面展示。 ### 封面图片要求 | 属性 | 要求 | |------|------| | 尺寸 | 1920x1080(横版)或 1080x1920(竖版) | | 格式 | PNG 或 JPG | | 风格 | 与视频视觉风格一致 | ### 封面 Prompt 模板 ``` 【封面图片提示词】 风格:[视觉风格关键词] 主体:[主要角色/物体] 动作:[关键姿势/表情] 场景:[背景环境] 光线:[光照效果] 构图:[镜头角度/构图方式] ``` --- ## 完整示例 Prompt ### 示例1:修仙玄幻场景 ```markdown 【主体描述】 沈安在:白衣中年男子,约40岁,两鬓霜白,面容俊俏,身材修长。 声音特征:沉稳有力的男中音,说话时带有仙风道骨的从容感。 【动作与表演】 双手负于身后,从高处跃下,落地时衣袂飘动,表情从慵懒转为严肃。 步伐稳健,眼神锐利地盯着前方,表现出高人的威严感。 【环境与氛围】 青云峰山道,清晨,阳光透过云层洒落,山间云雾缭绕。 氛围:仙侠意境,空灵飘逸。 【镜头语言】 运镜:从高处俯拍沈安在跃下,跟随下落,落地时切换到低角度仰拍。 景别:全景 → 中景 → 近景。 节奏:落地瞬间有轻微的慢动作效果。 【音频设计】 人声:沈安在大喝"站住!",声音在山谷中回荡。 环境音:山风吹过树林的沙沙声,远处鸟鸣。 音乐:古筝急促拨动,营造紧张感,落地时音乐骤停。 【风格影调】 xianxia, chinese fantasy, cinematic lighting, ethereal atmosphere. 色调:冷色调为主,晨光带来暖色点缀。 参考:《琅琊榜》《陈情令》的仙侠视觉风格。 【剧本内容】 沈安在落地,双手负于身后,故作高深地看着慕容天。 沈安在:(冷淡) 你要去哪? 慕容天低头,不敢直视沈安在。 ``` ### 示例2:情绪特写场景 ```markdown 【主体描述】 慕容天:少年身形,约16岁,穿着朴素道袍,背着包袱。 声音特征:清亮的少年音,说话时带着压抑的哭腔。 【动作与表演】 停下脚步,回头望向青云峰顶,眼眶泛红,嘴角苦笑。 肩膀微微颤抖,表现出压抑的悲伤和不甘。 【环境与氛围】 青云峰山道,上午,阳光透过树叶洒落斑驳光影。 氛围:落寞、决绝。 【镜头语言】 运镜:固定机位,缓慢推近到面部特写。 景别:远景 → 中景 → 面部特写。 特殊:最后定格在眼睛的极端特写,捕捉泪光。 【音频设计】 人声:慕容天自语,声音低沉颤抖。 环境音:山间寂静,偶尔有风吹树叶声。 音乐:低沉的大提琴独奏,逐渐加入弦乐,营造悲伤感。 【风格影调】 xianxia, chinese fantasy, melancholic, cinematic. 色调:偏冷的蓝色调,阳光带来微弱暖色。 参考:《卧虎藏龙》的情感戏视觉风格。 【剧本内容】 慕容天:(自语) 三年了……我还是无法突破筑基期。 慕容天停下脚步,回头望向青云峰顶。 慕容天:(苦笑) 也许离开才是最好的选择。 ``` --- ## 避坑指南 | ❌ 避免 | ✅ 替代 | |--------|--------| | "高质量"、"4K"、"精美" 等空泛词 | 具体描述材质、光影、运镜方式 | | 仅描述视觉,忽略音频 | 音视频联合描述,至少指定环境音 | | 过度限制(指定每秒的动作) | 给模型创意空间,描述意图和情绪 | | 长句堆砌 | 用分段清晰分隔不同维度 | | "像XX电影"(模型可能不理解) | 描述该电影的具体视觉特征 | | "缓慢行走"等模糊动作 | 明确动作意图、情绪强度和节奏 | --- ## 进阶设定(可选) ### 章节摘要模板 > 每章完成后记录核心信息,帮助 AI 记住前文。 ```markdown ## 第X章摘要 - **核心事件**:(一句话概括) - **关键决策**:(角色做出的重要决定) - **角色登场**:(本章出现的角色) - **伏笔埋设**:(埋下的伏笔ID) - **伏笔揭示**:(揭示的伏笔ID) - **角色状态变化**:(位置、情绪、关系等变化) - **预计下章内容**:(简要提示) ``` ### 场次时长估算指南 | 视频类型 | 对白密度 | 动作密度 | 建议时长 | |----------|----------|----------|----------| | 短视频 | 少(1-3句) | 多 | 15-20秒 | | 短视频 | 多(5-10句) | 少 | 20-30秒 | | 中视频 | 少 | 多 | 30-45秒 | | 中视频 | 多 | 少 | 45-60秒 | | 长视频 | 少 | 多 | 1-2分钟 | | 长视频 | 多 | 少 | 2-3分钟 |