提示词与多语种对白
好的提示词先说清楚发生什么,再说明怎么拍。把主体、动作、环境、风格、镜头和声音分开表达,比堆叠形容词更容易检查和修改。
基础结构
text
主体与引用 → 动作或事件 → 场景 → 视觉风格 → 相机 → 声音主体:谁在画面中,分别由哪张图片定义。
动作:可看见的动作和因果顺序,例如“先看信封,再抬眼看向对方”,而不是只有“非常震惊”。
场景:地点、时间、关键物件、光线及空间关系。
相机:景别、机位、主要运动;一次优先使用一种明确的运动。
声音:谁说什么、用什么语言和音色,是否有环境声、音效、音乐和字幕。
单镜头示例
text
@图片1 定义林晚的身份与服装,@图片2 定义夜间书店。
林晚站在柜台左侧,右手放下信封,停顿后看向画面右侧。
中近景,固定机位,暖色台灯照亮面部,背景保持安静。
林晚使用 @音频1 的音色,低声说中文:“你终于来了。”
保留纸张和衣料的轻微声音,不添加背景音乐和字幕。用时间段规划多个动作
Seedance 2.5 支持较长片段,可用时间段说明动作与切镜。例如 0–5 秒建立关系,5–10 秒人物开口,10–15 秒聆听者反应。时间标记是创作指导,仍需检查成片实际节奏。
先确保一句台词能够以自然语速说完,再安排沉默、转身和移动。不要把大量动作写在同一秒内,也不要同时要求“全程一镜到底”和多个硬切。
声音标记
指南中提供以下表达方式,可辅助区分声音任务:
| 类型 | 表达例子 |
|---|---|
| 音乐 | (轻柔的弦乐) |
| 音效 | <门锁轻响> |
| 对白 | {林晚:你终于来了。} |
| 字幕 | 【三年前】 |
这些是提示表达,不是强制编程语法。想要纯净后期素材时,明确“不添加字幕、文字和背景音乐”,并在导出后检查。
多语种与口音
按照“语言 + 地区口音 + 角色 + 表演状态 + 原文台词”书写。需要英文对白时,直接提供准确英文句子,不只写“把中文翻成英语”。例如:
text
Lin speaks in English with a natural American accent.
Her voice is quiet and controlled, with a short pause before the final word.
Dialogue: “I kept the letter. I just couldn't send it.”
Use @音频1 for her voice identity. No narration or subtitles.先用目标语言试听角色音色。多人对话分清说话人和发言顺序;不要让音色参考中的原台词混入新对白。支持语言见模型与参数。
迭代方法
先定位问题属于身份、空间、动作、镜头还是声音。保留已经正确的条件,只改一个主要变量。使用历史提示词回填比较版本;通过 AI 对话优化后,再检查是否新增了不需要的情节或镜头。
