Skip to content

符号语法——台词、音效、字幕怎么写

Seedance 2.0 起原生支持音视频联合生成——台词、音效、BGM 可以直接写进提示词,模型会一起生成。这意味着配音这一步可以不用剪映了

前提是用对符号。官方原文:

提示词中合理使用符号有助于模型准确理解不同信息类型。

信息类型 符号 官方示例
音乐 () (背景中播放着快节奏的摇滚乐)
音效 <> <远处传来狗叫声>
台词 {} {你好,世界}
字幕 【】 【第一章:启程】

台词还有一条补充规定:

如果台词为小语种(非中英文),需标注语种,如:用日语说道{こんにちは}

镜头3:近景,女孩抬头憋不住笑意,哈哈大笑说{骗你们的},
舍友们追着打闹起来。<宿舍里爆发出的哄笑声><椅子被拖动的声响>
(轻快俏皮的钢琴小调)

一条提示词同时交代了画面、台词、音效、BGM,生成出来就是带声音的成片。

创作者实测的经验值:按每秒 2.5 个字估算

  • 5 秒镜头 ≈ 12–13 个字
  • 15 秒镜头 ≈ 35 个字左右(还要留出没人说话的画面时间)

写超了会出现语速被压快、或者话没说完就切镜的情况。

Seedance 1.5 Pro 给了音色描述公式:

性别 + 年龄区间 + 声音属性 + 语速 + 情绪基线

例如:女性,20岁出头,清亮偏软的少女音,语速偏快,情绪轻松愉快

支持的语言范围(官方说明):

  • 中文:普通话、陕西话、四川话、粤语等方言
  • 外语:英语、日语、韩语、西班牙语、印尼语等

官方原文:

模型对多音字、生僻字、形近字容易读错。

解决方案是换成同音的常用字,官方给的示例很直白——把“螭龙山”写成“吃龙山”。听感一样,模型不会读错。

角色名里有生僻字的,建议在提示词里直接用同音常用字替代。

官方要求台词语言统一,避免中英文混用(专有名词除外)。想让角色说一句英文,最好整条镜头都是英文语境。

官方承认的已知问题:

视频中包含旁白时,视频片尾容易出现突兀咔哒声、截断杂音。

官方给的解法是重新生成,或者用剪映的音量包络线在结尾做淡出——在时间轴选中视频轨 → 音频 → 音量包络线 → 在临近结尾处把音量关键点拉到 0。

【】 可以主动生成字幕,但多数情况下你不想要 AI 生成的字幕——中文字容易糊成乱码。

官方的态度很坦诚:

目前无法直接做到 100% 避免生成字幕,只能通过以下方法降低其出现概率。

所以标准做法是:提示词里显式禁止字幕,字幕留到剪映后期加。 详见约束词与参数