如何写好声音描述

按希望听到的顺序,描述角色、对白、音效与音乐。先写清楚谁在说话、说什么、背景中发生什么,再补充细节。

1. 角色

给每个角色固定的名字,描述年龄感、音色、语言、吐字和语速。先选两三个辨识度高的特征,避免互相矛盾。

2. 对白

每句标明角色名,用引号包住要说出的原文,把语气、停顿等表演指令放在引号外。全文保持相同的角色名。

3. 音效

写明声音来源、远近、质感与出现时机。例如“句尾响起一声近处清脆的快门声”,比“电影级音效”更明确。

4. 音乐

写明乐器、情绪、节奏、进入和退出方式。如果对白优先,注明音乐轻铺在对白下方;不要同时堆叠过多音乐风格。

5. 顺序与参考音

按听觉时间顺序排列,注明同时发生、短暂停顿或渐弱。在输入框键入 @,选择已就绪参考音,并把 @voice1 分配给具体角色,最多三个。

完整示例 · 虚构手机广告

【角色:广告播音员(三十岁左右男性,声音清亮、冷静、富有科技感,普通话,吐字清晰)】

【音乐:空灵的电子音色与未来感合成器琶音缓缓铺入,随后加入有节奏感的电子鼓组,营造现代、科技、充满未来感的氛围。】

【对白:广告播音员:(语速适中、清晰、自信)"未来,此刻就在你手中。"】

【对白:广告播音员:(专业、冷静、有说服力的语调)"曜夜X旗舰手机,搭载新一代影像引擎,亿万像素捕捉每一帧精彩。超视网膜屏幕与全天候续航,性能与美学,一手掌握。"】

【音效:清脆的解锁提示音,随后是流畅的界面滑动声与快门清脆的"咔嚓"声。】

【对白:广告播音员:(清晰冷静、坚定)"曜夜,看见更远的未来。"】

【音乐:结尾响起一段空灵未来感的合成器音效,渐弱收束。】

提示词最多 3,000 字符。官方模型文档列出的语言为中文和英文;其他语言样例属于实际演示,生成效果可能不同。音频的时长和表演细节也可能与描述有偏差。

参考阿里云百炼官方文档: Audio generation ↗ · 模型规格 ↗

打开工作台 →