限时优惠!年度套餐低至 27% 折扣,开启一整年无限创作。

查看套餐 ›
视频教程

Seedance 2.5 Prompt 指南:语法、技巧与 30 个示例 Prompt

O
Sameer Sohail
Aug 10, 2026 · 阅读时长 7 分钟
Seedance 2.5 Prompt Guide: Syntax, Tips, and 30 Sample Prompts

Seedance 2.5 是 OpenArt 平台上能力最强的 AI 模型之一 AI 视频生成器,它之所以强大,很大程度上取决于你如何撰写 prompt。

它能一次生成完整的 30 秒视频,最多支持 50 个参考文件,还能让你只编辑片段中的某一部分,无需重做其余内容。这些功能各有各的用法,而大多数人始终没搞懂这套语法。

本指南涵盖真正有效的方法,包括字节跳动官方示例所用的确切措辞。

要点总结

  • 描述整个场景以及30秒内发生的变化,而不是某个静止的瞬间。
  • 在 prompt 里给每个参考文件都打上标签,并指明你想用它的哪一部分。
  • 把你的30秒拆成“0-8秒”这样的时间段,让每部分都有各自的方向指引。
  • 将音乐、音效和台词各自放在独立的括号中,以免混淆。
  • 用精准编辑修正某个错误元素,无需重新生成整段视频。

描述场景,而不只是主体

“一位女子走在城市街道上”是个不错的起点,但它把太多细节交给了模型去发挥。

当你把整个场景描述清楚时,Seedance 2.5 的表现会好得多。说明主体在做什么、场景是什么样子、镜头如何移动。“一位身着红色大衣的女子在雨夜走过城市街道,从侧面缓缓跟拍,路灯倒映在水洼中。”

同一个主体,完全不同的视频。你描述得越详细,它需要猜的就越少。

用参考图代替外观描述

这是 Seedance 2.5 带来的最大变革。你有 50 个参考位可用,不必再花一半的 prompt 去描述某个人的长相。

上传角色图片,让模型进行复刻。产品、场景和风格也可以照做。如果你有一段带有目标氛围或色调的视频片段,也一并添加进来。

一条好用的准则:能展示出来的,就别用文字描述。把文字留给画面无法传达的东西,比如动作、运镜和节奏。

在 prompt 中为每个参考图标注

这一步是大多数人会跳过的,但它决定了你的参考图是帮到视频,还是悄悄毁了它。

仅仅上传文件还不够。Seedance 2.5 无法可靠地猜出图 3 是场景、图 4 是夹克。你必须在 prompt 文本里明确说明。ByteDance 官方的示例 prompt 在每一张参考图上都会这样做。

该模式如下所示:

@Image 1 确定了女士的面部、发型和绿色夹克。

@Image 2 定义了咖啡馆、窗户和清晨的光线。

@Video 1 确定了行走速度和镜头运动。

@Audio 1 决定了她的声音。

然后在标签后面写动作。所有文件类型的编号方式都一样,所以你可以用同样的方式指向 @Image 7 或 @Video 2。

指出你想要的画面部分

每个参考图都会带来你没要求的东西:一个背景、角落里的陌生人、一种你不想要的颜色。如果标注含糊,这些都可能出现在你的视频里。

字节跳动官方的建议是,说明要用参考素材的哪一部分,而不是罗列不要什么。所以标签要写得精准:

@Image 1 仅定义女子的面部和绿色夹克。

@Image 2 仅定义咖啡店柜台和窗光。

这里多加一个词就能起大作用。说"仅面部"比上传一张头像并指望模型猜出你不想要她身后的墙更可靠。

对于一小部分内容,有明确的"不要"指令可供参考:字幕、logo、水印、背景音乐和整体风格。这些可以直接写清楚,比如"无字幕"或"无背景音乐,保留房间原声"。

将同一物体的多张图片分为一组

如果你上传同一产品的四个角度,模型可能会把它们当成四个不同的产品。请明确说明它们是同一物体,直白地说:

@Image 1 定义台灯的正面。@Image 2 定义同一台灯的左侧。@Image 3 定义同一台灯的背面。三张图展示的是同一盏灯。视频中只能出现一盏灯。

最后那句话才是点睛之笔。

混用多种参考类型

Seedance 2.5 单次生成最多支持 30 张图片、10 段视频和 10 段音频。总计 50 个文件,每种类型分别控制结果的不同部分。图片请保持在 4K 以内,视频片段总时长请控制在 30 秒以内。音频片段的总时长同样有 30 秒的上限。

图片承载人脸、产品和场景,视频片段传递动作、节奏和整体质感,音频片段则塑造人声与背景音。

最佳效果通常来自两三种素材的组合。以产品广告为例,可以是一张产品照片、一段用于定风格的短片,再加一个音频文件来配声音。

你不必填满全部50个位置。单个视频中出现8个或更少的人物或产品能保持稳定效果,超过这个数量一致性就会开始下降。5到10秒的短参考片段比长片段效果更好。

如果你经常使用同一个角色,只需在此处保存一次 OpenArt 角色库 再也不用每次都去翻找那张图片了。

将你的30秒拆分成时间点

Seedance 2.5 能在 30 秒里撑起一个完整的故事。所以你的 prompt 应该说清楚这段时间里发生了什么,而不是描述某个静止的瞬间。

最直接的方式是把时间范围直接写进 prompt 里。字节跳动官方的示例就采用了这种格式:

0-5秒:厨师把一个空盘子放到台面上,拿起一把勺子。

5-15秒:酱汁沿一条直线淋在盘子上时缓缓推近。

15-25秒:一只手将三只扇贝逐一放下。

25-30秒:拉远至暖色顶光下成品菜肴的广角镜头。

时间戳比「开场是、接着、最后」更好用,因为模型既能拿到顺序,也能拿到节奏。如果第一次生成时某个节拍显得太赶,只需拉宽那一段的时间范围,其余保持不变。

三条规则让时间戳保持有效。使用整秒,绝不用半秒。时间轴上不留空隙,让下一段从上一段结束的地方无缝接续。每段只给一个明确动作,因为塞得太满的段落会丢失节拍,而空白的段落则会被填入你没有要求的内容。

时间戳也不是计数器。「一秒内点头三次」是行不通的,所以要描述动作,而不是重复的次数。

如果你想要超过 30 秒的时长,无需拼接任何东西。先生成第一个片段,然后请求延长,它会从上一段接着往下走,并保持相同的角色、场景和风格。

命名镜头运动

Seedance 2.5 能直接从你的 prompt 中读取镜头指令。想要特定的镜头,就把它写出来。

有效的词汇:跟拍、缓慢推近、大远景、手持、航拍、向前移动、环绕、变焦拉焦、低角度、俯视。“电影感”不是运镜方式,对模型毫无指导意义。

每个节拍只选一个运镜动作,别一次堆三个。一个贯穿整整十秒的清晰运镜,远比三个互相冲突的动作好看得多。

你也可以直接从已有的片段中复制运镜方式。把它作为视频参考上传并标注,比如「@Video 1 仅用于定义运镜和节奏」。这样模型就会照着这个动作走,而不是靠猜测你的文字。

把声音写进你的 prompt

Seedance 2.5 会同时生成音频和视频,所以你可以用文字来塑造声音。描述环境:「安静的室内空间」「车水马龙的繁忙街道」「音乐在最后几秒逐渐推向高潮」。

当一个 prompt 同时包含音乐、音效、台词和屏幕字幕时,普通句子就会乱成一团。四种括号能把它们区分开:

你想要什么 该使用的括号 示例
音乐 ( ) (轻柔的钢琴声在场景中响起)
音效 < > <远处传来钟声>
配音台词 { } {Hello, welcome back.}
画面字幕 【 】 【第一章】

这些出自字节跳动官方的 prompt 指南,最初为 Seedance 2.0 编写,2.5 仍适用。注意音乐用的是宽括号【】,而非普通圆括号。

不必给每一行都加括号。当一句普通的话可能有两种读法时再用括号,比如一句台词老是被当成字幕显示出来。字节跳动较新的示例常常只用引号加说话人的名字,这样也行得通。

你也可以用大白话关掉某些效果。"无字幕"以及"无背景音乐,保留房间原声"都有文档说明,也都能生效。

让配音说对语言

这里有两条规则直接来自ByteDance。所有的配音台词都要用同一种语言,因为在同一个prompt里混用两种语言会出问题。而且只要台词不是英语或中文,就要在台词前面注明语言。

她用日语说:{もう大丈夫です}

想要特定口音或表达方式时,保持相同的顺序会很有帮助。先写语言和口音,再写说话方式,最后写台词内容。

Spoken language: American English. She says it fast and a little annoyed: {I told you this would happen.}

在开头就写明,比在 prompt 末尾加上"美式口音"更可靠。

只修改需要的部分,无需重做整个视频

区域编辑适用于片段有 90% 都对了、只有一处不对的情况。比如瓶子上标签错了、背景不搭,或者面部角度没拍好。

重新生成之前,先检查问题是否只出在某一处。如果是,就只针对那一处处理,其余部分保持原样。这样已经做好的每一部分都能保留下来。

措辞的结构和你第一个 prompt 一样。给片段命名,说明什么保持不变,再说明什么发生变化:

编辑 @Video 1。保持人物、动作和运镜不变。只把她手中的瓶子换成 @Image 2 里的那个,并匹配原有的光线。

使用 @Video 1,仅将背景替换为 @Image 3 中的场景。保持人物、她的衣着和动作完全不变。

编辑 @Video 1。0-5s:不变。5-12s:将标牌上的文字替换为 @Image 4 中的文字,匹配原有字体和光照。12-20s:不变。

注意最后一个把时间戳和编辑结合了起来,所以只有片段中间的部分被改动了。

编辑时有两点需要留意。生成结果会保持与你输入片段相同的画面比例和时长,因此无法在同一步骤中裁剪或修剪。此外,20秒及以内的片段编辑效果比更长的片段更稳定。

弱 prompt 与强 prompt 对比

可用结果与浪费一次生成之间的差距,通常就取决于三点。

你的设置项
相机 黄昏时分的城市天际线 黄昏时分低空掠过天际线,缓缓向一座亮灯的高塔推进
随时间变化 山脊上的攀登者 登山者翻过山脊,起身转向山谷,镜头随之拉远
参考图 使用这些图片 @Image 1 仅定义女子的面部和外套。@Image 2 定义市集。女子穿行于市集之中。

浪费生成次数的五个错误

  • 描述的是一张照片,而非一段视频。 要说清楚这 30 秒里有什么变化,而不是某一帧长什么样。
  • 参考图保持无标注状态。 如果你上传了五个文件,就说明每个文件的用途。
  • 标签文字过宽。 「@Image 1 定义这位女性」会把她的背景也一起带进来。要写成「仅她的脸和外套」。
  • 叠加运镜。 一拍里塞进三个动作只会互相打架,选一个就好。
  • 把五个场景的故事硬塞进一个段落。 使用时间点,或者逐个镜头搭建,在 OpenArt Director.

30 个 Seedance 2.5 提示词示例

随意复制其中任意一条,换上你自己的主体,再叠加你的参考标签。

产品与电商

  1. 一瓶护肤品摆在大理石台面上,窗外洒下柔和的光。以视平线缓慢360度环绕,最后正对标签定格。安静的房间环境音,末帧配一声轻柔的叮咚。
  2. 一只皮革包敞开着放在亚麻背景上。镜头近距离推进特写缝线,随后拉回到四分之三角度。柔和的录音棚环境音,伴随轻微的布料摩擦声。
  3. 耳机充电盒以慢动作打开,盒盖掀起,露出里面一盏蓝色小灯。镜头由高处向下俯拍,逐渐推近成紧凑特写。盒盖上一声清脆的咔哒,随后是一段简短的品牌提示音。
  4. 一只跑鞋以慢动作踏入水洼,水珠悬在空中。地面高度的侧向跟拍镜头,随后环绕凝固的水花旋转。清脆的溅水声被拉长。
  5. 咖啡袋撕开,咖啡豆倾泻入玻璃罐。俯拍镜头转为侧视,展现落下的豆子。醇厚的倾倒声,以温暖的咖啡馆基调收尾。

UGC 和社交广告

  1. 一位女士在明亮的厨房里举起一瓶护肤品,对着镜头讲述她的晨间护肤流程。手持自拍角度,轻微自然抖动,温暖的窗光。轻松的室内氛围,声线清晰。
  2. 一名男子坐在咖啡馆里介绍他 App 的一项功能,边说边打手势。平视角度的固定中景,身后是虚化的咖啡馆环境。他的话音下伴有咖啡馆的交谈声。
  3. 一位创作者咬下第一口零食,先做出反应再描述味道。厨房台面前的手持特写。咀嚼声与咬合同步,随后是自然的口头反应。
  4. 一位女士在酒店床上打开一个旅行收纳包,演示它如何放进行李箱。俯拍视角切换到侧面视角。伴有拉链和布料的声音以及随意的旁白。
  5. 一位教练在家庭健身房里演示一个阻力带动作,在两组之间讲解要领。手持镜头跟随动作,呼吸与发力同步。

角色与故事场景

  1. 午后光线中,两位朋友隔着一张小桌相对而坐。0-10秒:房间全景。10-20秒:左侧的人开口说话,中景双人镜头。20-30秒:另一人凑近回应。手持拍摄,带轻微自然晃动。人声下方是温暖的环境音。
  2. 一个男人在夜里走进空荡的办公室,当灯光自行闪烁亮起时他停下了脚步。镜头在他身后缓缓推进,随后切到他的脸部特写。低沉的嗡鸣声,一声尖锐的电流爆响,然后归于寂静。
  3. 暮色中的林间空地,一个身披斗篷的女孩伸手触碰一块发光的石头。光芒溢出时,镜头缓缓推近并轻柔上抬。风铃声与柔和的乐声随光芒迸发而起。
  4. 一位祖母在餐桌旁教孙子揉面团。静态中景,温暖的顶光,无剪辑。厨房声响与轻声交谈。
  5. 一名快递员抱着包裹跑上六层楼梯。手持摄像机紧跟其后一步,随他一起向上。伴有脚步声、喘息声和楼梯间的回响。

时尚与美妆

  1. 一位身穿超大廓形外套的模特在黄昏时分沿着空荡的街道朝镜头走来。稳定的跟拍镜头保持在髋部高度,随她的步速向后移动。街道环境声中脚步声与每一步同步。
  2. 一只手在脸颊上晕开粉底的超近特写。静止镜头,柔和均匀的光线。安静的室内环境音,伴随轻柔的晕染声。
  3. 一位模特身着长礼服,在头顶单盏灯光下原地旋转。镜头以与旋转相同的速度环绕。可听到面料摆动的声响,伴随低沉的弦乐渐强。

美食

  1. 厨师以慢动作在盘子上淋洒酱汁。俯拍特写,温暖的厨房灯光。淋洒声被拉长,最后收在厨房的环境音上。
  2. 一碗面热气腾腾,筷子将面夹起入镜。桌面高度的近距侧拍。餐厅嘈杂声,夹起面时伴随轻轻的吸溜声。
  3. 一张披萨从柴火烤炉里出炉,芝士还在冒泡,落在案板上。一镜到底,从烤炉运动到餐桌。伴有柴火噼啪声和芝士滋滋声。

自然与旅行

  1. 一头鲸鱼在清澈的蓝色海水中滑过潜水员身旁,阳光成束洒下。水下广角固定镜头,潜水员在鲸鱼面前显得渺小。低沉的水下声与悠远的鲸歌。
  2. 日出时分,一只热气球飘过葡萄园山谷,下方成排的葡萄藤间弥漫着薄雾。航拍镜头跟随气球飘移。远处传来喷火器的火焰与轻柔的风声。
  3. 浓雾中,灯塔光束扫过嶙峋的海岸。缓慢的固定广角镜头,光束在画面中转动。伴有雾号、海浪与海鸥声。

运动与动作

  1. 阳光洒满的公园里,一名滑板手完成了一组下楼梯的技巧动作。助滑时低角度跟拍,落地时固定定格。伴有滚轮碾过混凝土的声音和短促的欢呼。
  2. 一名游泳者从出发台上慢镜头跃入水中,入水处水花四溅。侧面机位贴着水面并跟随入水。水花被拉长,随后转为沉闷的水下音效。
  3. 一位骑行者高速通过山间发夹弯,每个转弯都侧身压弯。空中镜头从高处跟拍,随道路下降。风声随速度渐强。

企业与讲解类

  1. 一位创始人边走过办公室边直视镜头讲解公司业务,背景中员工在虚焦处安静工作。镜头稳定地跟随她移动。清晰的人声之下伴有淡淡的办公室环境音。
  2. 笔记本电脑屏幕上显示着一个仪表盘,光标依次划过三个菜单,每次点击都会点亮一块面板。桌面顶部固定俯拍镜头。轻柔的键盘敲击声和点击声。
  3. 一队人围在白板旁,其中一人画出一张简单的三步示意图。侧面静态中景,自然办公室光线。马克笔的吱吱声和安静的室内环境音。

三个完整的示例 prompt

下面就来看看这些要素是如何组合起来的。

示例 1:产品品牌片

模式:文本生成视频。参考:产品照片加一段品牌风格片段。

@Image 1 仅定义精华瓶、标签和瓶盖。@Video 1 仅定义色调和节奏,不涉及产品。

一瓶护肤精华置于白色大理石上,左侧洒下柔和光线。0-10 秒:全景,随光线渐暖缓缓推近。10-20 秒:一只手从右侧入镜,缓缓转动瓶身。20-30 秒:特写标签,背景虚化。安静的室内氛围声。

这演示了几个要点:精准的参考标签、三段式时间线、每个节拍一个镜头运动,以及用几个词命名声音。

示例 2:多角色场景

模式:参考生成。参考素材:两张角色照片、一张咖啡馆照片和一段风格片段。

@Image 1 仅定义第一个人的脸部、发型和蓝色衬衫。@Image 2 仅定义第二个人的脸部和眼镜。@Image 3 定义咖啡馆、靠窗座位和午后光线。@Video 1 仅定义手持镜头的质感。

两人在午后的光线中相对而坐,中间隔着一张小咖啡桌。0-8 秒:房间的大全景,暖光透过窗户洒入。8-20 秒:中景双人镜头,左侧的人端起杯子开口说话。20-30 秒:右侧的人身体前倾作答。手持拍摄,带轻微的自然晃动。温馨的咖啡馆环境音,人声背后传来柔和的交谈声。

这个案例说明了什么:让角色照片来把控面部,好让提示词专注处理动作和节奏,同时在每个标签上加“only”,把两处多余背景挡在画面之外。

示例 3:电影感风景

模式:图生视频。参考素材:一张风景照加一段风格片段。

@Image 1 定义悬崖、海洋和黄金时刻的光线,并设定第一帧。@Video 1 仅定义调色和节奏。

一个孤独的身影站在悬崖边缘,面朝大海。0-15 秒:从高空后方的大远景缓缓下降至平视高度。15-25 秒:在人物身后保持中等距离静止。25-30 秒:拉远至大远景,整条地平线尽收眼底。(管弦乐渐强至结尾)<风声与远处的海浪声>

这展示了什么:一段以时间线形式描述的长镜头运动、一张设定开场画面的参考图,以及用括号将配乐与音效分隔开。

归根结底

写清楚场景以及场景中发生的变化。为每个参考图打上标签,并指明你想要的部分。把这 30 秒拆分成时间戳,每个节拍指定一个镜头运动。

Seedance 2.5 更青睐具体的描述,而大部分具体内容都是可以直接照搬的句式。先从上面某个贴近你想法的 prompt 开始,换成你自己的主体,然后 在 OpenArt 上试试.

常见问题

在 Seedance 2.5 的 prompt 中最多能用几个参考文件?

单次生成最多支持 30 张图片、10 段视频和 10 段音频,共 50 个文件。请在 prompt 文本中为每个文件标注说明,让模型知道它的用途。

在 Seedance 2.5 的 prompt 里该怎么写时间戳?

将纯时间区间单独写成一行,例如「0-8s:」后接对应发生的内容。字节跳动的官方示例就采用这种格式,它既能控制事件顺序,也能控制每个事件的持续时长。

为什么我的产品在视频里出现了两次?

你上传了同一物体的多个角度,模型把它们当成了不同物体。把它们标注为同一样东西,并加上一句收尾说明,比如「这三张图都是同一盏灯,视频里只能出现一盏灯」。

我可以做超过 30 秒的视频吗?

可以。先生成开头的 30 秒,然后申请从这段片段延续下去的续接,人物、场景和风格都保持一致。你可以反复延续,无需拼接就能做到几分钟长。

为什么我的英文对白口音不对?

把语言和口音写在台词前面,而不是后面。先写“Spoken language: American English,”,然后写说话方式,最后把台词放在大括号里。

Seedance 2.5 的 prompt 能在 Seedance 2.0 上使用吗?

大多数单场景 prompt 适用于所有 AI 视频模型。不过时间戳的效果不佳,因为 Seedance 2.0 读取的是镜头编号而非时间。将「0-5s」和「5-15s」改写为「Shot 1」和「Shot 2」,同一个 prompt 即可生效。上传同一主体的多个角度也仅 2.5 版本支持。

创作无极限

加入数百万创作者的行列,用 OpenArt 生成图像、视频、角色和故事——全都在一个平台上完成。

免费开始使用 →