返回首页
中文中文

Gas Station Dance 提示词:三个角色与四个镜头

用完整镜头顺序组织提示词,区分三张照片的角色,排查结尾缺失和人物变化,并比较手动流程与内置生成器。

最近更新: 2026-10-06

作者:GasStationDance.video

Gas Station Dance 提示词需要明确三张照片对应的角色,并写出完整顺序:开场跳舞、自拍、下车、回到自拍。支持多人物参考的视频工具,还需要按同一顺序附上照片;只有文字不能提供朋友的身份信息。GasStationDance.video 已内置场景指令,使用本站的三张照片流程不需要自己写提示词。

先看完整顺序,再写提示词

20.04 秒、480 × 854、模型生成音频;不同结果可能变化

这是本站公开的一次 480p 生成,输入为三张虚构成年人肖像,没有提供原视频。它呈现四个预期片段并包含生成音频,但不证明可重复成功率或原片编舞的精准复刻。完整案例展示输入照片、成片与限制。

可改写的提示词示例

下文是根据本站四镜头故事结构编写的示例,不是跨模型验证过的通用指令。不同工具对图片编号与参考输入的处理可能不同。

生成一个竖屏加油站场景,包含三个不同的成年人角色。
参考照片 1:开场跳舞的人。
参考照片 2:拍自拍的人,结尾再次回到这个人。
参考照片 3:从车里走出来的人。

按顺序呈现四个片段:
1. 第一个角色在加油站前跳舞。
2. 镜头转向第二个角色的自拍视角。
3. 镜头展示第三个角色从车里走出来。
4. 回到第二个角色,完成最后的自拍。

保持三个角色各自的脸、发型与服装,避免互换。
使用连贯的镜头转换与自然速度的动作。
如果工具支持,添加轻快的器乐配乐和自然环境声。
不添加对白、文字或标志;不要在下车镜头结束视频。

时长、画幅、分辨率应在工具支持的设置中选择。在提示词里写“20 秒”不会覆盖模型的时长限制;要求某首歌也不能证明模型能复刻该歌曲或提供使用许可。

哪种模型能够接收这样的描述?

本站公开样片使用 Kie 的 Wan wan/3-0-video,实际请求包含三张图片参考、20 秒、480p、9:16 与音频开关。Kie 模型文档说明了生成接口。这里记录的是本站已测设置,不是证明 Wan 最好的多模型比较。

使用其他工具前,先确认是否支持多个人物参考、图片如何编号、可用时长是否足够。仅支持首帧的流程,未必能分别给后续两个角色提供参考。本文没有验证 Kling、Seedance、Veo 等模型对这段提示词的兼容性。

为什么角色会变化,或结尾会消失?

  • 同一个人重复出现:检查照片顺序,每张参考图只放一个清楚的人,并将角色与镜头动作分别描述。提示词无法纠正传错的照片。
  • 下车人物变成自拍人物:明确第二个角色在结尾返回,不要同时把两人称为“主角”。
  • 成片停在车门处:明确要求最后自拍,并核对可用时长。即使如此,模型仍可能压缩故事。
  • 服装或手部变化:减少互相冲突的视觉要求,观看完整动作。多写形容词不能保证身份一致。
  • 舞蹈或音乐不同:此示例描述新场景。要保留原片动作和音轨,需要合适的视频参考编辑流程,以及参考素材的使用权。

调试时每次只改一个输入或指令,记录设置,评估时保留失败输出。重试可能产生费用;目前没有证据表明只改提示词就能稳定解决这些问题。

手动提示词还是专用生成器?

手动流程适合实验场景、镜头和节奏,但需要自己选择模型、附加参考、设置输出并判断每次结果。本站针对三张角色照片的固定故事顺序:分配跳舞、自拍、下车位置,选择分辨率,再生成。

两种流程都不能保证精准身份、原版编舞或热门歌曲。可以先读工具选择指南。

常见问题

一段提示词能把合照分成三个角色吗?

本站需要分别上传三张角色照片。合照不能为上传流程提供三个明确参考;请按照片指南为各位置选择清楚的单人照片。

需要把这段提示词粘贴进本站吗?

不需要。本站已经内置场景指令。上面的示例用于理解和改写手动流程,不是本站生成器的必填内容。

能复刻原版热门歌曲吗?

目前没有这样的保证。本站样片包含生成音频。若要使用指定歌曲,应在发布工具提供且适合用途的情况下另行添加。

想直接使用三张照片?阅读制作教程,或打开生成器。发现不适用的指令或错误,可联系我们。