midjounery资讯

纯文生视频提示词写作方法详解

哈喽,各位同学欢迎回来。前面几节课我们已经学习了如何用 MidJourney 生图,如何结合 Runway Gen-3 做首尾帧衔接,以及如何用全能参考将静态图片生成小短片。今天这节课我们继续讲解 Runway 视频实操中一个特别基础但也特别重要的内容——纯文生视频。

也就是说,这节课我们不上传图片、不上传视频,也不做参考混合,而是仅依靠一段文字直接生成一条视频。很多同学一听到“纯文生视频”,第一反应是:“那不就是写一句话,让模型帮我生成吗?”

其实没有这么简单。因为纯文生视频最容易出现的问题是:你脑子里想得很美,但写出来只有一句很模糊的话,最后模型虽然也能生成视频,却和你真正想要的效果相差甚远。

所以今天这节课主要解决两个问题:第一,纯文生视频到底该怎么理解?第二,纯文生视频的提示词到底该怎么写?

所谓纯文生视频,其实很好理解——你不给模型任何参考图、参考视频或参考音频,只用一段文字告诉它:画面里有什么人物、长什么样、人物在干什么、镜头怎么拍、氛围是什么样,然后让 Runway 根据这段文字直接生成一条视频。

那么纯文生视频最适合什么场景呢?特别适合以下几种情况:

  • 你脑海里已经有一个比较明确的画面;
  • 你手里暂时没有可用素材;
  • 你只是想快速测试一个创意,比如:仙侠角色出场镜头、国漫风人物回眸镜头、广告感的产品展示镜头、幻想角色觉醒镜头等。

很多同学做纯文生视频时都会遇到一个问题:能出视频,但不够像自己想要的。原因通常只有一个——提示词写得太笼统。

比如你只写一句“白狐妖姬在月光下醒来”,这句话当然能生成视频,但问题在于:模型并不知道她具体长什么样、穿什么、在什么场景里;镜头是从脚开始拍还是从脸开始拍;她是站着不动,还是有一个缓慢苏醒的过程;整体氛围是梦幻感、神秘感,还是偏魅惑感?于是模型只能自由发挥。

大家一定要记住一句话:纯文生视频不是少写一句话,而是要把你的想法写清楚。不是你写得越短越高级,而是你写得越清楚,模型越容易帮你实现预期效果。

那提示词到底怎么写更稳定?我建议大家前期先记住一个特别好用的结构,也就是本节课最核心的知识点:主体或场景 + 外观特征 + 镜头设计 + 动作变化 + 风格氛围

也就是说,你以后写纯文生视频提示词,不要一口气乱写一长段,而是先想清楚五个部分:

  1. 主体和场景:谁在什么地方?
  2. 外观特征:这个角色长什么样?穿什么?有什么明显识别点?
  3. 镜头设计:镜头怎么拍?先拍哪里?再拍哪里?镜头如何推进?
  4. 动作变化:人物有什么动态?画面中真正动起来的部分是什么?
  5. 风格氛围:最后整体呈现成什么调性?

只要你按这个顺序来写纯文生视频提示词,通常都会比随便写一句话清晰得多。

接下来我们不讲抽象概念,直接来看一个完整案例。这个案例非常典型,因为它同时包含了主体场景、人物特征、镜头推进、动作变化、氛围风格,特别适合大家理解一条纯文生视频提示词是如何从一个想法变成可执行文本的。

我们现在想做的画面是:月夜下一位白狐妖姬在幻想宫殿露台上缓缓苏醒

如果你只写这一句,其实是不够的。现在我们就按照刚刚的五段式结构,一步一步把它补完整:

  1. 主体和场景:先告诉模型“谁在什么地方”——可以写为“月夜下的幻想宫殿露台,一位白狐妖姬缓缓苏醒”。这样主体和场景就先立住了。
  2. 外观特征:接下来告诉模型这个角色具体长什么样——可以补充:“她拥有银白色长发、白色狐耳、九条蓬松狐尾、紫色发光眼眸,佩戴水晶额饰、银色链饰和宝石吊坠,身穿轻薄华丽的白色仙灵礼服。”这一段非常重要,因为如果不写这些外观特征,模型就会自由发挥,最终可能做出的并不是你想要的那种白狐妖姬。所以大家以后写人物类纯文生视频,一定要记住:外观特征就是角色识别度。
  3. 镜头设计:接下来是最关键一步——镜头怎么拍。很多同学写提示词时只写画面内容,不写镜头,这样生成出来的视频往往比较平淡。但如果你想让视频更有影视感,就必须把镜头顺序写进去。这里我们可以这样写:“镜头从裙摆与赤足特写开始,随后切到手指轻抚手臂银链的近景,再推进到唇部特写,最后缓缓上移至正脸。”这句话已经呈现出清晰的镜头流程:先拍裙摆与脚,再拍手部细节,再拍唇部,最后抬到正脸。这样模型理解的就不再是一张静态海报,而是一条带镜头推进逻辑的视频。大家以后写纯文生视频,如果想让画面更有高级感,镜头这一块一定不能省略。