Runway Gen-2是目前主流的AI视频生成工具之一,其中文本转视频(Prompt-to-Video)模式允许用户直接输入一段文字描述,由模型生成一段几秒钟的动态画面。这个模式上手门槛看似很低,但真正想生成符合预期的画面,需要理解提示词的结构、参数的调节逻辑以及运镜语言的运用。本文从操作流程、Prompt写法、参数配置和运镜控制四个维度展开,帮你把Gen-2的能力真正用起来。

一、文本转视频的基本操作流程与Prompt结构
进入Runway的工作台后,在工具列表中选择Gen-2,模式切换到Text to Video,输入框中填写提示词后点击Generate即可开始生成。每次生成会消耗一定积分,生成时长通常在几十秒到两分钟之间,完成后可在右侧预览区播放并下载。
很多人容易把Prompt当成一句话随便写,其实Gen-2对提示词的结构是有偏好的。一条质量较高的Prompt通常包含四类信息:主体(Subject)、动作(Action)、环境(Environment)和风格(Style)。例如写一段"电影感画面"的提示词,可以这样组织:
cinematic shot of a lone astronaut walking slowly across a red desert, dust particles floating in the air, low sun creating long shadows, anamorphic lens flare, shallow depth of field, 35mm film look
这条Prompt里,astronaut是主体,walking slowly是动作,red desert和dust particles是环境,而cinematic、anorphic lens flare、35mm film look则共同定义了风格。实践下来,英文提示词的效果明显优于中文,因为模型的训练语料以英文为主。如果你不擅长写英文,可以先用中文组织好语义,再翻译成英文并做适当润色。
另一个实用技巧是控制Prompt的长度。太短的描述会让模型自由发挥,结果往往不可控;太长则可能稀释关键信息。一般来说40到80个英文单词是比较理想的区间,重点信息放在前面,修饰性词语放在后面。当生成的画面偏离预期时,优先调整主体和环境描述,而不是盲目堆叠风格词。
二、核心参数详解:Seed、宽高比与去噪强度
Gen-2的参数面板看起来简单,但每个选项都直接影响生成结果,逐个说明如下。
Seed值是随机种子,固定Seed后同样的Prompt会生成高度相似的画面。这个参数的典型用法是"局部迭代":当你生成出一条80分满意的视频时,记下它的Seed值,之后只微调Prompt中的个别词汇并保持Seed不变,就能在保留整体构图的前提下改变局部细节。如果每次都想探索新的可能性,则把Seed设为Random。
宽高比建议根据用途选择。竖屏内容选9:16适配短视频平台,横屏电影感内容选21:9或16:9。需要注意,Gen-2对宽高比的支持随版本更新有变化,生成前确认当前可用选项,避免生成后二次裁剪损失画面。
去噪强度(在图像+文本混合模式下尤为重要)控制生成结果与输入参考的差异程度。数值越低,输出越贴近参考图;数值越高,模型 creativity 越强但可能偏离参考。纯文本模式下这个参数影响相对有限,但理解它的机制有助于你在切换到图生视频模式时快速上手。此外,Interpolate插帧选项能让画面更流畅,Upscale选项可提升分辨率,代价是额外的积分消耗和处理时间。
下面是一组参数配置的参考思路:
Prompt: drone shot flying over a foggy pine forest at dawn Seed: 4286153 # 固定种子,便于迭代 Aspect Ratio: 16:9 # 横屏输出 Interpolate: ON # 开启插帧,画面更顺滑 Upscale: OFF # 先确认画面满意再放大,节省积分
三、运镜控制:用提示词描述镜头语言
Gen-2没有独立的运镜控制面板,镜头运动完全通过Prompt中的镜头语言词汇来引导。掌握常见的电影运镜术语,是让画面产生"电影感"的关键。以下是经过验证效果较好的运镜词及其适用场景:
- 推近(Push in / Dolly in):镜头向主体靠近,营造压迫感或聚焦感,适合表现人物情绪或揭示细节。
- 拉远(Pull back / Dolly out):镜头远离主体,展示环境全貌,常用于片尾或交代场景规模。
- 环绕(Orbit / Circling shot):镜头围绕主体旋转,视觉冲击力强,适合展示产品或人物特写。
- 平移(Pan / Tracking shot):镜头水平移动跟随主体,适合表现行进、追逐等动态场景。
- 航拍俯冲(Drone shot / Aerial view):上帝视角俯瞰或飞行穿越,适合大场景。
- 手持感(Handheld camera):模拟手持晃动,增强纪实感和紧张氛围。
运镜词的位置有讲究。建议放在Prompt的开头,因为模型对前置信息的权重更高。对比下面两条写法:
slow dolly in on an old man sitting by a rainy window, warm lamp light, melancholic atmosphere, shallow depth of field
把"slow dolly in"放在句首,镜头运动会明显比放在句尾时更稳定、更符合指令。同时注意,一条Prompt只描述一种运镜效果最可靠,如果同时写"dolly in and orbit around",模型大概率会生成混乱的运动轨迹,或者只执行其中一个指令。
运镜词还可以和速度词组合,进一步细化效果,例如"slow push in"(缓慢推近)与"fast zoom in"(快速推近)带来的情绪完全不同。前者安静克制,后者紧张突然。配合光线描述(如golden hour、backlit、volumetric lighting)一起使用,画面质感会有质的提升。
四、常见问题排查与实用建议
实际使用中常见的几类问题和应对方法整理如下。第一,画面出现明显变形或闪帧,多半是主体描述过于复杂,尝试简化Prompt,减少画面中的元素数量。第二,生成的视频毫无动感、近乎静态图,说明Prompt缺少动作描述,加入明确的动词短语如"walking through""flowing""swaying in the wind"通常能改善。第三,多次生成结果都很相似,检查Seed是否被固定,同时调整环境或风格词增加随机性。
关于生成成本的规划,建议采用"广撒网再精修"策略:前期用Random Seed快速生成多条候选,挑出构图最好的一条,记录Seed后进入微调循环。这样比在一条不满意的结果上反复调整Prompt更省积分。
最后提醒一点,Gen-2生成的是几秒钟的短片段,单条视频的信息承载有限。如果你的目标是制作完整短片,正确的思路是把多条生成片段导入剪辑软件拼接,保持Prompt风格词的一致性(比如始终使用同一组镜头风格描述),才能让多段画面在色调和质感上保持统一。AI视频生成的本质是"生成素材"而非"直接成片",理解这一点后,你对工具的预期和用法都会更加合理。
Runway Gen-2文本转视频Prompt参数修改时间:2026-09-09 05:30:41