首页 / AI教程 / 正文
AI教程

Runway教程:零基础快速上手Gen-3 AI视频制作,少走弯路完整指南

chuanbook chuanbook
发布于 2026 年 10 月 05 日
阅读 约32分钟
浏览 4
评论 0

我第一次接触Runway的时候,说实话有点懵。打开官网看到一堆工具按钮,完全不知道该点哪个。后来慢慢摸索下来才发现,这东西其实没有想象中那么玄乎,它就是一个把"想法变成视频"的工具箱。你脑子里有个画面,不管是文字描述还是现有图片,丢进去,它就能帮你产出一段动态影像出来。

这份教程总览会把我踩过的坑、走过的弯路都摊开讲一遍。不绕弯子,从Runway到底是个什么东西开始,一直聊到Gen-3的完整工作流该怎么跑通。

Runway是什么:核心功能、产品定位与适用人群

Runway最早是做AI视频编辑工具起家的,那会儿主要服务于专业影视团队。画面抠像、物体追踪、绿幕合成这些活儿,以前得在后期软件里折腾半天,它用AI几秒钟就能搞定。后来Gen系列模型出来之后,它的定位变了,不再只是"剪辑师的辅助工具",而是变成了"任何人都能生成视频的创作平台"。

它的核心功能可以粗暴地分成三块。一块是生成,也就是用文字或者图片来产出视频画面,Gen-3就是干这个的主力模型。一块是编辑,包括视频裁剪、遮罩、关键帧控制、慢动作补帧这些。还有一块是音频和后期处理,配音、音效、字幕整合都在这里面。三块功能互相打通,你可以在同一个项目里从生成做到成片。

适合谁用呢?短视频创作者拿它做素材效率很高,广告从业者用它做概念片提案特别快,独立导演和编剧可以用它把分镜脚本可视化。完全零基础的小白也能上手,因为Gen-3你只需要会打字描述画面就行。当然,如果你本来就有剪辑基础,那Runway对你就不是替代品,更像是一个效率放大器。

Runway Gen-3 视频生成教程的学习价值与应用场景

我身边不少朋友问过我,学Runway到底值不值。我的回答一直是:看你拿它干什么。如果你只是偶尔想生成几段炫酷视频发朋友圈,那随便玩玩就够了,不用系统学。但如果你想把它变成稳定的产出能力,比如每周要更新短视频、要接商业项目、要做完整的叙事短片,那就得认真研究提示词结构、参数控制、工作流衔接这些东西。

Gen-3的生成质量已经能做到"乍一看分不清是实拍还是AI"的程度。光影、材质、镜头运动都相当自然。这意味着它能覆盖的应用场景比前几代广太多了。产品广告里那些空镜、氛围镜头,以前要租场地请摄影师,现在一个人对着电脑就能搞定。概念设计阶段,导演可以直接把脑海里的画面生成出来给团队看,沟通成本直线下降。

音乐MV也是一个很适合的场景。风格化的画面、超现实的转场、情绪化的色调,Gen-3在处理这类需求时表现很出色。叙事短片的话,需要配合角色一致性和场景连贯性的技巧,这部分我在后面章节会详细拆。

Runway如何制作AI视频:整体流程与关键环节预览

用Runway做一条完整的AI视频,大概会经历这么几个环节。前期你得先想清楚要做什么,写脚本、画分镜、确定视觉风格。这个阶段不用打开Runway,拿纸笔或者文档工具就能完成。想得越清楚,后面生成的时候越省力。

进入生成阶段之后,核心工作就是写提示词和反复抽卡。提示词决定了画面的内容、构图、光线、情绪。第一次生成大概率不会完全满意,需要根据结果调整描述再生成。这个迭代过程有时候两三轮就搞定,有时候要七八轮。抽卡这个词就是这么来的,有点像开盲盒。

生成出满意的素材之后,就到了剪辑和合成环节。Runway内置了时间线编辑功能,你可以把多段素材拼在一起,加转场、调色、加字幕和音效。如果需要更精细的剪辑,也可以导出到专业软件里继续处理。最后一步是导出成片,选择合适的分辨率和格式,发布到对应平台。

整个流程里头,提示词编写和素材迭代是最耗时间的两个环节。剪辑反而相对快,因为素材质量够好的话,拼接起来很顺。

本教程学习路径:从注册、生成到剪辑发布的五个阶段

我把学习路径拆成了五个阶段,每个阶段有明确的目标。第一个阶段是注册和基础操作,搞清楚订阅方案怎么选、点数怎么消耗、界面各个区域是干什么的。这个阶段花个一两个小时就能过。

第二个阶段是理解三种生成模式的区别。文生视频、图生视频、视频转视频,各自适合什么场景,操作上有什么不同。这个阶段建议每种模式都动手试几次,感受一下差异。第三个阶段是提示词专项训练,包括镜头语言描述、光影控制、情绪表达这些技巧。这是最需要花时间打磨的部分。

第四个阶段是完整工作流跑通。从脚本到分镜到生成到剪辑到导出,完整走一遍。哪怕做出来的东西很粗糙也没关系,目的是熟悉整个链条。第五个阶段是进阶优化,包括角色一致性处理、多轮迭代技巧、常见问题排查。走完这五个阶段,基本上就能独立完成商业级别的AI视频项目了。

新手常见误区与学习前准备事项

我见过最多的误区就是"提示词写得越长越好"。其实不是。Gen-3对提示词的理解能力很强,但信息太密集反而会让它抓不住重点。好的提示词是精准而不是冗长,一个镜头讲清楚一件事就够了。

另一个误区是急着做长视频。一上来就想生成三分钟的叙事短片,结果每个镜头都不满意,越做越挫败。我的建议是从三到五秒的单个镜头开始练,把每一个短镜头做到满意,再考虑拼接成长片。短镜头是基本功。

学习前的准备其实很简单。一台能流畅上网的电脑,稳定的网络环境,一个Runway账号,再加上足够的耐心。不用提前学什么剪辑软件,Runway的操作门槛比传统工具低很多。真要准备的话,我建议你平时多看电影多截图,积累视觉素材库。知道什么样的画面是好看的,比会操作软件更重要。

我第一次打开Runway官网的时候,盯着那个登录按钮愣了十几秒。心里想的是:这玩意儿到底要不要翻墙,注册麻不麻烦,免费版够不够我玩。后来注册完发现,整个过程比点外卖还简单。邮箱或者谷歌账号一键登录,连密码都不用设。登录进去之后系统会送你一些初始点数,够你生成几段五秒的视频感受一下。我当时就用这点数生了只猫在草地上跑,画质把我惊到了,心想这要是发朋友圈肯定有人问用的什么滤镜。

注册登录、订阅方案与生成点数消耗规则

注册这块我踩过的唯一一个坑,是没注意看点数消耗表。Runway免费版给的点数不多,生成一次Gen-3视频大概要花掉十几个点。我当时不知道,连着抽了五六次卡,点数瞬间见底。后来才搞明白,不同模型、不同时长、不同分辨率,消耗的点数都不一样。Gen-3 Turbo比标准版便宜些,但画质有细微差别。你要是想省点数,可以用Turbo先试提示词方向,定下来了再用标准版出成品。

订阅方案我研究了好一阵。免费版适合刚上手的人,点数少,生成排队时间也长。标准版每个月给一千多点,够做几个小项目。专业版点数更多,还能去水印、提分辨率。无限版就适合团队或者高频创作者了,钱包得够厚。我的建议是别一上来就充年费,先按月订一个标准版,把点数消耗规律摸清楚。有些朋友开完会员没用几次就忘了取消,白白扣钱。我自己是设了个手机日历提醒,续费前三天弹窗问自己一句:这个月到底用没用回本。

点数消耗还有个细节,就是失败生成也会扣点。你提示词写得太离谱,模型理解不了,它照样扣你点数。我一开始不知道,有次写了个“一只会跳芭蕾的章鱼在月球上打篮球”,生成出来一团模糊,点数照扣不误。所以新手阶段别太天马行空,先把基础的场景描述练熟。另外每天登录有时候会送点小点数,蚊子腿也是肉,能攒就攒。

工作区、项目创建与素材文件管理

登录之后你看到的主界面就是工作区。左边一排工具图标,中间是项目卡片列表,右上角有个显眼的“New Project”按钮。我第一次点创建项目的时候,随手起了个名字叫“测试1”,结果后来做了十几个项目,满屏都是测试2测试3,自己都分不清哪个是哪个。现在我会用日期加关键词来命名,比如“20240612_咖啡广告_分镜01”,找起来快很多。项目里面可以建文件夹,把不同场景的素材分开丢进去。别小看这个习惯,做长片的时候素材几十上百个,不分类的话你会疯。

素材文件管理这块,Runway支持上传图片、视频、音频。图片格式JPG、PNG都行,视频MP4、MOV常见格式也没问题。上传之后直接拖到时间线或者生成区域就能用。我有个朋友做MV,把几百张参考图全堆在一个文件夹里,找一张图要翻半天。我教他按场景分文件夹,比如“城市夜景”“人物特写”“转场素材”,效率立刻上来了。

我个人还有个习惯,每做完一个项目,会把最终用到的提示词和参数截图存一份。下次做类似风格的东西,直接翻截图照着填,省得重新试。Runway的项目文件可以导出备份,也可以分享链接给协作者。不过分享之前记得检查一下,有没有把不该公开的素材传上去。我就干过一次蠢事,把带客户Logo的测试图传到了公开项目里,幸好发现得早。

理解文生视频、图生视频与视频转视频模式

文生视频就是纯打字,你描述什么它生成什么。这个模式最自由,也最考验提示词功底。我一开始觉得文生视频最酷,后来发现它有个问题:你对构图的控制力很弱。你说“一只鸟在树枝上”,它可能给你一只鸟在电线杆上,也可能给你三只鸟在树枝上。图生视频就不一样了,你先扔一张图片进去作为首帧,模型顺着这张图往下动。构图基本锁死了,你只需要描述运动方式和镜头走向。我做产品广告的时候,图生视频用得最多,因为产品位置不能乱跑。

视频转视频是给现有视频换风格。你把一段实拍视频传上去,写个提示词说“变成赛博朋克夜景风格”,它就能把白天变成黑夜,把普通街道变成霓虹灯巷子。这个模式适合做风格化处理,比如老照片动起来、水彩画效果、动漫滤镜。我试过把一段手机拍的街景转成油画风格,边缘处理得挺自然,就是运动剧烈的地方偶尔会糊。

三种模式我现在的使用比例大概是:图生视频六成,文生视频三成,视频转视频一成。新手建议从图生视频入手,因为反馈最直观。你看到生成结果跟原图差太多,就知道是提示词写偏了。文生视频的随机性大,容易打击积极性。我教过一个零基础的朋友,直接让他用图生视频做,第一段就出了能看的片子,他特别兴奋。反过来先玩文生视频的人,经常抽了十几次卡还没找到感觉。

Runway Gen-3 操作界面与核心功能区域说明

Gen-3的操作界面其实挺简洁的。中间一大块是预览区,生成结果在这里播放。左侧是工具栏,切换不同生成模式、上传素材、查看历史记录。右侧是参数面板,提示词输入框在最上面,下面跟着时长选择、运动强度滑块、种子数值、镜头运动预设。底部有一条时间线,你生成的每段素材会按照顺序排列,可以拖动调整。刚开始我总把参数面板和工具栏搞混,点了半天发现点错了地方。用两天就习惯了,肌肉记忆比脑子快。

提示词输入框下面有个小箭头,点开能看到高级选项。里面可以设置负面提示词、风格参考图、运动笔刷。运动笔刷这个功能很实用,你可以在预览画面上涂一个区域,告诉模型“只让这个部分动起来”。比如人物站着不动,只让头发飘。我拍产品视频的时候,用运动笔刷圈住杯子里的液体,让它微微晃动,真实感一下就上来了。种子数值决定每次生成的随机起点,同一个种子加同一个提示词,结果基本一致。你想复现某个满意效果,就记下种子号。

界面右上角有个“Generate”按钮,点下去之后进度条会走。免费版有时候要排队,高峰期等个几分钟很正常。生成完了自动出现在预览区,下面有四个小图标:下载、重新生成、延长时长、删除。我建议每次生成完先别急着删不满意的,有些片段单独看一般,剪进时间线里跟别的素材一拼,节奏感反而对了。我就有过这种经历,一段废片当转场用,效果出奇地好。

导出格式、分辨率、时长限制与版权注意事项

导出的时候,Runway默认给你MP4格式,H.264编码。这个格式发抖音、B站、YouTube都没问题。分辨率选项有720p、1080p,部分方案能到4K。免费版导出带水印,而且分辨率锁在720p。标准版以上可以去水印,1080p随便导。我一般做短视频就导1080p,做概念片提案会导4K,文件大但投影看细节清楚。时长限制方面,Gen-3单次生成最长十秒。你想做更长的片子,得生成多段拼接。拼接的时候注意动作衔接,前一段结尾和后一段开头要对得上,不然看起来像卡带。

版权这件事我得认真说两句。Runway生成的视频,你用来做个人项目、发社交媒体、参加非商业比赛,基本没问题。商业用途要看你的订阅方案,免费版生成的素材商用有风险。另外你上传的参考图、视频,必须是你自己有版权的,或者有明确授权。我见过有人拿明星照片做图生视频,生成完发到网上,结果被平台下架还吃了警告。模型本身不审查版权,但平台会。保险的做法是用自己拍的素材,或者用无版权图库的图片。

还有一个容易忽略的点:生成内容里如果出现了 recognizable 的品牌Logo、名人脸、受保护的角色形象,哪怕是你无意中生成的,也可能惹麻烦。我现在的习惯是,提示词里避开具体品牌名和真人姓名。想要某个风格,就描述风格特征,比如“复古胶片感”“赛博朋克霓虹灯”,而不是直接写“王家卫风格”。导出之前我会快速过一遍画面,确认没有不该出现的东西。多花两分钟检查,省得后面扯皮。

3.1 Gen-3 文生视频:提示词结构与镜头语言描述

我刚开始用文生视频的时候,以为提示词就是写一句“一只猫在沙发上睡觉”这么简单。结果生成出来的画面要么猫缺了半条腿,要么沙发变成了床。后来我才明白,Gen-3的提示词需要像写分镜脚本一样去组织。一个有效的提示词结构通常包含四块:主体、动作、环境、镜头语言。比如“一个穿红色风衣的女人,在雨夜街头快步走,中景跟拍”,这里面主体是女人,动作是快步走,环境是雨夜街头,镜头语言是中景跟拍。这四块凑齐了,模型理解起来就清楚很多。我试过只写“女人在街上走”,出来的画面要么静止不动,要么视角乱飘。加上镜头语言之后,画面立刻有了电影感。

镜头语言这块,Gen-3支持不少专业术语。推、拉、摇、移、跟、升降,这些词它都能听懂。景别也有区分:特写、近景、中景、全景、远景。我习惯在提示词末尾加上“35mm镜头”“浅景深”“手持跟拍”这类描述,出来的质感会明显不一样。有次我写“一个老人坐在长椅上,特写,缓慢推近”,生成的画面从半身慢慢推到脸部皱纹,情绪一下就出来了。反过来,如果你想要大场面,可以写“广角,航拍,缓慢拉远”,模型会给你一个开阔的视角。这些镜头术语不需要你亲自扛摄像机,但写进提示词里,模型就知道该怎么运镜。

还有个容易踩的坑,是提示词里别塞太多矛盾的动作。我试过写“一个人同时跑步和跳舞”,结果生成出来的人像在抽筋。Gen-3对动作的理解比较线性,一个镜头里最好只做一件事。你要表现复杂动作,可以拆成两段生成,后期剪在一起。另外,主体和环境之间要有合理的互动逻辑。写“一只鱼在沙漠里游泳”不是不行,但模型可能会给你一坨奇怪的东西。刚开始练的时候,尽量选生活里常见的场景,比如“咖啡杯放在木桌上,热气飘动,特写,固定镜头”。这种提示词生成的成功率很高,也能帮你快速建立对模型能力的感知。

3.2 Gen-3 图生视频:首帧选择、风格控制与动态引导

图生视频是我现在用得最多的模式,大概占我工作量的六成。它的逻辑是你先给一张图作为首帧,模型顺着这张图往下生成动态。首帧选得好不好,直接决定了最终视频的上限。我一般会用两种图:自己用相机拍的素材,或者用Midjourney生成的插画。自己拍的照片细节真实,生成出来的运动也自然。插画风格的首帧适合做动画感强的片子,比如绘本风、赛博朋克风。首帧图片的分辨率别太低,至少1080p,不然生成出来会糊。构图也要注意留出运动空间,比如人物朝向右边,右边就多留一点空白,模型会顺着方向让人物走过去。

风格控制方面,图生视频的提示词要侧重描述运动,而不是重复描述静态画面。因为静态部分已经被首帧锁死了。我写提示词的时候,会把重点放在“怎么动”上。比如“头发轻轻飘动,镜头缓慢右移,背景光影变化”。如果你在提示词里写“一个穿红裙子的女人”,模型会忽略,因为首帧里已经穿了红裙子。有次我犯傻,在图生视频的提示词里详细描述人物的长相和衣服,结果生成出来跟首帧完全不像。后来我学乖了,只写动作和镜头。风格控制还可以通过“风格参考图”功能实现,你上传一张风格图,模型会把那种色调、笔触迁移过来。我做过一个水彩风格的短片,首帧是实拍照片,风格参考图选了一张水彩画,生成出来的效果像手绘动画。

动态引导这块,Runway给了两个工具:运动笔刷和方向箭头。运动笔刷就是你在预览画面上涂一个区域,告诉模型“只让这里动”。我拍产品视频的时候,经常用运动笔刷圈住杯子里液体的表面,让它微微晃动,杯身保持静止。方向箭头是拖一个箭头出来,指定运动方向。比如你想让云往左飘,就画个左箭头。这两个工具配合使用,控制力会强很多。我有个做MV的朋友,用运动笔刷刷出人物头发飘动的区域,再画个向上的箭头,生成出来的头发飘动特别自然。记住一点,图生视频的运动幅度别设太大。首帧本身已经提供了很强的构图信息,运动太剧烈容易让画面崩坏。我一般先用低运动强度试,满意了再慢慢往上调。

3.3 关键参数设置:时长、运动强度、种子与镜头运动

Gen-3的参数面板看着简单,但每个选项都影响最终结果。时长方面,单次生成最长十秒。五秒适合做转场或特写,十秒适合有完整动作的镜头。我刚开始总选十秒,觉得越长越好。后来发现十秒的生成时间更长,点数消耗也更多,而且中间容易出瑕疵。现在我会根据用途来选:发短视频的片段用五秒,做概念片的关键镜头用十秒。时长选好之后,运动强度滑块是第二个要调的。运动强度从1到10,数值越高动作越大。我做人物走路,一般设4到5;做风吹树叶,设2到3;做爆炸或者快速追车,才会设到7以上。数值太高,画面容易扭曲变形,尤其是人脸。有次我把运动强度拉到10,生成出来的人脸像融化的蜡像。

种子数值是复现满意效果的关键。同一个种子加同一个提示词,生成结果基本一致。我每次生成了喜欢的画面,第一件事就是记下种子号。下次想微调,就锁定种子,只改提示词里的一个词。这样能清楚知道是哪个词影响了结果。镜头运动预设是给懒人准备的,里面有左移、右移、推近、拉远、环绕等选项。我一般不用预设,而是在提示词里手动写,因为手动写更灵活。不过新手阶段用预设能快速出效果。我教过一个朋友,他直接用预设里的“缓慢推近”,配合图生视频,第一段就出了能看的镜头。还有个细节:种子数值旁边有个小锁图标,点一下锁定,之后生成都会用同一个种子。你要做角色一致性或者场景连贯性,这个功能特别有用。

3.4 提示词进阶:光影、材质、情绪与叙事节奏控制

写到一定程度之后,你会发现基础提示词已经不够用了。想让画面有质感,得在光影和材质上下功夫。光影方面,Gen-3能理解“柔光”“硬光”“逆光”“侧光”“黄金时刻”“蓝调时刻”这些词。我写提示词的时候,会直接指定光源方向。比如“人物左侧打来暖色侧光,右侧留阴影”,生成出来的立体感会强很多。材质描述也很重要。“金属反射”“玻璃透明”“布料褶皱”“皮肤纹理”,这些词能让模型关注到表面细节。我做过一个手表广告的测试,提示词里加了“不锈钢表壳反射环境光,蓝宝石玻璃镜面”,生成出来的表盘质感接近实拍。不加这些词,表壳看起来像塑料。

情绪和叙事节奏是更高阶的控制。情绪可以通过光线、色彩、动作速度来暗示。写“冷色调,缓慢动作,人物低头”传递出压抑感;写“暖色调,轻快脚步,阳光洒落”传递出愉悦感。Gen-3对情绪词也有反应,比如“紧张的”“宁静的”“孤独的”。我试过在同一场景下,只改情绪词,生成出来的氛围完全不同。叙事节奏控制指的是你希望这个镜头在整部片子里起什么作用。如果是开场镜头,可以写“缓慢拉远,建立环境”;如果是高潮镜头,写“快速推近,手持晃动”。我剪片子的时候,会把不同节奏的镜头分开生成,再按需要拼在一起。有个小技巧:在提示词末尾加上“慢动作”或者“延时摄影”,模型会调整运动速度。我做咖啡滴落的镜头,加了“高速摄影慢动作”,液体下落的细节特别清晰。

3.5 生成失败原因排查与多轮迭代优化方法

生成失败是家常便饭。我统计过自己的失败案例,大概分四种原因。第一种是提示词矛盾,比如“静止的跑步者”。模型左右为难,最后给你一个扭曲的人形。第二种是运动强度太高,画面崩坏。第三种是内容触发了审核,比如出现了真人明星的脸或者暴力画面。第四种是分辨率或时长设置超出了当前方案的限制。排查的时候,我有个笨办法但很管用:把提示词砍到只剩主体和动作,其他全删掉,用Turbo模型快速生成一次。如果这次成功了,说明问题出在被删掉的描述词里。如果还是失败,那可能是图片或者参数的问题。我一般会准备一个“简化版提示词”作为测试基准。

多轮迭代优化,关键是每次只改一个变量。我见过有人一次性改提示词、改种子、改运动强度,生成出来效果好了,但根本不知道是哪个改动起了作用。我的习惯是:第一轮生成四版,选最好的一版。第二轮锁定种子,只改一个形容词,比如把“柔光”改成“硬光”。第三轮再改另一个参数。这样一步步逼近想要的效果。有时候生成结果不理想,不一定是提示词的问题,可能是首帧图片本身就不适合做动态。比如一张人物闭着眼睛的图,你想让他眨眼,模型很难做到。换一张睁眼的图,效果立刻就好。我还有个私人技巧:把生成失败的片段下载下来,用剪辑软件倒放或者变速,有时候能变废为宝。有段生成失败的风吹头发,倒放之后像头发被吸回去,用在科幻片里特别合适。多试多错,错着错着就找到感觉了。

4.1 从脚本到分镜:AI视频前期策划与视觉设计

很多人做AI视频,打开Runway就开始敲提示词,生成一堆片段再想怎么拼。我以前也这样,做出来的东西像素材垃圾场,画面好看但讲不成一件事。后来我把流程倒过来:先写脚本,再拆分镜,最后才进Runway。脚本不用写得多专业,我一般用最笨的办法,拿手机备忘录写一段大白话。比如“一个上班族早上赖床,匆忙出门,赶地铁,到公司发现是周末”。这段话里藏着四个场景,每个场景对应一到三个镜头。写脚本的时候我会问自己一个问题:这个故事用一句话能不能说清楚。说不清,说明还没想透,别急着生成画面。

脚本定下来,我把它拆成镜头表。Excel或者Notion都行,列几个字段:镜号、时长、景别、画面内容、运动方式、情绪基调。举我上个月做的一个咖啡广告,镜号01是“特写,咖啡豆落入杯中,慢动作,暖光”,镜号02是“中景,手拿杯子走向窗边,跟拍,逆光”。这张表格填完,我脑子里已经有片子的雏形了。拆镜头有两条路:一条是按叙事逻辑拆,一条是按生成难度拆。前者保证故事连贯,后者保证每个镜头都能做出来。我一般先按叙事拆,再回头看哪些镜头模型搞不定,用更简单的方式替代。

视觉设计这块,我习惯先定三样东西:色板、光源方向、镜头质感。色板决定整片气质,我在Pinterest或者Adobe Color上找一组参考图,存成一个文件夹。光源方向最好统一,别这个镜头左边打光,下个镜头右边打光,剪在一起会跳。镜头质感可以用关键词锚定,我常在提示词里反复出现“35mm胶片颗粒”“浅景深”“柔光罩”这类描述。有了这三样,整个片子的视觉语言不会散。分镜图我不用手绘,直接拿参考图或者Midjourney生成的静帧当分镜,Runway生成的时候还能拿来当首帧,一举两得。做前期策划花的时间,比后期返工省下的时间多得多。

4.2 素材生成与多次抽卡:角色一致性、场景连贯性

抽卡这个词从游戏里借来的,用在AI视频生成上特别贴切。同一个提示词跑四次,出来四个版本,你挑一个顺眼的。我做项目的时候,一个镜头抽四到八次是常态。抽卡不是瞎抽,每次抽完我会记下种子号、提示词版本、参数设置。这些记录攒多了,就成了自己的数据库。下次做类似镜头,直接翻记录找技巧,省掉大量试错时间。Runway的生成速度不算快,十秒片段排队等个两三分钟很常见,所以我一般同时开几个标签页,一边生成一边做别的事。抽卡抽到麻木的时候,我会停下来看一遍已经生成的素材,按镜头表逐个打勾,进度条一点点往前走,心里踏实不少。

角色一致性是AI视频里最头疼的问题之一。我试过让同一个角色出现在五个镜头里,结果生成出来像五个不同的演员。解决思路有三条。第一条,锁定首帧。先用一张角色定妆照生成第一个镜头,后面所有镜头都拿这张定妆照当首帧,或者用上一镜的末帧当下一镜的首帧。第二条,锁定种子。同一个种子加微调后的提示词,角色的脸部特征会稳定很多。第三条,用风格参考图把整片色调统一,脸型差异在统一色调下会被弱化。我现在做角色一致性,会同时用这三招,效果最好的是首帧延续法。有个做系列短剧的朋友,他建了一个角色库,每个角色存五张不同角度的定妆照,每次生成新镜头就从库里挑一张当首帧,熟练之后角色基本不会跑偏。

场景连贯性比角色一致性稍容易些,诀窍是保持环境描述的“锚点词”不变。比如咖啡馆这个场景,我每次提示词里都写“深棕色木质吧台,暖黄色吊灯,背景有模糊的窗户”。这几个词就是锚点,改别的描述可以,锚点不能动。运动方式也得考虑场景逻辑。上一镜人物从左往右走,下一镜如果突然从右往左走,观众会晕。我在分镜表里会标注每个人物的运动方向,生成的时候盯着这个方向走。抽卡抽出来的素材,不是每一条都能用。我的经验是,十段素材里能挑出三段合格的,就算运气不错。废片别急着删,放到一个“废片库”文件夹里,有时候剪片子缺个反应镜头,翻废片库能捡到宝。有次我抽废的一段风吹树叶,倒过来用成了沙尘暴的铺垫镜头,观众完全没看出来。

4.3 Runway编辑工具:剪辑、合成、遮罩与关键帧应用

Runway的编辑功能经常被低估,很多人只把它当生成工具用,生成完导出到别的软件剪。我早期也这样,后来在Runway里把一整条片子剪出来,才发现它的工作流可以闭环。Runway自带的剪辑时间线虽然不如Premiere精细,做短片和广告够用了。我的习惯是,生成完所有素材就在Runway里粗剪一遍,把节奏定下来,再决定哪些镜头需要重新生成。这个顺序很重要。先剪后补,不会出现生成了一堆用不上的素材的情况。剪辑的时候我会开两遍:第一遍纯看画面节奏,不看细节;第二遍逐帧检查过渡点的瑕疵,做AI视频的人都知道,两个片段拼在一起的地方最容易露馅,背景颜色差一点、光位变一点,观众都能看出来。

合成这块,Runway的图层堆叠和混合模式能做出不少效果。我做过一个产品广告,把产品实拍素材和一个AI生成的动态背景叠在一起,用正片叠底模式,产品边缘的融合度比想象中好。遮罩是我用得最多的工具。Runway的遮罩可以手动绘制,也可以用自动分割。我拍人物访谈的时候,用遮罩把人抠出来,背景换成AI生成的场景,省掉了绿幕和布光的成本。遮罩边缘的羽化值很关键,调太小边缘生硬,调太大人物会发虚。我一般设三到五像素,具体看素材的分辨率。有个细节,遮罩在国内外的生成时间不一样,遮罩图层越多,渲染排队越久,能合并的图层尽量合并。

关键帧功能让静态图片动起来,这是Runway里被我低估了很久的功能。关键帧的原理是,你可以在时间线上给图层的位置、缩放、旋转打点,软件自动补间。我用它做片头字幕、做产品旋转展示、做镜头推拉。有次做概念片,我把一张AI生成的插画打了三个关键帧,从全景推到人物特写,再缓缓拉回,观众以为是实拍运镜。关键帧配合遮罩用,能做局部动画。比如画面里有辆车,我用遮罩圈住车轮,给车轮图层打旋转关键帧,车就动起来了。这个技巧做机械类、科技类的视觉很出效果。我踩过的坑是,关键帧打得太密反而不好,软件补间会抖动。两个关键帧之间留足够的时间,运动曲线选缓入缓出,出来的动感最自然。

4.4 音频、配音、音效与字幕的整合制作

我做第一条AI视频的时候,只顾着画面,导出后自己看了一遍,感觉像在看默片。声音对观感的影响,可能比画面还大。现在我的流程里,音频和画面是同步推进的。配音我主要用两个工具:ElevenLabs和Runway自带的语音功能。ElevenLabs的中文音色自然度不错,情绪调节也方便。Runway自带的语音胜在集成度高,不用来回导文件。配音稿我会根据成片时长做调整,AI配音的语速比真人快,同样一段话,真人念要十秒,AI可能八秒就念完了。我一般把稿子写长一点,生成后掐头去尾,比稿子不够用再补写要方便。

音效是提升质感的关键。我建了一个自己的音效库,分几大类:环境音、动作音、转场音、情绪铺垫音。环境音解决的是“空”的问题,画面再漂亮,没有环境音就是悬浮的。我做雨夜街头那段,背景加了雨声和远处车流声,画面立刻有了空间感。动作音要卡点,脚踩水坑、杯子放桌面、衣服摩擦,这些声音对上了,观众才会觉得画面是真的。Runway本身不提供音效库,我用的素材主要来自Freesound和Artlist,前者免费,后者付费但质量高。音乐这块,我用Suno生成背景配乐,或者从Epidemic Sound里挑。音乐的情绪要和画面匹配,我剪片子的时候会先铺一条音乐轨,画面跟着音乐节奏走,这样出来的成片节奏感强很多。

字幕的整合,很多人放到最后才做,我建议在剪辑中期就加。Runway有自动字幕生成功能,准确率对英语还不错,中文识别一般,需要手动校一遍。我习惯把字幕当成视觉元素来设计,字体、大小、位置、出现时机都调。短视频平台的字幕要够大够粗,手机屏幕小,字太小根本看不清。位置放在画面下方三分之一处,别压到人物的脸。有个技巧是用字幕制造节奏,短句字幕配合快速剪辑,长句字幕配合缓慢运镜。我做过一条知识类短片,字幕一行行跳出来,每行停留时间精确到帧,观众的注意力被字幕带着走,看完率比不加字幕的版本高了不少。字幕软件我用剪映或者ArcTime,Runway导出的成片再进这些软件加字幕,流程顺。

4.5 成片导出与多平台发布:短视频、广告与概念片

导出这一步,参数选错,前面所有努力打折扣。Runway导出的分辨率选项里,1080p是最稳妥的,4K对多数平台来说过剩,上传后还会被二次压缩。码率我一般选高,宁可文件大一点。帧率看用途,做短视频用30帧,做广告或者概念片用24帧更有电影感。导出格式选MP4,H.264编码,兼容性最好。有个容易被忽略的点是色彩空间,Runway导出的默认色彩偏灰,我导出后会在剪辑软件里做一次色彩校正,把对比度和饱和度拉一拉,画面立刻精神起来。做竖屏短视频的话,生成素材的时候就要按9:16的比例来,别等剪的时候再裁,裁完构图全乱了。

不同平台的发布策略差别很大。抖音、快手、视频号这类竖屏平台,前两秒决定生死,我会把最抓人的镜头放在开头,标题字幕直接打在画面上。B站和小红书可以稍微铺陈,观众有耐心看铺垫。YouTube适合横屏长内容,广告片和概念片放这里最合适。发布的时候,标题和封面图的重要性不亚于视频本身。我用Runway生成封面图,挑成片里最好看的一帧,加个大字标题。发布节奏上,我习惯一次做三条不同版本的片子,分别针对不同平台,测试哪个版本数据好,下一批就按这个方向做。做AI视频的人容易陷入技术自嗨,画面酷炫但没人看。发布后的数据反馈才是真正的老师,完播率、点赞率、评论内容,这些信息帮你判断观众到底想要什么。

概念片和广告片的导出,还有几个讲究。广告片通常有品牌方的格式要求,交付前要确认分辨率、时长、字幕规范、logo位置。概念片自由度大,我做过一些实验性的短片,导出的时候会同时存一版无字幕、无音乐的干净版本,方便后期换配乐重剪。成片导完,我会自己完整看三遍。第一遍看整体,第二遍戴耳机听声音,第三遍静音看画面。三遍都过了,才发出去。做AI视频最爽的时刻,是把所有碎片拼成一条完整片子,导出进度条走完的那一刻。那种从一堆抽卡素材变成一部作品的感觉,值回前面所有的折腾。

5.1 实战案例一:产品广告短片从0到1制作演示

上个月我接了一个护手霜的小广告,客户要求30秒竖屏,预算不高,时间给了一周。我拿到产品图之后,先写了一段旁白稿:手部干裂,涂上护手霜,纹理变淡,阳光下皮肤透亮,产品定格。六个镜头,每个三到五秒。脚本定了,我打开Runway,第一个镜头用文生视频,提示词写“特写,女性手部,干燥皮肤,微距,冷色调,轻微纹理”。抽了四次卡,选了一条手指微微蜷缩的动态,自然。第二个镜头用图生视频,首帧是客户提供的产品实拍图,提示词加“膏体挤出,缓慢推开,柔光”。这里踩了个坑,Runway审核提示“膏体”这个词可能涉及敏感内容,我换成“乳液状物质”就过了。

六个镜头生成完,花了一天半。我把素材拖进Runway时间线粗剪,按脚本顺序排好,节奏偏慢。配乐用Suno生成了一段轻钢琴,音量压到人声下面。旁白用ElevenLabs,中文女声,念了四遍选一版。导出1080p竖屏,进剪映加字幕和产品logo。客户看完提了两个修改:第三个镜头太暗,产品特写不够突出。我把第三个镜头的提示词加了“明亮,高调,柔光箱”,重新抽卡。产品特写换成了图生视频,首帧用产品白底图,背景生成虚化的浴室场景。整个项目从沟通到交付花了五天,成片客户很满意,投放到小红书和抖音,点击率比他们之前的实拍广告高了两成。做产品广告,产品本身不能变形,生成的时候运动强度别调太高,0.3到0.5之间最稳。

5.2 实战案例二:叙事短片与风格化MV创作思路

叙事短片我做过一个《深夜便利店》,讲一个男生凌晨去买泡面,遇到一个同样失眠的女孩。两个人没说几句话,靠眼神和动作推进。这个故事没有强情节,靠情绪曲线撑。我先把情绪拆成五段:疲惫、偶遇、犹豫、靠近、分开。每段配一个主镜头。角色一致性用首帧延续法:先拿一张男生定妆照生成第一个镜头,后面每个镜头都拿上一镜的末帧当首帧。女孩的镜头单独跑一条线,最后在剪辑里交叉。有个镜头男生低头看泡面,女孩在背景里走过,我抽了十二次才抽到背景人物不糊的版本。叙事短片最怕观众看不懂关系,我在字幕里加了时间戳和地点,比如“凌晨2:17,便利店”,帮助观众进入情境。

风格化MV完全是另一套玩法。我给一首电子乐做视觉,整片没有故事,靠节奏和色彩冲击。提示词里反复出现“霓虹紫,赛博朋克,液态金属,频闪”。每个镜头生成四秒,抽卡抽了六十多条,选出来拼成三分钟。MV里大量用了Runway的关键帧功能,把静态的AI插画做推拉摇移。有个镜头是液态金属缓慢包裹人脸,我用遮罩圈住脸部,给金属层打缩放关键帧,配合音乐重拍切换。抽卡抽出来的废片也没浪费,倒放、变速、加色差,变成转场素材。做MV比做叙事短片自由,但工作量更大。我的经验是,先铺音乐轨,看着波形图标记重拍点,每个重拍点对应一个视觉变化。观众不一定看懂每一帧,但节奏对上了,身体会跟着动。

5.3 常见问题FAQ:生成慢、模糊、变形与审核限制

生成慢是问得最多的问题。Runway的排队时间跟服务器负载有关,晚上八点到十一点最慢,早上六点到九点最快。我一般把大批量生成放在早上,一边吃早饭一边开着标签页。同时开三四个项目,一个在排队,一个在抽卡,一个在剪辑。十秒的Gen-3片段等两三分钟是常态,别盯着进度条看,去写下一个镜头的提示词。有个技巧是先用低分辨率跑一遍看动态,动态满意了再跑高分辨率。这样省时间也省点数。模糊的问题,八成是分辨率设低了。导出选1080p,提示词里加“清晰,细节丰富,锐利对焦”。图生视频比文生视频清晰度高,首帧质量决定上限。首帧糊,生成出来一定糊。

变形通常跟运动强度有关。运动强度拉到0.8以上,人脸和手容易扭曲。我一般控制在0.4到0.6。人物走动、转身这类动作,用图生视频加首帧,比纯文生视频稳。如果还是变形,把镜头拆短,三秒一个动作,别让模型一次生成太复杂的运动。审核限制这块,Runway对暴力、血腥、性感、名人肖像卡得严。提示词里出现“刀”“血”“比基尼”直接拒。我的办法是用隐喻:刀写成“金属反光条”,血写成“红色液体”,性感写成“优雅姿态”。名人名字换成“三十岁男性,短发,微笑”。被拒了别反复提交同一个词,换个说法,等几分钟再试。有次我写“雨中奔跑”,审核过了,写“雨中追逐”就被拒了。差一个词,结果完全不同。

5.4 提示词库、模板与Runway Gen-3学习资源推荐

我自己的提示词库是一个Notion表格,按场景分类:人物、风景、产品、抽象、转场。每个分类下面存二十到三十条验证过的提示词,标注了种子号和参数。比如人物类里有一条“特写,亚洲女性,三十五岁,短发,自然光,浅景深,35mm胶片颗粒,皮肤纹理清晰”,这条我跑过十几次,脸部稳定。产品类里有一条“白色背景,产品缓慢旋转,柔光箱,高调,微距,4K细节”,适合做电商展示。模板方面,我做了三个:镜头运动模板、光影模板、情绪模板。镜头运动模板里列了推、拉、摇、移、跟、升降对应的英文关键词。光影模板分自然光、人工光、混合光。情绪模板分平静、紧张、欢快、忧郁,每个情绪配五组形容词。这些模板不复杂,用起来省脑子。

学习资源我常看几个地方。Runway官方有Academy页面,里面有Gen-3的提示词指南和案例拆解,免费。YouTube上Matt Wolfe和Curious Refuge的频道更新快,讲实战技巧多。Reddit的r/runwayml板块,每天有人分享抽卡结果和参数,我经常去翻。Discord的Runway官方社区,提问回复快,官方人员偶尔出现。中文资源里,B站有几个UP主做Runway教程,搜“Runway Gen-3 教程”能出来不少。付费资源我买过Curious Refuge的AI视频课程,讲叙事结构比较深,适合进阶。提示词库网站PromptHero和PromptBase可以逛,但别照抄,里面的词偏Midjourney风格,Runway吃不太动。我建议每天花二十分钟刷社区,看到好提示词就存进自己的表格,一个月下来素材库就很厚了。

5.5 总结:Runway教程持续进阶路线与创作建议

回头看我自己学Runway的路线,大概分四步。第一步玩文生视频,瞎写提示词,出来什么算什么。第二步学图生视频,开始控制首帧和风格。第三步研究参数和种子,做角色一致性和场景连贯。第四步把Runway放进完整工作流,从脚本到分镜到剪辑到发布。每一步都对应一批新问题,解决完就上一个台阶。我建议新手别跳过第二步直接做长片,先拿十个短镜头练手,每个镜头抽四到八次,记录哪些词有用哪些词没用。练完十个镜头,你对提示词和参数的感觉就有了。进阶的话,重点攻角色一致性和运动控制。这两个问题解决了,才能做叙事内容。

创作建议方面,我讲三条。第一条,故事永远比画面重要。Runway能生成惊艳的镜头,但观众记住的是情绪和人物。第二条,声音是另一半。画面再好,没声音就是半成品。配音、音效、音乐,一样别省。第三条,建立自己的素材库和废片库。抽卡抽出来的废片,换个用法就是宝。我有个“备用”文件夹,里面存了三百多条短素材,剪片子缺过渡镜头就去翻。Runway的版本更新很快,Gen-3之后还有Gen-4,工具会变,底层的能力不变:审美、叙事、节奏感。把这三样练好,换什么工具都能做出好东西。做AI视频最开心的时刻,是观众看完片子问“这是怎么拍的”。你告诉他“AI生成的”,他瞪大眼睛说“不可能”。那种反馈,比多少个赞都值。

版权声明
文章版权声明:除非注明,否则均为ZBLOG原创文章,转载或复制请以超链接形式并注明出处。
分享到
chuanbook

评论

发表评论

请文明发言,共同维护良好交流氛围。
链接已复制到剪贴板