图生视频完整教程:让一张老照片动起来的 5 种玩法上个月我妈翻出一张 1998 年的全家福,边角发脆、颜色泛黄。我顺手拿它试了一次图生视频,三分钟后,照片里的奶奶眨了下眼、嘴角微微动了动。我妈盯着屏幕看了好一会儿,没说话。 这就是图生视频最有意思的地方:你给一张静止的图,剩下的交给模型。它比纯文字生成视频好上手太多——人物长什么样、穿什么、站在哪,全由你的参考图说了算,AI 只需要补上"动"这一层。
下面这篇是我自己一边做一边记下来的流程,从挑参考图讲到 5 种具体玩法,参数和翻车排查都放在后面。零基础也能跟着走一遍。 先说一句:为什么我建议你先玩图生视频,别急着玩文生视频纯文字生成视频,模型要同时干两件事:决定画面里有什么,还要决定它怎么动。这两件事绑在一起,结果就非常随机。 我到现在还记得第一次用文生视频写"一个穿红裙的女孩在夕阳下跳舞",生成出来的跟我想的完全不沾边,连试六次才勉强挑出一条能看的。同样的需求换成图生视频——我先用图像模型出一张满意的照片,再让视频模型把它动起来,基本一两次就有能用的。 道理很简单:你先当摄影师把画面定死,再当导演告诉它怎么动。控制权在你手里,而不是在随机数手里。 要是你连视频模型都还没摸过,建议先花二十分钟看 Seedance 2.5 入门教程,把基本流程和提示词写法过一遍,再回来玩这些玩法。 参考图怎么挑?这一步基本决定了成片上限我踩过的坑基本都在这。上传之前照着下面几条过一遍,能省掉很多废片:
老照片还多两个麻烦。一是分辨率低,我一般先用图像模型的放大或者修复功能过一轮再喂给视频模型;二是年代久远、人脸本来就糊,模型有时候会自作主张补成另一张脸。这个问题目前没什么好办法,我的做法是拍的时候镜头拉远一点,别让它长时间怼脸。 5 种玩法,按难度从低到高排玩法 1:让它轻轻动一下(最容易成功,建议从这个开始) 只让画面里的小元素动:头发被风吹、水面起波纹、烟雾慢慢升、裙摆轻轻摆。提示词只写动作,别写运镜。比如:"人物头发随风轻微飘动,背景水面有细微波纹,画面稳定,镜头静止"。 这种成功率最高,我第一次做就过了。拿来当短视频封面也很合适,比纯静态图抓人。 玩法 2:让老照片里的人活过来 就是开头那张全家福的用法。让人物眨眼、微笑、微微转头。 关键就一个字:小。提示词写"人物缓慢眨眼,嘴角微微上扬,轻微转头,动作自然缓慢"。幅度一旦写大——相信我——一秒变成恐怖片,这是我见过新手翻车最多的地方。 玩法 3:让镜头动,画面别动 画面内容不变,改成镜头的运动:缓慢推近、慢慢拉远、从左右横移、绕着主体转一圈。这类最有电影感。提示词写"镜头缓慢推近,焦点始终在人物面部,画面平稳"。 到现在为止,把运镜写进提示词仍然是控制镜头最直接的办法,比调参数好使。
玩法 4:拼成一支真正的短片 单条 AI 视频通常只有几秒,想做正经作品就得拼。我的做法是拿同一张参考图,分别生成远景、中景、特写三条不同运镜的片段,再丢进剪辑软件按顺序接起来,中间加个转场。
这样出来的是有节奏的短片,不是一条被拉长的动图。差别很大。 玩法 5:让插画和 IP 形象动起来 上传插画、卡通形象、品牌吉祥物,让它做指定动作——短视频开头、直播间贴片、产品页动效都能用。 有意思的是,插画类素材线条简单、结构清楚,模型的容错率反而比真人照片高。做 AI 漫剧的时候,这一步就是分镜转视频的核心环节,配合 AI 漫剧全流程指南一起看会更顺。 提示词:图生视频其实只需要写三件事别再描述画面里有什么了,那是图片已经给定的事。你只要写:
套用模板就是:主体 + 动作幅度 + 镜头状态 + 氛围。举个例子——"穿白衬衫的女性缓慢转头看向镜头,动作自然轻微,镜头静止,柔和侧光"。 还有个我犯过的错:别写画面里本来没有的东西。参考图里没猫,你写"一只猫走过来",模型没法凭空加,只能在画面内部硬生生变形出一团东西,看着很吓人。 参数怎么设,才不至于把额度烧光
翻车了怎么办:5 个我常遇到的问题人脸变形、五官漂移。先看参考图里人脸够不够清晰、是不是正对镜头;然后把镜头拉到中景或远景,别长时间面部特写;再把动作幅度调小。这三步做完基本能救回来。 整个画面像泡在水里一样扭。多半是参考图主体和背景分不开。换一张主体突出、背景干净的图,或者先用图像模型抠个图换个背景。 视频闪烁、抖。降低运动强度,提示词里补上"画面稳定、光线稳定、镜头静止"这类约束。 动作做不到位。把一个大动作拆成几个小动作分开生成,再在剪辑里接起来。一次要求它连走带转身,几乎必崩。 每次结果都不一样。这是生成模型的固有特性,别跟它较劲。固定参考图、固定提示词、把随机性参数调低,然后接受一件事:多生成几条,挑最好的那条。 最后说两句图生视频的思路说到底就一句话:把画面交给图片,把运动交给文字。 新手别一上来就挑战多镜头拼接,先用"轻微动态化"成功一次,找到手感,再慢慢加运镜、加镜头组合。真正拉开差距的从来不是你用的模型多贵,而是你对动作幅度的那点判断,和你挑参考图的眼光。 后面还会继续更新 AI 视频方向的实操教程和案例拆解,关注悠悠谷AI的行业资讯栏目就行。 相关阅读 |