图生视频完整教程:让一张老照片动起来的 5 种玩法

2026-10-04 18:21:04| 发布者:小编 | 查看: 1

首页 / 新闻中心 / 行业资讯

图生视频完整教程:让一张老照片动起来的 5 种玩法

上个月我妈翻出一张 1998 年的全家福,边角发脆、颜色泛黄。我顺手拿它试了一次图生视频,三分钟后,照片里的奶奶眨了下眼、嘴角微微动了动。我妈盯着屏幕看了好一会儿,没说话。

这就是图生视频最有意思的地方:你给一张静止的图,剩下的交给模型。它比纯文字生成视频好上手太多——人物长什么样、穿什么、站在哪,全由你的参考图说了算,AI 只需要补上"动"这一层。

用图生视频让老照片动起来的操作场景

下面这篇是我自己一边做一边记下来的流程,从挑参考图讲到 5 种具体玩法,参数和翻车排查都放在后面。零基础也能跟着走一遍。

先说一句:为什么我建议你先玩图生视频,别急着玩文生视频

纯文字生成视频,模型要同时干两件事:决定画面里有什么,还要决定它怎么动。这两件事绑在一起,结果就非常随机。

我到现在还记得第一次用文生视频写"一个穿红裙的女孩在夕阳下跳舞",生成出来的跟我想的完全不沾边,连试六次才勉强挑出一条能看的。同样的需求换成图生视频——我先用图像模型出一张满意的照片,再让视频模型把它动起来,基本一两次就有能用的。

道理很简单:你先当摄影师把画面定死,再当导演告诉它怎么动。控制权在你手里,而不是在随机数手里。

要是你连视频模型都还没摸过,建议先花二十分钟看 Seedance 2.5 入门教程,把基本流程和提示词写法过一遍,再回来玩这些玩法。

参考图怎么挑?这一步基本决定了成片上限

我踩过的坑基本都在这。上传之前照着下面几条过一遍,能省掉很多废片:

  • 清晰度够不够:短边最好别低于 720 像素。糊图喂进去,出来的只会更糊,而且糊的方式很抽象。
  • 主体别被裁:人物别只剩半个身子,手脚尽量留在画面里。边缘被切掉的部分,模型很喜欢在那儿长出一些奇怪的形状。
  • 主体和背景要分得开:颜色都糊成一片的时候,模型根本分不清哪些该动哪些不该动,整张画面会一起扭。
  • 比例一开始就定对:要做竖屏短视频就准备竖图。拿横图硬裁成竖屏,人会被压得又扁又怪。
  • 少带文字和水印:AI 会把文字当图案来处理,最后出来的是一片乱码在抖。

老照片还多两个麻烦。一是分辨率低,我一般先用图像模型的放大或者修复功能过一轮再喂给视频模型;二是年代久远、人脸本来就糊,模型有时候会自作主张补成另一张脸。这个问题目前没什么好办法,我的做法是拍的时候镜头拉远一点,别让它长时间怼脸。

5 种玩法,按难度从低到高排

玩法 1:让它轻轻动一下(最容易成功,建议从这个开始)

只让画面里的小元素动:头发被风吹、水面起波纹、烟雾慢慢升、裙摆轻轻摆。提示词只写动作,别写运镜。比如:"人物头发随风轻微飘动,背景水面有细微波纹,画面稳定,镜头静止"。

这种成功率最高,我第一次做就过了。拿来当短视频封面也很合适,比纯静态图抓人。

玩法 2:让老照片里的人活过来

就是开头那张全家福的用法。让人物眨眼、微笑、微微转头。

关键就一个字:小。提示词写"人物缓慢眨眼,嘴角微微上扬,轻微转头,动作自然缓慢"。幅度一旦写大——相信我——一秒变成恐怖片,这是我见过新手翻车最多的地方。

玩法 3:让镜头动,画面别动

画面内容不变,改成镜头的运动:缓慢推近、慢慢拉远、从左右横移、绕着主体转一圈。这类最有电影感。提示词写"镜头缓慢推近,焦点始终在人物面部,画面平稳"。

到现在为止,把运镜写进提示词仍然是控制镜头最直接的办法,比调参数好使。

AI 视频生成界面中调整运镜与运动幅度参数

玩法 4:拼成一支真正的短片

单条 AI 视频通常只有几秒,想做正经作品就得拼。我的做法是拿同一张参考图,分别生成远景、中景、特写三条不同运镜的片段,再丢进剪辑软件按顺序接起来,中间加个转场。

剪辑软件时间线上拼接多段 AI 视频片段

这样出来的是有节奏的短片,不是一条被拉长的动图。差别很大。

玩法 5:让插画和 IP 形象动起来

上传插画、卡通形象、品牌吉祥物,让它做指定动作——短视频开头、直播间贴片、产品页动效都能用。

有意思的是,插画类素材线条简单、结构清楚,模型的容错率反而比真人照片高。做 AI 漫剧的时候,这一步就是分镜转视频的核心环节,配合 AI 漫剧全流程指南一起看会更顺。

提示词:图生视频其实只需要写三件事

别再描述画面里有什么了,那是图片已经给定的事。你只要写:

  • 动作:谁在动、怎么动、幅度多大(缓慢 / 轻微 / 快速)
  • 运镜:镜头是固定的,还是推拉摇移
  • 氛围:光线怎么变、有没有粒子、整体是什么调子

套用模板就是:主体 + 动作幅度 + 镜头状态 + 氛围。举个例子——"穿白衬衫的女性缓慢转头看向镜头,动作自然轻微,镜头静止,柔和侧光"。

还有个我犯过的错:别写画面里本来没有的东西。参考图里没猫,你写"一只猫走过来",模型没法凭空加,只能在画面内部硬生生变形出一团东西,看着很吓人。

参数怎么设,才不至于把额度烧光

  • 先用最低规格探路:宽高比调对、时长选最短、分辨率选最低档,先把动作方向确认下来,再上高规格出正式素材。AI 视频很少一次就成,前期拿高规格试错,额度掉得比你想的快。
  • 画幅跟着发布平台走:竖屏短视频用 9:16,横屏视频 16:9,商品图那种场景用方形。
  • 运动幅度尽量写在提示词里:不少平台有单独的运动强度参数,但从提示词里控制更精确。
  • 同样的提示词连着出三到四条:挑最自然的那条。这是我试下来提高出片率最有效的办法,没有之一。

翻车了怎么办:5 个我常遇到的问题

人脸变形、五官漂移。先看参考图里人脸够不够清晰、是不是正对镜头;然后把镜头拉到中景或远景,别长时间面部特写;再把动作幅度调小。这三步做完基本能救回来。

整个画面像泡在水里一样扭。多半是参考图主体和背景分不开。换一张主体突出、背景干净的图,或者先用图像模型抠个图换个背景。

视频闪烁、抖。降低运动强度,提示词里补上"画面稳定、光线稳定、镜头静止"这类约束。

动作做不到位。把一个大动作拆成几个小动作分开生成,再在剪辑里接起来。一次要求它连走带转身,几乎必崩。

每次结果都不一样。这是生成模型的固有特性,别跟它较劲。固定参考图、固定提示词、把随机性参数调低,然后接受一件事:多生成几条,挑最好的那条。

最后说两句

图生视频的思路说到底就一句话:把画面交给图片,把运动交给文字。

新手别一上来就挑战多镜头拼接,先用"轻微动态化"成功一次,找到手感,再慢慢加运镜、加镜头组合。真正拉开差距的从来不是你用的模型多贵,而是你对动作幅度的那点判断,和你挑参考图的眼光。

后面还会继续更新 AI 视频方向的实操教程和案例拆解,关注悠悠谷AI的行业资讯栏目就行。

相关阅读

上一篇
下一篇
QQ在线咨询
售前咨询热线
400-9999-531
售后服务热线
13831235958
返回顶部