作者:互联网 时间: 2026-09-05 10:36:53
在人工智能内容学习中,可灵AI多图参考从素材准备到生成视频完整教程是常见主题。很多人在阅读时会遇到概念分散、步骤不清和注意点难以归纳的问题。本文按照基础概念、操作流程和关键细节,对相关内容进行整理。
必须使用v3.0.2+电脑端客户端,经【视频生成→图生视频→多图参考】路径进入,上传2–4张统一格式、主体一致、无水印的正方形参考图,并配以精确动词+部位+方向的提示词方可生成连贯稳定视频。
要用可灵AI基于多张参考图生成连贯、人物形象稳定的视频,必须严格满足图片数量、格式、主体一致性与模型版本等硬性条件,缺一不可。
第一步:打开电脑端可灵AI客户端,检查左下角版本号——【必须为v3.0.2或更高】,网页版和手机App完全不支持此功能。
第二步:点击左侧导航栏【视频生成】→顶部选项卡切换至【图生视频】→再点【多图参考】,此时界面右上角会显示“视频1.3”且不可更改。
第三步:若未看到【多图参考】按钮,说明当前登录账号未开通该权限,需前往官网提交企业认证或升级为Pro会员。
方法一:按视角差异准备2–4张图
① 选同一人/物,无遮挡、无镜像翻转、无严重透视畸变;正面、侧45°、背面、局部特写(如手、鞋)各一张最稳妥。
② 所有图片统一导出为JPG或PNG,短边不低于300px,强烈推荐裁切为1024×1024正方形——尺寸不一致会导致AI误判空间关系,生成后肢体错位概率超70%。
③ 光照方向尽量统一,避免一张顶光、一张逆光、一张阴影过重;色温偏差大会让AI认为是不同时间拍摄的不同主体。
方法二:用即梦AI预生成角色库再导出
先在即梦AI中输入详细人物设定(发色/脸型/服饰/神态),生成5–10张不同角度的标准图,人工筛选出最符合预期的2–4张,再导入可灵。这比实拍图更可控,尤其适合虚拟角色。
【注意:绝对不要上传带水印、文字标注或PS拼接痕迹的图,AI会把水印识别为画面元素并动态化】
将准备好的2–4张图一次性拖入界面中央虚线框,系统自动编号为图1→图4;顺序会影响AI理解动作起始帧,建议图1为起始姿态,图4为结束姿态。
提示词必须含明确动词+部位+方向,例如:“青年男子右臂前伸握剑柄,左膝微屈下蹲,身体向左旋转15度,衣袍随动扬起”。
删掉所有模糊副词——“缓缓”“轻轻”“似乎”“大概”全删;把“走路”改成“左脚先行,步幅25cm,足跟先着地”,把“挥手”改成“小臂以肘为轴向外展开30度,五指自然张开”。
右侧参数面板中,时长固定为4秒,不可调;分辨率锁定为1080p,帧率自动匹配模型最优输出。