
图片生成视频,是一种将静态图像转换为动态视频序列的技术。该技术主要通过计算机视觉与人工智能(如扩散模型),或借助视频编辑工具,为单张或多张静态画面添加时间维度的运动、过渡效果,从而生成连贯的短视频。主流实现路径包括基于AI模型的智能动态化生成,以及使用专业软件或代码工具进行序列合成与编辑。该技术广泛应用于社交媒体内容创作、电商展示、教育演示及创意表达等领域,并扩展至老照片修复与动态化等场景。视频生成技术的发展经历了从早期的基于规则和模板的方法到基于深度学习的方法,再到2025年的基于扩散模型和大型语言模型的方法的过程 。2024年8月,我国自研视频大模型Vidu全球上线,开放图生视频功能 。2024年9月,美图奇想大模型(MiracleVision)视频生成能力升级,支持生成1080P分辨率视频 。为降低推理延迟,业界提出了如LightX2V等轻量级推理框架,通过步数蒸馏等技术将生成耗时压缩至20秒内 。同期,Stable Video Diffusion XT等模型实现了更长视频序列的生成 。进入2026年,技术发展更注重创作流程与一致性,出现了“参考主体”创作模式 。
想要了解更多“图片生成视频”的信息,请点击:图片生成视频百科
