Wan 3.0 图片生成视频:让照片动起来
已经有一张满意的照片了?那就给它加上运动,而不是把整个外观再描述一遍。上传照片,只说哪里该动,然后把每一次结果都和原图对照。你可以生成最高 4K 的画面和最长 30 秒的片段。
将静态图片转换为动态视频
提示:越详细具体效果越好。描述主体、风格、光线、氛围和构图。
示例图库
看看你能用 image to-video 创作什么
作品集
滑动浏览示例片段。点按任意视频即可全屏播放。
案例展示
浏览 AI 视频示例片段。点击任意方块即可播放完整片段。













页面中展示的所有视频和图片均为 AI 生成的合成内容,除另有明确说明外,不代表真实人物或真实事件。
Wan 3.0 有哪些新变化
更长的片段、更清晰的画面,起点也更明确
Wan 3.0 让日常的 AI 视频创作更好用。你可以生成最高 4K、最长 30 秒的片段,并且从手头已有的素材出发——文字、一张照片或一段视频。这意味着后期要拼接的碎片更少,也更适合社交广告、产品演示和早期的场景试拍。
最高 4K 输出
当细节重要时,为产品页、广告和客户评审拿到更清晰的画面。
片段最长 30 秒
把一个钩子、一段演示或一个小故事更完整地放进一条片段,不用再拼很多短镜头。
从文字、照片或视频开始
写一个场景、让一张照片动起来,或者在节奏已经合适时给一段视频换个风格。
创作者为什么用 Wan 3.0
对真实项目有实际帮助
在约拍或正式剪辑之前,先做出最长 30 秒的概念片
把产品图和角色图变成动态画面,不用从零重建外观
在手头已有的素材上试试新风格
在浏览器里创作,队友能更快看到样片并给出反馈
怎样加上运动又不改变外观
当外观已经定下来时该怎么做
准备一张适合加运动的源图片
挑一张主体清楚、边缘留有一点余量的清晰画面。裁得太紧,会逼着工具去编造你根本没打算要的细节。干净的光线和稳定的构图,能让运动说明写得更短、也更实在。
把主体运动和镜头运动分开
先说人物或产品在做什么,再说镜头怎么移动。把两者混在一句含糊的话里,往往会削弱控制力。除非你有意要改,别把服装描述写进运动那一行。
加运动的同时保住人物一致
说明哪些必须保持不变——脸、衣服、产品外形——这样在加入运动时,相似度依然是第一优先。简短的稳定性说明胜过长篇的重新设计。如果某一次跑偏了,先把运动要求简化。
描述结尾那一帧
补一小段话说明最后的取景或角度。对结尾的引导,能让主体停在画面里有用的位置。把最后一帧当成一个大致目标,而不是第二次完整的重新设计。
限制背景的运动
只挑少数几个会动的元素,比如布料、蒸汽或光线变化。多余的干扰会破坏你已经选定的外观。收着一点,通常能让人脸和产品边缘在评审时更可信。
没有照片时就用文本生成视频
如果还没有图片,就去文本生成视频页面,别硬要在这里空着上传。这个页面是围绕一张你已经认可的源图片设计的,从文字凭空想象外观应该去别的地方做。
这个工作流怎么用
从上传到关注相似度的评审
上传源图片
从已经定下构图和人物形象的那一帧开始。干净的光线和清楚的主体,能帮生成器保持忠实。如果这张静态图噪点多或者裁得太狠,先把文件处理好。
写运动,而不是重新设计
提示词里写身体或产品的动作,加一个镜头动作。除非这个改动是有意的,别去重写服装、脸或包装。那些问题这张静态图已经回答过了。
生成并比对相似度
看看结果是否还像你上传的那张图。如果相似度下滑,只调整运动那一行。把原图放在结果旁边,问问自己:有什么本该不动的东西动了。
为什么从静态图开始
从一张图片出发能得到什么
第一帧就锁定外观
上传的图片承载了外观,提示词就可以专注在运动上,而不是把主体重新发明一遍。这种分工能减少早期评审里关于颜色、服装和产品外形的争论。
更强的形象锚点
在生成之前,静态图就定下了脸、产品或服装,相似度也因此更容易保持。你保护的是看得见的东西,而不是指望一堆形容词把它重建出来。
创意评审更快通过
参与评审的每个人都已经熟悉这张照片。反馈会集中在运动质量上,而不是一个全新的外观。这种聚焦能缩短会议、让意见更容易执行,尤其是当评审者可以把原图放在每一次结果旁边对照时。
少猜提示词
你描述的是随时间发生的变化,而不是相机已经拍下的每一个视觉细节。更短的提示词更好做版本、更好分享、也更好排查问题。
从设计稿自然衔接
设计师可以导出一帧画面直接加运动,不必把整个概念用文字重写一遍。设计文件依然是外观的唯一依据。
清晰的下一步路径
如果项目之后需要给素材换风格或用多种参考,就转到对应的工具页面。以静态图为主导的工作留在这里,每个工具才能对自己期待的输入保持诚实。
这条路径最能帮上忙的时候
从一张现成画面出发的工作
把产品静图变成动态广告
把产品照片做成短广告,同时让包装和外形保持可辨认。主图大家早就熟悉了,评审可以专注在运动质量上,而不是去想一个全新的外观。
为社交平台做人像微动
给人像加上细微的动作,不用靠一份文字简报把人重新造一遍。当这张人像已经通过评审时,小幅动作加上温和的镜头路径,通常比大改更有效。
把分镜变成动态镜头
在正式开拍之前,用可控的镜头动作让分镜画面活起来。导演可以试试推镜还是横摇更服务这个场景,而手绘的外观依然是参照标准。
房源照片的推镜漫游
把房间照片变成缓慢的推进镜头,展示空间感,同时保留上传图里的建筑结构。目标是把空间讲清楚,而不是造出一间谁都没拍过的幻想改造房。
让活动主视觉动起来
把已定稿的活动主视觉延展成一小段动态画面,同时不丢掉品牌形象。让 logo 区域和产品轮廓保持稳定,把运动放在布料、手部或克制的镜头路径上。
画册片段的起点
把这条路径当作画册视频的起点:在模特开拍之前,先用时装静图测试服装的运动。早期的运动测试能看出垂坠感和廓形在动起来后是否还站得住。
常见问题
上传之前的简短解答
Wan 3.0 图片转视频是做什么的?
用 Wan 3.0 图片转视频,你上传一张照片、描述想要的运动,并在浏览器中得到短视频,再与原图对比。它不是给没有图片的纯提示词用的。
提示词该不该把主体重新设计一遍?
通常不该。让上传的图片决定外观。提示词只写动作、镜头移动,以及确实该改变的那些细节。重新设计式的措辞,最容易让你丢掉“从静态图开始”的意义。
什么样的上传图算好?
主体清楚、边缘干净,并且为想要的镜头动作留出足够空间。裁得太紧会限制镜头能走多远,画质浑浊的文件也让相似度更难保持。
Wan 3.0 图片转视频和文字转视频有何不同?
Wan 3.0 文字转视频从文字生成画面;Wan 3.0 图片转视频从源图出发再加运动。外观已经锁定时选后者。
用 Wan 3.0 加运动时如何保持像本人?
先写明必须稳定的部分,再把提示词限制在该动的部分。去掉改头换面式措辞、背景运动克制,相似度通常更好。
能用很多帧做出一个完整故事吗?
把每张静态图当作一个节拍。分开生成,如果需要更长的序列,再到工具之外去拼。一帧一件事,能让连贯性的决定始终是有意做出的。
什么时候该改用视频转视频?
当你已经有素材要换风格时就换过去。这个页面针对照片,不针对片段。如果节奏已经存在于一条已拍的素材里,视频转视频通常是更合适的去处。
如果脸或产品跑偏了怎么办?
把提示词简化,加强稳定性说明,减少互相冲突的镜头和环境指令。每次重试都和原始上传图做对照。相似度稳住之后,Wan 3.0 支持 4K 视频输出和最长 30 秒的片段。