Visnova 已接入阿里 Wan3.0:最长支持 30 秒文生视频与多模态参考统一升级
阿里云新一代视频生成模型 Wan3.0 正式进入用户视野。作为面向多模态输入的视频生成模型,Wan3.0 将文生视频、图生视频、首尾帧控制和参考生视频整合到统一模型中,并将单次视频生成时长扩展至最长30秒。
目前,Visnova 已完成 Wan3.0 接入。用户无需自行配置 API,即可通过 Visnova 的 AI 视频生成界面选择 Wan3.0,使用文字、图片等素材开始视频创作。
进入 Visnova AI 图片与视频生成,即可体验 AI 视频创作。
一、Wan3.0 有哪些值得关注的新能力?VISNOVA AI
Wan3.0-Video 的定位是一款 All-in-One 视频生成模型。根据阿里云百炼官方资料,模型可以接收文本、图像、视频、音频、文件和网页链接等多种输入,并统一完成文生视频、图生视频以及参考生视频等任务。
对于实际视频创作来说,这意味着用户不再只能从一句文字开始生成。已经有商品图片,可以直接让商品动起来;已经有人物参考图,可以围绕人物继续设计动作和镜头;如果希望控制视频的起始画面和结束画面,也可以通过首尾帧进行更明确的画面约束。
相比单一的文生视频模型,这种多模态参考方式更适合已有视觉素材的创作者、电商团队和品牌内容团队。

创作者在多屏工作站中使用 AI 视频工具编辑素材
二、最长30秒,让AI视频从“短片段”走向更完整镜头VISNOVA AI
Wan3.0 此次另一个值得关注的变化,是最长支持30秒视频生成。
阿里云百炼官方文档显示,在没有视频输入的情况下,Wan3.0 可生成2至30秒视频;同时提供480P、720P和1080P三档分辨率,并支持智能时长和音频输出。
过去使用 AI 视频模型制作稍长内容时,常见做法是分别生成多个5秒或10秒片段,再通过后期进行拼接。
视频时长扩展至30秒之后,一段素材可以容纳更完整的动作变化和镜头运动。例如商品从静态展示过渡到使用场景,人物完成一段连续走位,或者在一个镜头中完成环境变化,都有了更大的发挥空间。
当然,30秒并不意味着所有内容都需要直接生成30秒。对于商品展示、人物微动作和社交媒体素材来说,较短的视频依然更容易控制。更长的时长,真正增加的是创作者在镜头设计上的选择空间。

Visnova 一站式图视频 AI Agent 的视频生成界面
三、Visnova 已接入 Wan3.0,普通用户如何直接使用?VISNOVA AI
对于开发者来说,可以通过阿里云百炼调用 Wan3.0 API;但对于内容创作者、电商运营、设计师以及品牌团队来说,API 并不是体验新模型最直接的方式。
Visnova 目前已经接入 Wan3.0。进入 Visnova 的 AI 视频生成页面后,用户可以根据创作需求选择 Wan3.0,并通过文字描述或参考图片开始生成视频。Visnova 本身支持从文字或参考图片生成动态视频内容,可应用于商品展示、人物动态、电影感镜头、社交媒体视频以及广告创意等场景。
实际使用流程可以概括为:
对于第一次使用 Wan3.0 的用户,建议先从一个主体、一个主要动作和一种镜头运动开始测试。相比一次加入大量复杂要求,这种方式通常更容易判断模型对素材和提示词的理解是否符合预期。
四、Wan3.0 图生视频如何复用已有图片资产?VISNOVA AI
在 Visnova 的实际使用场景中,Wan3.0 图生视频尤其值得关注。很多电商和品牌团队并不缺图片,而是缺少能够快速投入社交媒体、广告投放和商品展示的视频素材。
例如已有一张香水产品图,可以让镜头缓慢环绕产品,同时增加玻璃高光变化和背景氛围;已有一张服装模特图,可以增加人物转身、衣摆摆动和镜头推进;已有一张风景图,也可以继续生成云层移动、水面变化或镜头前推效果。
这种工作方式的价值在于,企业已有的商品图、宣传图和视觉素材可以继续被复用,而不需要每次制作短视频都重新从拍摄开始。
在提示词写法上,图生视频也与文生视频有所不同。对于已经确定主体和构图的图片,不需要再次大篇幅描述画面,更重要的是明确说明:主体需要保持什么不变、主体如何运动、镜头如何运动,以及环境需要发生什么变化。
保持产品主体、包装结构和文字不变,镜头从正面缓慢推进并轻微向右环绕,产品表面高光随镜头自然移动,背景出现柔和光斑,整体保持高端商业广告摄影质感。这种提示方式通常比单纯添加“高级、电影感、8K”等风格词更有实际控制意义。

基于产品资料和商品图片生成广告视频的 Wan3.0 界面示意
五、从商品视频到社交媒体,Wan3.0 可以用在哪里?VISNOVA AI
从目前的模型能力来看,Wan3.0 不只是一个用于生成创意 Demo 的视频模型,在不少常见内容生产场景中都具备实际应用空间。
六、Visnova 如何持续扩展 AI 视频模型能力?VISNOVA AI
随着 AI 视频模型不断更新,创作工具的重点也正在发生变化。对于普通用户来说,仅仅“能生成视频”已经不够。能否快速切换模型、使用已有素材继续创作、控制人物和商品的一致性,以及能否将生成结果继续用于电商和营销内容,正在成为更加实际的问题。
Visnova 持续接入主流图像与视频生成模型,并将模型能力与商品视频、人物视觉、广告创意和社交媒体内容等实际工作场景结合,让用户可以在同一平台完成从图片到视频的创作流程。
此次 Wan3.0 的接入,也进一步补充了 Visnova 在长时长视频、多模态参考和图生视频方向的能力。目前用户已经可以通过 Visnova 使用 Wan3.0,尝试文生视频、图生视频以及更多基于参考素材的视频创作。
立即进入 Visnova AI 图片与视频生成,体验 Wan3.0 视频生成。