Wan 3.0
根据文字、图片或参考素材生成最长 30 秒、带原生音频的视频。
Wan 3.0 AI 视频生成器
在上方生成器中描述一个场景,Wan 3.0 就能把它变成带声音的视频,时长 2 到 30 秒不等。你也可以在图生视频中让静态图片动起来,或用参考生视频让角色保持一致。AI Hug 是提供 Wan 3.0 访问服务的独立平台,与 Alibaba 和 Wan 团队均无隶属关系。
- 2 到 30 秒视频
- 原生音频
- 支持文本、图片和参考素材输入

值得为 Wan 3.0 写的镜头
更长的时长足以容纳一个完整的瞬间,而不只是单个动作。下方画面仅为示意静帧,并非由 Wan 3.0 生成的视频;每一张都展示了一种适合该模型的镜头类型。在上方生成器中描述你自己的版本,即可得到带声音的动态视频。



适合更长时长和内置声音的创意
你可以用 Wan 3.0 创作什么
- 01
短故事场景
用一段连贯的视频完整演绎一个小瞬间,例如抵达、揭晓或一个反应。
- 02
音乐与环境音短片
为画面配上相应的声音,从街头表演到暴雨和人群嘈杂声。
- 03
产品展示
10 到 15 秒的转台或开箱镜头,配上合适的音效,适用于广告和商品页面。
- 04
让照片动起来
在图生视频页面以你的照片为起始帧,让静态图片动起来。
- 05
角色一致性
在参考生视频中使用参考图片、视频和音频,让面孔或服装保持一致。
- 06
社交媒体循环短片
适用于 Reels、Shorts 和 TikTok 的 9:16 竖屏短片,或适用于 YouTube 和网站的 16:9 视频。
如何使用 Wan 3.0
描述场景,设置时长,开始生成
- 1
描述场景与声音
写出主体、环境和镜头运动,再写明你想要的声音,例如音乐、人声或环境音。
- 2
设置时长和分辨率
选择 2 到 30 秒之间的时长,以及 480p、720p 或 1080p。时长越长、清晰度越高,消耗的积分越多。
- 3
生成并检查
打开声音观看结果,然后修改一个细节(如镜头速度或某个声音提示),再重新生成。
FAQ
Wan 3.0 常见问题解答
时长、音频、输入方式与访问
Wan 3.0 是什么?
Wan 3.0 是一款 AI 视频模型,可在 AI Hug 的视频生成器中使用。它能根据文本提示词、起始图片或参考素材生成带原生音频的视频。
Wan 3.0 视频最长可以多长?
每次生成 2 到 30 秒。生成前可通过时长滑块设置具体时长。
Wan 3.0 能生成声音吗?
能。音频与视频同步生成。在提示词中描述你想要的音乐、人声或环境音即可。
可以用我自己的图片开始吗?
可以。在图生视频页面选择 Wan 3.0,你上传的图片就会成为视频的起始画面。
Wan 3.0 的参考生视频怎么用?
在参考生视频页面上传参考图片、视频或音频,并在提示词中标记它们,Wan 3.0 就会据此保持主体一致。参考视频和音频片段每段最长 15 秒。
AI Hug 是否隶属于 Alibaba 或 Wan 团队?
不是。AI Hug 是提供 Wan 3.0 访问服务的独立平台,并未声称获得 Alibaba 或 Wan 团队的认可。
使用前需要检查视频吗?
需要。请打开声音完整观看视频,检查面部、手部和文字,并确认你对上传的参考素材及预期用途拥有相应权利。